Câștiguri:
- Înțelegerea conceptelor de memorie de traducere (TM), potriviri și segmente neclare și posibilitatea de a utiliza diferențele dintre potrivirile neclare adaptându-le mai degrabă decât orbește.
- Abilitatea de a aplica disciplina de a scrie doar traduceri aprobate la TM, păstrând TM-urile clientului separat și efectuând întreținerea TM
- Capacitatea de a proteja confidențialitatea controlând unde merg datele în integrarea MT/LLM în CAT
Traducerea profesională se face cel mai adesea într-un instrument CAT, nu într-un editor de text simplu. În această unitate, veți învăța instrumentele CAT, memoria de traducere (TM) în centrul traducerii, cum funcționează împreună cu traducerea automată și LLM și cum să utilizați acest ecosistem în mod eficient și în siguranță. Scopul este de a deveni un utilizator de tehnologie de traducere care gestionează un proiect întreg, nu propoziții individuale, într-o manieră consistentă, rapidă și urmăribilă.
Concepte de bază
Instrumentul CAT (Computer-Assisted Translation) este un software profesional (precum Trados, memoQ, Phrase, MateCat) care organizează traducerea propoziție cu propoziție (segment) și conectează memoria de traducere și baza de termeni. Afișează sursa și ținta una lângă alta, prinde repetări, păstrează formatarea.
TM (Memorie de traducere) este o bază de date care stochează perechile de propoziții sursă-țintă pe care le-ați tradus anterior. Când sosește o nouă propoziție, dacă există o propoziție similară în TM, agentul ți-o sugerează. Conceptul cheie aici este potrivirea neclară: asemănarea noii propoziții cu o propoziție din TM (100% = exact la fel, 85% = în mare măsură similară). Potrivirile ridicate accelerează munca deoarece reutilizați traducerea anterioară.
Un segment este unitatea de bază a traducerii - de obicei o propoziție. Instrumentul CAT împarte textul în segmente și editează fiecare separat.
Importanța TM: MT produce schițe brute, dar TM returnează traducerile tale aprobate, de calitate umană. Cele două sunt diferite: MT este o predicție, TM este o amintire.
Sfat: Nu confundați TM și MT. O potrivire 100% TM (traducerea dvs. aprobată anterior) este în general de încredere; Recomandarea MT trebuie întotdeauna verificată. Instrumentele CAT le arată pe cele două cu culori/etichete diferite; vezi întotdeauna această diferență.
Integrarea MT și LLM în CAT
Instrumentele CAT moderne apelează la interior motoarele MT și din ce în ce mai multe LLM-uri: dacă nu există potriviri în TM, agentul returnează automat o recomandare MT pentru segment; îl posteditați (adică MTPE curge în CAT). Instrumentele de ultimă generație integrează și LLM: puteți face operațiuni precum „rescrieți acest segment cu acest ton”, „corectați acest termen în baza de date” etc. în instrument.
Avantajul acestei integrări: TM, termbase, MT și LLM sunt combinate într-un singur ecran; Pentru fiecare propoziție, se stabilește fluxul „priviți mai întâi TM, altfel sugerați MT, termenul QA automat”. Dezavantaj și atenție: unde se duc datele? Integrarea MT/LLM bazată pe cloud poate trimite text către servere externe; În munca confidențială, aceasta poate fi o încălcare a contractului. Asigurați-vă că știți la ce motor este conectat vehiculul și cu ce politică de date.
Alimentarea și ștergerea memoriei de traducere
Valoarea TM este la fel de mult ca și calitatea traducerilor din acesta. Gunoi înăuntru, gunoi afară. Două discipline:
- Doar scrieți traducerea certificată în TM. Dacă salvați rezultatul brut MT în TM fără a o valida, acesta va reveni la viitoarele dvs. locuri de muncă ca „memorie” proastă.
- Efectuați întreținerea TM. În timp, termenii se schimbă și intră erori. Curățați periodic TM, corectați perechile uzate/incorecte. În această lucrare, folosesc LLM pentru a întreba „există inconsecvențe/disturbiri de termen în aceste perechi TM?” Îl poți folosi ca auditor.
Atenție: Utilizarea TM a unui client în afacerea altui client reprezintă atât o încălcare a confidențialității, cât și un risc de confuzie pe termen lung. TM-urile sunt păstrate separate în funcție de client/proiect. Un „totul TM” mixt distruge atât confidențialitatea, cât și calitatea.
trei mini cutii
Cazul 1 — TM a zburat reluările. Un producător avea să fie tradusă o familie de produse în care 70% din manualul său rămânea aceeași an de an. Datorită TM, potrivirile 100% și foarte neclare au venit automat în fiecare versiune nouă; Doar ~ 9.000 de cuvinte din cele 30.000 de cuvinte au fost traduceri reale noi. Timpul și costurile au fost reduse cu o treime.
Cazul 2 — Dirty TM a propagat eroarea. O echipă a salvat rezultatul brut MT în TM fără verificare. Un an mai târziu, aceeași traducere greșită a revenit din nou și din nou, părând „de încredere” ca o potrivire 100%; Eroarea a fost răspândită în 14 documente diferite. Echipa a instituit o regulă „doar traducerea certificată în TM” și un tur de curățare.
Cazul 3 – Confidențialitate scursă în integrare. Un traducător a lucrat confidențial într-un proiect CAT care a fost conectat automat la cloud MT; Textul a ajuns la un motor extern a cărui politică de date este neclară. Odată observată, integrarea MT pentru proiecte secrete a fost dezactivată și au fost folosite doar motoare de întreprindere care „nu stochează/întrenează date”.
Patru șabloane copiabile
1) Evaluarea potrivirii neclare (la LLM):
Mai jos este noua propoziție sursă, propoziția similară în TM și traducerea ei aprobată. Spune-mi exact ce trebuie să schimb pentru a adapta traducerea TM la noua propoziție; Nu sugerați modificări inutile. Arătați clar diferența de sens. Sursă nouă: [...] | sursa TM: [...] | traducere TM: [...]
2) Verificarea consistenței TM:
Mai jos sunt perechile sursă-țintă de la TM. Marcați inconsecvențele și abaterile termenilor în cazul în care propozițiile sursă aceleași sau foarte similare sunt traduse DIFERIT. Doar enumerați problemele.Cupluri: [...]
3) Rescrierea tonului segmentului (LLM în CAT):
Realizați următorul segment țintă [tonul dorit] FĂRĂ A SCHIMBA sensul. Respectați lista de termeni: [...]. Păstrați numere și nume. Exportați numai segmentul rescris. Segment: [...]
4) Verificare prealabilă a confidențialității/integrarii:
Voi folosi integrarea MT/LLM într-un proiect CAT. Voi descrie tipul de text din acest proiect; Spuneți-mi dacă este potrivit să trimit acest text către un motor extern bazat pe cloud, ce întrebări (reținerea datelor, instruire, locație) ar trebui să adresez furnizorului. Tipul de text/starea confidențialității: [...]
Prompt slab / Prompt puternic
Slab: „Folosește traducerea în TM”. (Nu este clar ce rata de potrivire și ce să se adapteze; copierea oarbă introduce erori.)
Puternic: „Această nouă propoziție se potrivește cu propoziția din TM 90% din timp. Construiți-vă pe traducerea TM, dar reflectați această diferență: sursa are „anual” în loc de „lunar”, deci ar trebui să fie „anual” în loc de „lunar”. Nu schimbați nimic altceva."
Diferență: promptul puternic indică diferența de meci; Împiedică „lăsarea vechii traduceri așa cum este”, care este cea mai frecventă greșeală de potrivire neclară.
Tabelul componentelor ecosistemului CAT
componentă
Ce face
relația cu AI
TM (memorie de traducere)
Returnează traduceri aprobate din trecut
Fiabil; precede MT
Baza de termeni
Asigură consistența termenului
Este dat ca o solicitare pentru LLM
Recomandare MT
Schiță brută în segment gol
Trebuie să fie post-editat
Integrare LLM
Ton/termen/rescriere
Controlat, atentie la intimitate
Modul QA
Scanează eroare de număr/termen/etichetă
control automat
Greșeli comune
- Acceptând orbește meciul neclar. O potrivire de 85% poate ascunde o diferență de sens de 15%.
- Scrierea ieșirii brute MT în TM. Dirty TM duce eroarea în viitor și o proliferează.
- Mixarea TM-urilor client/proiect. Confidențialitate și risc de confuzie a termenilor.
- Neștiind unde se duc datele de integrare. Textul ascuns se poate scurge fără ca tu să fii conștient de el.
- Uitând diferența TM/MT. MT este o estimare; TM este o amintire. Cei doi nu sunt la fel de siguri.
Pre-traducere și aliniere
Două funcții CAT avansate accelerează și mai mult fluxul de lucru în era AI. Prima este pre-traducere: la începutul proiectului, instrumentul umple automat toate segmentele cu TM și MT; În loc de un fișier gol, începeți cu un fișier în care potrivirile 100% sunt aprobate, potrivirile neclare așteaptă să fie adaptate, iar cele goale sunt schițe MT. Acest lucru schimbă munca de la „scriere de la zero” la „revizuire și editare” – dar trebuie să evaluați fiecare segment în loc să aprobați orbește pre-traducere.
A doua este alinierea: dacă aveți o pereche de document sursă-țintă care a fost tradusă înainte, dar nu a intrat în TM, instrumentul de aliniere le potrivește segment cu segment și le convertește în TM. Astfel, traducerile tale anterioare sunt adăugate la „memorie”. Atenție la aliniere: potrivirea automată nu este întotdeauna corectă; alunecarea unui segment perturbă întregul aliniament. Revizuirea perechilor aliniate înainte de TMing previne în primul rând riscul de TM murdară. Aceste două funcții transformă activele tale actuale (traduceri anterioare) în investiții în afaceri viitoare.
Pe scurt
instrumente CAT; Combină memoria de traducere, baza terminologică, traducerea automată și LLM într-o singură linie de producție. TM este o memorie care preia traducerile aprobate din trecut și oferă o viteză mare în sarcinile repetitive; MT este o predicție care trebuie întotdeauna verificată. Utilizatorul inteligent adaptează cu atenție diferența dintre potrivirile neclare, scrie doar traduceri aprobate în TM, păstrează TM-urile clientului separat și protejează confidențialitatea știind unde se îndreaptă datele în integrare.
Sarcina de aplicare
Configurați un mic proiect într-un instrument CAT (funcționează și un CAT online gratuit): adăugați o bază de termeni și un TM gol. Traduceți un text de 10 propoziții, salvați traducerile aprobate în TM. Apoi traduceți un al doilea text foarte asemănător cu primul text și adaptați potrivirile fuzzy returnate de TM cu șablonul „evaluare fuzzy match”; Observați câte propoziții ați greși dacă ați accepta orbește TM.
lista de verificare
- [ ] Am conectat TM și baza terminologică la proiect.
- [ ] Am folosit diferența dintre potrivirile neclare mai degrabă adaptiv decât orbește.
- [ ] Am scris către TM doar traducerea certificată pe care am verificat-o.
- [ ] Am ținut separat TM-urile client/proiect.
- [ ] Am verificat unde merg datele în integrarea MT/LLM.