Eenheid 3 / 11

Machinevertaling nabewerking (MTPE): lichtgewicht en volledige nabewerking

Winst:

  • Mogelijkheid om onderscheid te maken tussen lichte en volledige nabewerkingsniveaus en het juiste niveau te kiezen op basis van het doel en de zichtbaarheid van de tekst
  • Mogelijkheid om een efficiënte nabewerkingsstroom te implementeren die alleen corrigeert wat nodig is, waarbij zowel overcorrectie als ondercorrectie wordt vermeden
  • Mogelijkheid om een aparte controleronde uit te voeren voor getal, ontkenning en term en de efficiëntie van nabewerking te meten met tijd en bewerkingsafstand

De meest gebruikelijke manier waarop professionele vertalingen vandaag de dag werken, is niet een geheel nieuwe vertaling, maar MTPE (Machine Translation Post-Editing): de machine produceert een ruwe versie, de menselijke vertaler corrigeert deze en maakt deze gereed voor publicatie. In dit onderdeel leer je de twee formele niveaus van nabewerking (licht en volledig), hoe je welke op welke tekst toepast, een efficiënte nabewerkingsstroom en de valkuil van 'overbewerking'. Het doel is om een ​​evenwichtige post-editor te worden die kwaliteit garandeert en tegelijkertijd de tijd behoudt die de machine je geeft.

Twee niveaus: lichte en volledige nabewerking

Post-regulering in de industrie wordt gedefinieerd op twee standaardniveaus (ISO 18587 is de internationale standaard voor dit bedrijf):

Lichte nabewerking: het doel is om de tekst duidelijk en accuraat te maken – niet perfect. Je corrigeert fouten die de betekenis vertekenen, verkeerd vertaalde informatie, ernstige grammaticale fouten; Maar je maakt geen stilistische accenten omdat ‘dat mooier zou zijn’. Geschikt voor: intern gebruik, snelle informatie, slecht zichtbare tekst, kernvertalingen.

Volledige nabewerking: Het doel is dat de output niet te onderscheiden is van menselijke vertaling. Betekenis, terminologie, toon, flow, toon – alles moet van uitzendklare kwaliteit zijn. Geschikt voor: alle teksten met merkzichtbaarheid die gepubliceerd worden, aangeleverd aan de klant.

Het combineren van de twee niveaus levert problemen op: als je lichte nabewerking toepast op een te publiceren tekst, zal de kwaliteit slecht zijn; Als u een interne notitie volledig nabewerkt, verliest u tijd en geld. Maak vóór aanvang van de werkzaamheden met de opdrachtgever duidelijk welk niveau wordt verwacht.

Tip: Wanneer de klant zegt "machinevertaling, goedkoop", wil hij meestal "licht" maar heeft hij het over een tekst die "gepubliceerd" zal worden – bespreek deze tegenstrijdigheid van tevoren. Als de verwachting niet duidelijk is, vraag je je af: "Waarom is dit niet perfect?" of “waarom duurde dit zo lang?” Er ontstaat een ruzie.

Overbewerkingsval

MTPE's meest verraderlijke vijand van efficiëntie is overcorrectie: het herschrijven van een zin die de machine je heeft gegeven en die correct is, maar niet jouw keuze, alleen maar omdat "ik het zo zou schrijven." Dit vernietigt het volledige tijdvoordeel van MTPE. De regel is duidelijk: als de uitvoer van de machine accuraat, begrijpelijk en passend is, raak deze dan niet aan; corrigeer deze alleen als deze verkeerd is. Smaakveranderingen zijn beperkt bij volledige nabewerking en vrijwel verboden bij lichte nabewerking.

Het tegenovergestelde is ook gevaarlijk: te weinig redactie, waarbij de vloeiende maar onjuiste zin van de machine wordt doorgegeven als 'ziet er goed uit'. Balans is de discipline van ‘corrigeren wat nodig is, laten wat niet nodig is’.

Let op: Overcorrectie komt vaak voor bij beginnende postredacteuren, terwijl ondercorrectie ontstaat door vermoeidheid en tijdsdruk. Om uit de buurt van beide extremen te blijven: "Verbetert deze verandering de betekenis/nauwkeurigheid/toon, of is het gewoon mijn smaak?" vragen.

Efficiënte nabewerkingsstroom

Een praktisch stappenplan:

  1. Eerst scannen, later repareren. Lees de tekst een keer door; zie het geheel, de toon en de herhalende fouten.
  2. Markeer items met een hoog risico. Getallen, datums, ontkenningen, eigennamen, eenheden: geef deze een aparte rondleiding.
  3. Corrigeer semantische fouten. Alles wat de trouw aan de bron verbreekt, komt op de eerste plaats.
  4. Stem term en consistentie op elkaar af. Match Termbase en eerdere vertalingen.
  5. Vloei en toon corrigeren (volledige nabewerking). Naturaliseer zinnen die naar vertaling ruiken.
  6. Laatste lezing. Zonder naar de bron te kijken, lees je de doeltekst gewoon als een lezer; Als je vastloopt, repareer het dan.

U kunt de LLM in deze stroom als een ‘tweede oog’ gebruiken: door de uitvoer van de machine naar de LLM te sturen en deze te vertellen ‘alleen de risicovolle gebieden te markeren’, verkleint u uw blinde vlekken – maar de uiteindelijke beslissing is aan u.

drie minikoffers

Geval 1 — Het juiste niveau bespaarde tijd. Een bedrijf liet zijn interne kennisbankartikelen van 40.000 woorden vertalen, zodat werknemers deze konden begrijpen. De vertaler paste lichte nabewerking toe: corrigeerde 60 fouten die de betekenis vervormden en liet geen stilistische accenten achter. De klus was 55% sneller geklaard dan de volledige nabewerking en het doel werd bereikt.

Geval 2 — Facturering wegens overcorrectie. Een beginnende postredacteur herschreef de juiste zinnen, zodat ze 'vloeiender' verliepen. Uit de meting bleek dat 70% van de bewerkte zinnen al acceptabel was; Door de extra tijd die werd besteed, werd de klus twee dagen eerder dan gepland uitgevoerd en ging de winst verloren. Het team heeft de regel 'repareer het alleen als het fout is' opgeschreven.

Geval 3 — Onvoldoende correctie opgevangen. In een handleiding voor medische apparaten vertaalde de machine de zinsnede "niet onderdompelen" vloeiend maar onvolledig, waarbij alleen "schoon" werd gezegd in plaats van "niet onderdompelen". De ronde met hoog-risico-items heeft deze beveiligingsbug ontdekt; Hieruit bleek hoe een ontoereikende correctie in gevaar kan uitmonden.

Vier kopieerbare sjablonen

1) Niveaubepaling na bewerking:

Jouw rol: MTPE projectconsultant. Ik zal het doel en de zichtbaarheid van de tekst beschrijven. Vertel me of lichte of volledige nabewerking geschikt is voor deze taak, wat de reden is en wat ik op elk niveau moet corrigeren of laten. Doel/zichtbaarheid van de tekst: [leg uit]

2) Tweede ooginspectie (naar LLM):

Hieronder vindt u de bron en de machinevertaling. Markeer fouten met HOOG RISICO die een postredacteur mogelijk over het hoofd ziet: dubbelzinnigheid, weggelaten/toegevoegde informatie, verkeerd nummer/datum/naam, ontkenningsfout, inconsistente term. Stilistische suggesties doen.Bron: [...] | Vertaling: [...]

3) Lichte nabewerkingsinstructie:

Bewerk de onderstaande machinevertaling LICHT na: corrigeer alleen verwarrende, onnauwkeurige of onduidelijke delen. Verander uw stijl of smaak niet. Laat elke zin die correct en begrijpelijk is zoals die is. Geef kort aan wat je hebt gewijzigd en waarom. Vertaling: [...] | Bron: [...]

4) Overcorrectiecontrole (naar uw eigen correctie):

Hieronder vindt u de zin van de machine en mijn correctie. Zeg voor elke correctie: is deze verandering (a) de juiste betekenis/juistheid, (b) vereist deze terminologie/consistentie, of (c) is dit slechts een stilistische voorkeur? (c) markeer deze als "kan onnodig zijn". Machine: [...] | Mijn oplossing: [...]

Zwakke prompt/sterke prompt

Zwak: "Repareer deze vertaling." (Niveau onduidelijk; LLM herschrijft alles, corrigeert te veel.)

Strong: "Volledige nabewerking van deze machinevertaling: maak de betekenis, terminologie en vloeiendheid klaar voor publicatie, maar blijf trouw aan de bron, voeg niets toe. Verander correcte zinnen niet onnodig. Label de reden voor elke verandering (betekenis/term/stroom) met een woord."

Verschil: sterke prompt geeft niveau, limiet en rechtvaardigingsvereiste; voorkomt zowel overcorrectie als ondercorrectie.

Niveauvergelijkingstabel

Grootte

Lichte nabewerking

Volledige nabewerking

doel

Nauwkeurig en begrijpelijk

Kwaliteit van menselijke vertalingen

semantische fouten

wordt gecorrigeerd

wordt gecorrigeerd

Consistentie van de termijn

basisniveau

vol

toon/stijl

onaantastbaar

Klaar om te publiceren

Stilistische verbetering

niet gedaan

Beperkt, indien nodig

Toepasselijke tekst

intern, tijdelijk, essentie

gepubliceerd, merk

Tijd/kosten

laag

hoog

Veel voorkomende fouten

  • Het niveau met de klant niet verduidelijken. De verwachting ‘het moet goedkoop zijn’ en ‘het moet perfect zijn’ conflicteren.
  • Overcorrectie. Voor het plezier de juiste zin herschrijven en het tijdsvoordeel vernietigen.
  • Onvoldoende correctie. Een vloeiende maar verkeerde zin uitspreken; De gevaarlijkste zijn veiligheids-/telfouten.
  • Geen aparte rondes maken voor items met een hoog risico. Getal- en negatiefouten worden in de stroom over het hoofd gezien.
  • De laatste lezing overslaan. Als je de doeltekst leest zonder naar de bron te kijken, komen eventuele resterende ruwheden aan het licht.

Efficiëntie meten: afstand en duur bewerken

Gebruik twee eenvoudige indicatoren om te meten hoe “waarde” de post-edit is. De eerste is tijd: het verschil tussen het helemaal opnieuw vertalen van hetzelfde boek en het nabewerken; Versnelt MTPE daadwerkelijk, of loopt u vast door overcorrectie? De tweede is de bewerkingsafstand: het is de verhouding van hoeveel van de machine-uitvoer u wijzigt. Een te kleine bewerkingsafstand (bijna niet aanraken) is een teken van slechte montage; Als de bewerkingsafstand te groot is (bijna herschrijven), is de tekst niet geschikt voor de machine of corrigeert u te veel. Als je deze twee indicatoren in meerdere banen volgt, zul je concreet zien in welk type tekst MTPE echt winst oplevert, waarbij het verstandiger is om helemaal opnieuw te vertalen. Je kunt een proces dat je niet meet niet verbeteren; Kijk naar deze twee cijfers in plaats van naar intuïtie.

Samengevat

MTPE is tegenwoordig de belangrijkste manier waarop vertalingen werken en kent twee niveaus: lichte nabewerking, waardoor de tekst accuraat en begrijpelijk wordt, en volledige nabewerking, waardoor de tekst menselijke kwaliteit krijgt. De master post-editor verduidelijkt het niveau voordat hij aan de slag gaat; corrigeert alleen wat nodig is en vermijdt zowel overcorrectie als ondercorrectie; voert een aparte controleronde uit op getal, ontkenning en term; Hij gebruikt de LLM als tweede paar ogen, maar neemt zelf de uiteindelijke beslissing.

Applicatie taak

Ontvang een machinevertaling van een tekst van 150-200 woorden. Pas eerst lichte nabewerking toe en meet de tijd; pas vervolgens volledige nabewerking toe op dezelfde tekst (op schone kopie) en vergelijk de tijd en het aantal wijzigingen. Gebruik ten slotte het sjabloon ‘overcorrectiecontrole’ om te bepalen hoeveel van de wijzigingen die u aanbrengt daadwerkelijk noodzakelijk zijn en hoeveel stilistisch.

controlelijst

  • [ ] Ik heb het licht/volledig niveau met de klant verduidelijkt.
  • [ ] Ik corrigeerde het alleen als het fout was; Ik heb de juiste zinnen niet onnodig veranderd.
  • [ ] Ik heb een aparte auditronde gedaan op het aantal, de datum, de naam en de negatieven.
  • [ ] Ik heb de veiligheids-/kritische straffen met de bron bevestigd tegen het risico van onvoldoende correctie.
  • [ ] Ik heb het proefgelezen zonder naar de bron te kijken.