Hagnaður:
- Geta til að tryggja samræmi í hugtakanotkun með því að koma á orðagrunni og skilgreina á skýran hátt samþykkt og bönnuð jafngildi
- Notkun gervigreindar til að draga fram umsækjendur fljótt og taka endanlega tímaákvörðun með sérfræðingnum og viðskiptavininum
- Geta til að tengja orðagrunn við tólið/kvaðninguna meðan á þýðingu stendur og greina ósamrýmanleika við QA ferð eftir þýðingu
Í tæknilegri þýðingu, ef þú þýðir orðið "notendareikningur" sem "notendareikningur" á einum stað, "meðlimareikningur" á öðrum stað, "notandasnið" á öðrum stað, mun notandinn glatast, vörumerkið virðist ósamræmi og leitin/skjölin verða brotin, jafnvel þótt textinn sé tæknilega "réttur". Hinn þögli en afgerandi gæðaþáttur þýðingar er hugtakasamkvæmni. Í þessari einingu munt þú læra hugtakastjórnun, búa til hugtakagrunn (hugtaksgagnagrunn), hugtakaútdrátt með gervigreind og hvernig á að viðhalda hugtakafræði í gegnum þýðingu. Markmiðið er að vera sérfræðingur sem hittir sömu hugmyndina í hverju verkefni á sama hátt alls staðar og er trúr tungumálinu.
Grunnhugtök
Hugtök eru orð og orðasambönd sem samsvara tilteknum hugtökum á sviði eða stofnun („úttekt“, „skilastefna“, „stofnfruma“). Termbase (TB — hugtaksgagnagrunnur) er skipulögð orðabók sem geymir jafngildi upprunamarkmiða, skilgreiningu, notkunarskýrslu og "bönnuð jafngildi" þessara hugtaka; Það tengist CAT verkfærum og stingur sjálfkrafa upp á þýðingu. Hugtakaútdráttur er ferlið við að safna sjálfkrafa hugtökum sem þarf að þýða/staðla úr texta. Orðalisti er einfaldari, tveggja dálka listi yfir hugtök; Það er notað í stað termbase í litlum störfum.
Af hverju er það svona mikilvægt? Vegna þess að vélþýðing og LLM í sjálfu sér tryggja ekki samræmi í hugtakanotkun. NMT getur þýtt hverja setningu sjálfstætt; LLM getur breytt ákvörðun sinni í löngum texta. Það sem veitir hugtakaaga er hugtakagrunnurinn sem þú hefur útbúið og tengt við ökutækið.
Ábending: Eyddu 30 mínútum í að setja upp tímabil í fyrsta starfi þínu hjá viðskiptavinum. Þessi fjárfesting eykur bæði hraða og gæði í allri síðari vinnu og gefur orðspor „samkvæmt vörumerki í þýðingum þínum“.
Hugtaksútdráttur og smíði termagrunns með gervigreind
Gervigreind flýtir fyrir leiðinlegasta hluta þess að setja upp hugtakagrunn: að finna umsækjendur. Þú getur gefið frumtexta til LLM og sagt, "lista lénssértæku hugtökin í þessum texta, þau sem eru endurtekin og þau sem krefjast samræmis í þýðingunni." Þú samþykkir síðan þennan lista yfir umsækjendur, ákvarðar rétt markmiðssvörun og staðfestir við viðskiptavininn þegar þörf krefur. Mikilvægt atriði: gervigreind bendir til umsækjenda um kjörtímabilið, sérfræðingurinn og viðskiptavinurinn taka ákvörðunina um kjörtímabilið. Hvort vörumerki kallar „stefnumót“ eða „bókun“ er val viðskiptavinarins, ekki gervigreindarinnar.
Fyrir hvert hugtak, settu eftirfarandi inn í Termbase: upprunahugtak, samþykkt markmiðshliðstæðu, stutt lýsing/samhengi, "ekki nota" (bönnuð) jafngildi og léns-/verkefnismerki ef við á. Að skrifa bannað jafngildi er áhrifaríkasta leiðin til að forðast ósamræmi (fyrir „reikning“, EKKI nota bara „reikning“; „prófíl“, „aðild“).
Viðhalda hugtakafræði alla þýðingu
Það er ekki nóg að setja upp Termbase; Það þarf að koma því til framkvæmda. Þrjú lög:
- Meðan á þýðingu stendur: Þegar þú ert að þýða yfir á LLM skaltu bæta orðagrunni við leiðbeiningarnar ("VERÐUR að nota þessa skilmála með þessum jafngildum"). Ef þú ert að nota CAT tól skaltu tengja termbase; Tólið sýnir samsvörun samstundis.
- QA eftir þýðingu: Skannaðu fullunna textann á móti orðagrunni. Ég spurði LLM "eru staðir í þessum texta sem eru ekki í samræmi við termbase?" eða keyra hugtakið QA fall CAT tólsins.
- Uppfærsla verkefnaloka: Bættu nýjum skilmálum og endurgjöf viðskiptavina við tímagrunn þegar vinnu er lokið; termbase er lifandi skjal.
Varúð: Þegar þú gefur LLM langtímagrunn gæti það "gleymt" sumum hugtökum eða breytt þeim eftir samhengi. Svo aldrei sleppa QA umferð eftir þýðingu; Hvetjandi kemur ekki í staðinn fyrir athugun.
þrjú smámál
Mál 1 — Termbase eyddi misræminu. Í 60.000 orða skjölum sem hugbúnaðarfyrirtæki með 5 mismunandi sjálfstætt starfandi þýðendum gerði, voru sömu 40 hugtökin þýdd á tugi mismunandi vegu. Þegar sameiginlegum orðagrunni var komið á og allar þýðingar voru samræmdar honum fækkaði umtalsvert kvörtunum eins og „ég finn ekki þennan skjá“ til notendastuðnings.
Tilfelli 2 — gervigreind minnkaði ályktun úr 2 dögum í 2 klst. Í stað þess að draga handvirkt út lista yfir hugtök úr 200 blaðsíðna tækjaskjali, lét læknaþýðingateymi LLM leggja drög að því: 380 umsækjendur voru skráðir á 2 klukkustundum. Sérfræðingur samþykkti þetta á 1 degi og skýrði svör þeirra; Það hefði tekið margar vikur ef það væri gert handvirkt. Ákvarðanir tilheyrðu fólki aftur.
Mál 3 - Bannregla afstýrði kreppu. Í hugtakagrunni vörumerkis var „viðskiptavinur“ samþykktur fyrir „viðskiptavinur“ og „notandi“ bannaður (vegna staðsetningar vörumerkis). Þegar nýr þýðandi skrifaði „notanda“ náði hugtakið QA það og röskun á vörumerkjamáli var lagfærð áður en það fór í loftið.
Fjögur afritanleg sniðmát
1) Útdráttur umsækjenda um tíma:
Þitt hlutverk: hugtakafræðingur. Úr eftirfarandi [lén] texta dregur út hugtök sem krefjast samræmis í þýðingu: lénssértæk hugtök, endurteknar setningar, vöru-/eiginleikaheiti, skammstafanir. Skráðu hvert hugtak á frummálinu, bættu við stuttri samhengisskýringu. Ákvörðunin er mín; Þú stingur bara upp á frambjóðanda. Að bæta við algengum orðum (og, en).Texti: [...]
2) Að búa til hugtakslínu:
Undirbúið orðagrunnslínu fyrir eftirfarandi hugtök: upprunahugtak | lagt til viðbrögð við miðum | stutt lýsing | röng svör til að forðast. Ef þú ert ekki viss skaltu merkja svarið með [?]; Ég mun taka ákvörðunina.Alan: [...] | Skilmálar: [...]
3) Þýðing sem er samhæfð við hugtök:
Þýddu þennan texta [heimild]→[markmið]. VERÐUR að nota hugtakagrunninn hér að neðan; EKKI NOTA bönnuð jafngildi:- [heimild1] → [mark1] (nota: [bannað1])- [heimild2] → [target2]Ef þú rekst á hugtak sem er ekki í hugtaksgrunni, merktu það með [?].Texti: [...]
4) Eftir þýðingu hugtak QA:
Skannaðu þýðinguna hér að neðan með orðagrunninum sem ég gaf upp. Nefndu bara ósamrýmanleika: hvaða hugtak var notað, hvar, með hvaða rangri merkingu, hvað ætti að vera það rétta. Tilkynning um samhæfðar staðsetningar.Tilorð: [...] | Þýðing: [...]
Veik kvaðning / Sterk kvaðning
Veik: "Farðu varlega með skilmálana." (Hvaða hugtak, hvaða jafngildi, hvaða bann — er óljóst; vélin velur sjálf.)
Sterkt: "Þegar þú ert að þýða þennan texta skaltu nota eftirfarandi hugtakagrunn: 'dashboard'→'dashboard', 'login'→'skrá sig inn'. Ef þú rekst á hugtak sem ekki er hugtak, settu [?] og búðu til það sjálfur."
Mismunur: sterk hvetja tilgreinir samþykkta hliðstæðuna, bannaða hliðstæðuna og óþekkta hugtakið hegðun; samræmi er tryggt.
Tafla yfir hugtakatól/aðferðir
Nálgun
Hvað gerir það?
takmörk
Orðalisti (tveir dálkar)
Lítil fyrirtæki, hröð byrjun
Engin skilgreining/bann
Termbase (tengdur CAT)
Sjálfvirk meðmæli, QA
Uppsetning krefst vinnu
Tímaútdráttur með LLM
Flýtir framboðslistanum
Fólk ræður
Term QA skanna
Greiðir ósamræmi
Hugtakagrunnur verður að vera uppfærður
Listi yfir bönnuð ákvæði
Viðheldur tungumáli vörumerkja
Krefst stöðugs viðhalds
Algeng mistök
- Byrja á stóru starfi án þess að setja upp Termbase. Ósamræmið eykst í kjölfarið veldishraða.
- Samþykkja svarið sem AI lagði til án spurninga. Orðalagsákvörðun er í höndum viðskiptavinar/sérfræðings.
- Ekki skrifa bönnuð svör. Það eitt að skrifa „rétt“ kemur ekki í veg fyrir „rangt“.
- Hugtakið eftir þýðingu er að sleppa QA. Að setja termbase í hvetjunni tryggir ekki framkvæmd hans.
- Ekki uppfæra Termbase. Dauður orðagrunnur mun afvegaleiða með tímanum.
Fjöltyngdur hugtakagrunnur og samþykki viðskiptavina
Í stórum verkefnum er hugtakagrunnurinn oft fjöltyngdur: hugtak á sér hliðstæðu á fleiri en einu markmáli (heimild → enska, þýska, tyrkneska, arabíska). Þetta tryggir samræmda þýðingu á sama hugtaki á öllum tungumálum og flýtir fyrir vinnu þegar nýju tungumáli er bætt við. Atriðið sem ber að hafa í huga í orðagrunninum á fjöltyngunni er að hvert tungumál hefur sitt menningarlega og málfræðilega jafngildi; Það er rangt að afrita jafngildið í blindni á einu tungumáli yfir á annað.
Hugtök hafa einnig keðju samþykkisvídd. Í mikilvægum skilningi ætti endanleg ákvörðun oft að vera tekin af sérfræðingi viðskiptavinarins eða vörumerkjateymi, ekki þýðandann; Vegna þess að þeir þekkja best hið opinbera/lagalega/vörumerkjagildi hugtaks. Þess vegna er góð venja í stórum störfum að merkja hugtakagrunninn sem „samþykkt“, „umsækjanda“ og „umdeild“: þú biður viðskiptavininn um umsækjanda og umdeild kjör að öllu leyti, færð þau samþykkt og læsir þeim síðan. Þessi fræðigrein kemur í veg fyrir „þetta hugtak ætti í raun að koma“ á óvart og fjöldaendurþýðingu.
Í stuttu máli
Orðafræðileg samkvæmni er ósýnilegi en mest afgerandi gæðaþáttur þýðingar. Þýðandinn setur sér hugtakagrunn um starfið; Það notar gervigreind til að draga fram umsækjendur í tíma, en skilur ákvörðunina eftir hjá viðskiptavininum og sérfræðingnum; skrifar greinilega samþykkt og bönnuð svör; Það tengir orðagrunn við hvetjandi/tól við þýðingu og sleppir aldrei QA lotunni eftir þýðingu. Termbase er lifandi skjal; vex í öllum viðskiptum og verndar vörumerkið.
Umsóknarverkefni
Veldu reittexta (tæknilegur, læknisfræðilegur eða markaðslegur). Dragðu út að minnsta kosti 15 hugtaksframbjóðendur með sniðmátinu „term umsækjendaútdráttur“, staðfestu þá og skrifaðu jafngildi, skilgreiningar og bönnuð jafngildi með „termgrunnlínu“ sniðmátinu. Þýddu svo stuttan texta með þessum orðagrunni, leitaðu að ósamrýmanleika við „term QA“ sniðmátið og lagaðu það sem þú finnur.
gátlisti
- [ ] Ég hef sett upp hugtakagrunn/orðalista í vinnunni.
- [ ] Ég samþykkti kjörtímabil AI og tók ákvörðunina.
- [ ] Auk samþykktra svara skrifaði ég einnig bönnuðu svörin.
- [ ] Ég tengdi termbase við hvetjandi/tól við þýðingu.
- [ ] Ég gerði QA skönnun eftir þýðingu og lagaði ósamrýmanleikann.