Ieguvumi:
- Spēja nodrošināt terminoloģijas konsekvenci, izveidojot terminu bāzi un skaidri definējot apstiprinātos un aizliegtos ekvivalentus
- Mākslīgā intelekta izmantošana, lai ātri iegūtu kandidātus un pieņemtu galīgo lēmumu ar ekspertu un klientu
- Iespēja tulkošanas laikā savienot terminu bāzi ar rīku/uzvedni un atklāt nesaderības ar terminu kvalitātes nodrošināšanas ceļvedi pēc tulkošanas
Tehniskā tulkojumā, ja vārdu "lietotāja konts" tulkojat kā "lietotāja konts" vienā vietā, "biedra konts" citā vietā, "lietotāja profils" citā vietā, lietotājs tiks pazaudēts, zīmols izskatīsies nekonsekvents un meklēšana/dokumentācija tiks bojāta, pat ja teksts ir tehniski "pareizs". Klusais, bet noteicošākais tulkojuma kvalitātes elements ir terminoloģiskā konsekvence. Šajā nodaļā jūs apgūsit terminoloģijas pārvaldību, terminu bāzes (terminu datubāzes) izveidi, terminu izgūšanu ar AI un to, kā tulkošanas laikā saglabāt terminoloģijas disciplīnu. Mērķis ir būt ekspertam, kurš katrā projektā vienādi visur atbilst vienam un tam pašam jēdzienam un ir lojāls korporatīvajai valodai.
Pamatjēdzieni
Terminoloģija ir vārdi un izteicieni, kas atbilst konkrētiem jomas vai institūcijas jēdzieniem ("kase", "atgriešanas politika", "cilmes šūna"). Terminu bāze (TB — terminu datubāze) ir strukturēta vārdnīca, kurā tiek saglabāti šo terminu avota-mērķa ekvivalenti, definīcija, lietošanas piezīme un "aizliegtie ekvivalenti"; Tas savienojas ar CAT rīkiem un automātiski iesaka tulkojumu. Terminu izvilkšana ir process, kurā tiek automātiski apkopoti termini, kas no teksta ir jātulko/standartizē. Glosārijs ir vienkāršāks terminu saraksts ar divām kolonnām; To izmanto terminu bāzes vietā mazos darbos.
Kāpēc tas ir tik svarīgi? Tā kā mašīntulkošana un LLM paši par sevi negarantē terminoloģijas konsekvenci. NMT var tulkot katru teikumu neatkarīgi; LLM var mainīt savu lēmumu garā tekstā. Terminu disciplīnu nodrošina terminu bāze, kuru esat sagatavojis un pievienojis transportlīdzeklim.
Padoms. Pavadiet 30 minūtes, lai izveidotu terminu bāzi savam pirmajam darbam ar klientu. Šis ieguldījums palielina ātrumu un kvalitāti visos turpmākajos darbos un nodrošina "jūsu tulkojumos konsekventa zīmola" reputāciju.
Terminu ieguve un terminu bāzes veidošana ar AI
AI paātrina terminu bāzes izveides nogurdinošāko posmu: kandidātu atrašanu. Varat sniegt avota tekstu LLM un teikt: "norādiet šajā tekstā domēnam raksturīgos terminus, tos, kas atkārtojas, un tos, kuriem nepieciešama konsekvence tulkojumā". Pēc tam jūs apstipriniet šo kandidātu sarakstu, nosakiet pareizo mērķa atbildi un, ja nepieciešams, apstipriniet ar klientu. Kritiskais punkts: AI iesaka termiņa kandidātus, eksperts un klients pieņem termiņa lēmumu. Neatkarīgi no tā, vai zīmols sauc par "tikšanos" vai "rezervāciju", ir klienta, nevis AI izvēle.
Katram terminam terminu bāzē ievietojiet šādu informāciju: avota termins, apstiprināts mērķa ekvivalents, īss apraksts/konteksts, "nelietot" (aizliegti) ekvivalenti un domēna/projekta tags, ja piemērojams. Aizliegto ekvivalentu rakstīšana ir visefektīvākais veids, kā izvairīties no nekonsekvences ("kontam" NELIETOJIET tikai "kontu"; "profils", "biedrība").
Terminoloģijas disciplīnas saglabāšana tulkošanas laikā
Ar Termbase instalēšanu nepietiek; Tas ir jāīsteno. Trīs slāņi:
- Tulkošanas laikā: tulkojot uz LLM, uzvednei pievienojiet terminu bāzi ("OBLIGĀTI jāizmanto šie termini ar šiem ekvivalentiem"). Ja izmantojat CAT rīku, pievienojiet terminu bāzi; Rīks uzreiz parāda atbilstību.
- Pēctulkošanas QA: skenējiet gatavo tekstu, salīdzinot ar terminu bāzi. Es jautāju LLM "vai šajā tekstā ir vietas, kas neatbilst terminu bāzei?" vai palaidiet CAT rīka termina QA funkciju.
- Projekta beigu atjauninājums: pievienojiet jaunus noteikumus un klientu atsauksmes terminu bāzei, kad darbs ir pabeigts; terminu bāze ir dzīvs dokuments.
Uzmanību! Ja piešķirat LLM ilgtermiņa terminu bāzi, tas var "aizmirst" dažus terminus vai mainīt tos atkarībā no konteksta. Tāpēc nekad neizlaidiet pēctulkošanas kvalitātes nodrošināšanas kārtu; Uzvedne neaizstāj pārbaudi.
trīs mini futrāļi
1. gadījums — Termbase izdzēsa neatbilstību. 60 000 vārdu dokumentācijā, ko izstrādājis programmatūras uzņēmums ar 5 dažādiem ārštata tulkiem, tie paši 40 termini tika tulkoti desmitiem dažādu veidu. Tiklīdz tika izveidota kopēja terminu bāze un visi tulkojumi tika saskaņoti ar to, lietotāju atbalstam tika saņemtas tādas sūdzības kā “Es nevaru atrast šo ekrānu”.
2. gadījums — AI samazināja secinājumus no 2 dienām līdz 2 stundām. Tā vietā, lai manuāli izvilktu terminu sarakstu no 200 lappušu gara ierīces dokumenta, medicīnas tulkošanas komanda sagatavoja LLM projektu: 2 stundu laikā tika uzskaitīti 380 kandidātu termini. Eksperts tos apstiprināja 1 dienas laikā un precizēja savas atbildes; Tas būtu prasījis nedēļas, ja tas būtu izdarīts manuāli. Lēmumi atkal piederēja cilvēkiem.
3. gadījums — aizlieguma noteikums novērsa krīzi. Zīmola terminu bāzē “klients” tika apstiprināts kā “klients” un “lietotājs” bija aizliegts (zīmola pozicionēšanas dēļ). Kad jauns tulkotājs ierakstīja “lietotājs”, termins QA to uztvēra, un zīmola valodas izkropļojumi tika novērsti pirms tā publicēšanas.
Četras kopējamas veidnes
1) Termiņa kandidāta izvilkšana:
Jūsu loma: terminologs. No šāda [domēna] teksta izņemiet terminus, kuru tulkojumā nepieciešama konsekvence: domēnam raksturīgi jēdzieni, atkārtotas frāzes, produktu/iezīmju nosaukumi, saīsinājumi. Uzskaitiet katru terminu avota valodā, pievienojiet īsu konteksta piezīmi. Lēmums ir mans; Jūs vienkārši iesakāt kandidātu. Kopīgu vārdu pievienošana (un, bet).Teksts: [...]
2) Termbase rindiņas izveide:
Sagatavojiet terminu bāzes rindu šādiem terminiem: avota termins | ieteicamā mērķa reakcija | īss apraksts | nepareizas atbildes, no kurām izvairīties. Ja neesat pārliecināts, atzīmējiet atbildi ar [?]; Es pieņemšu lēmumu.Alans: [...] | Noteikumi: [...]
3) ar terminu bāzi saderīgs tulkojums:
Tulkot šo tekstu [avots] → [mērķis]. OBLIGĀTI jāpiemēro tālāk norādītā terminu bāze; NELIETOJIET aizliegtus ekvivalentus:- [avots1] → [mērķis1] (izmantot: [forbidden1])- [source2] → [target2]Ja sastopaties ar terminu, kas nav terminu bāzē, atzīmējiet to ar [?]. Teksts: [...]
4) Pēctulkošanas termins QA:
Skenējiet tālāk sniegto tulkojumu, salīdzinot ar manis sniegto terminu bāzi. Vienkārši uzskaitiet NEATBILSTĪBAS: kurš termins tika lietots, kur, ar kādu nepareizu nozīmi, kādam jābūt pareizajam. Ziņošana par saderīgām atrašanās vietām.Termbaze: [...] | Tulkojums: [...]
Vāja uzvedne / spēcīga uzvedne
Vāji: "Esiet uzmanīgs ar noteikumiem." (Kurš termins, kurš ekvivalents, kurš aizliegums — nav skaidrs, mašīna izvēlas pati.)
Strong: "Tulkojot šo tekstu, izmantojiet šādu terminu bāzi: "informācijas panelis" → "informācijas panelis", "piesakieties" → "pieteikties". Ja saskaraties ar terminu, kas nav termins, ievietojiet [?] un izdomājiet to pats."
Atšķirība: spēcīga uzvedne norāda apstiprināto ekvivalentu, aizliegto ekvivalentu un nezināmā vārda uzvedību; konsekvence ir garantēta.
Terminoloģijas rīku/pieeju tabula
Pieeja
Ko tas dara?
ierobežojums
Glosārijs (divas kolonnas)
Mazs bizness, ātrs sākums
Nav definīcijas/aizlieguma
Terminu bāze (savienota ar CAT)
Automātisks ieteikums, QA
Uzstādīšanai nepieciešams darbaspēks
Termiņu ieguve ar LLM
Paātrina kandidātu sarakstu
Cilvēki izlemj
Termina QA skenēšana
Noķer disonansi
Termiņu bāzei ir jābūt atjauninātai
Aizliegto noteikumu saraksts
Uztur zīmola valodu
Nepieciešama pastāvīga apkope
Biežas kļūdas
- Liela darba sākšana, neinstalējot Termbase. Neatbilstība pēc tam pieaug eksponenciāli.
- AI ieteiktās atbildes pieņemšana bez jautājuma. Terminoloģijas lēmums ir klienta/eksperta ziņā.
- Nerakstīt aizliegtas atbildes. Tikai uzrakstot "pareizo", tas nenovērš "nepareizo".
- Termins pēc tulkošanas ir kvalitātes nodrošināšanas izlaišana. Terminu bāzes ievietošana uzvednē negarantē tās ieviešanu.
- Termbase netiek atjaunināta. Nedzīva terminu bāze laika gaitā maldinās.
Daudzvalodu terminu bāze un klientu apstiprinājums
Lielos projektos terminu bāze bieži ir daudzvalodu: jēdzienam ir līdzinieks vairāk nekā vienā mērķa valodā (avots → angļu, vācu, turku, arābu). Tas nodrošina vienas un tās pašas koncepcijas konsekventu tulkojumu visās valodās un paātrina darbu, pievienojot jaunu valodu. Daudzvalodu terminu bāzē ir jāņem vērā tas, ka katrai valodai ir savs kultūras un gramatiskais ekvivalents; Ir nepareizi akli kopēt ekvivalentu vienā valodā citā.
Terminoloģijai ir arī apstiprināšanas ķēde. Kritiski runājot, galīgais lēmums bieži vien ir jāpieņem klienta priekšmeta ekspertam vai zīmola komandai, nevis tulkotājam; Jo viņi vislabāk zina termina oficiālo/juridisko/zīmola ekvivalentu. Tāpēc lielos darbos ir laba prakse terminu bāzi atzīmēt kā "apstiprināts", "kandidāts" un "apstrīdēts": jūs prasāt klientam kandidātus un strīdīgos nosacījumus, saņemat apstiprinājumu un pēc tam bloķējat. Šī disciplīna novērš starpuzdevuma “šim terminam patiesībā vajadzētu būt” pārsteigumu un masveida atkārtotu tulkošanu.
Rezumējot
Terminoloģiskā konsekvence ir neredzams, bet vissvarīgākais tulkojuma kvalitātes elements. Galvenais tulkotājs izveido terminu bāzi darbam; Tas izmanto AI, lai ātri iegūtu kandidātus, bet lēmumu pieņemšanu atstāj klients un eksperts; skaidri raksta apstiprinātas un aizliegtas atbildes; Tas savieno terminu bāzi ar uzvedni/rīku tulkošanas laikā un nekad neizlaiž pēctulkošanas terminu QA kārtu. Termbase ir dzīvs dokuments; aug katrā biznesā un aizsargā zīmolu.
Lietojumprogrammas uzdevums
Atlasiet lauka tekstu (tehnisks, medicīnisks vai mārketings). Izvelciet vismaz 15 terminu kandidātus, izmantojot veidni "terminu kandidātu ieguve", apstipriniet tos un ierakstiet ekvivalentus, definīcijas un aizliegtos ekvivalentus ar veidni "terminu bāzes līnija". Pēc tam tulkojiet īsu tekstu, izmantojot šo terminu bāzi, meklējiet nesaderības ar "term QA" veidni un izlabojiet atrasto.
kontrolsaraksts
- [ ] Esmu darbā izveidojis terminu bāzi/vārdnīcu.
- [ ] Es apstiprināju AI termiņa kandidātus un pieņēmu lēmumu.
- [ ] Papildus apstiprinātajām atbildēm es uzrakstīju arī aizliegtās atbildes.
- [ ] Tulkošanas laikā es savienoju terminu bāzi ar uzvedni/rīku.
- [ ] Es veicu termina QA skenēšanu pēc tulkošanas un novērsu nesaderības.