एकाइहरू
1. अनुवाद र व्याख्यामा कृत्रिम बुद्धिमत्ताको परिचय: भूमिका, सीमा, प्रमाणीकरण, गोपनीयता र नैतिकता 2. मेसिन अनुवादका आधारभूत कुराहरू: NMT, LLM, इन्जिन चयन र पूर्व-मूल्याङ्कन 3. मेसिन अनुवाद पोस्ट-सम्पादन (MTPE): हल्का र पूर्ण पोस्ट-सम्पादन 4. शब्दावली व्यवस्थापन र टर्मबेस: स्थिरता र कर्पोरेट भाषा 5. CAT उपकरण र अनुवाद मेमोरी (TM) सँग AI एकीकरण 6. स्थानीयकरण (L10n): सफ्टवेयर, वेब, खेल र सांस्कृतिक अनुकूलन 7. उपशीर्षक, डबिङ र अडियोभिजुअल अनुवाद 8. गुणस्तर नियन्त्रण (QA), मूल्याङ्कन मेट्रिक्स र LQA 9. व्याख्या तयारी: लगातार र एक साथ व्याख्या 10. सन्दर्भ, संस्कृति, स्वर र रचनात्मक अनुवाद (ट्रान्सक्रिएशन) 11. गोपनीयता, नैतिकता, प्रतिलिपि अधिकार, प्रामाणिकता र पेशाको भविष्य
एकाइ 4 / 11

शब्दावली व्यवस्थापन र टर्मबेस: स्थिरता र कर्पोरेट भाषा

लाभ:

  • टर्मबेस स्थापना गरेर र स्पष्ट रूपमा स्वीकृत र निषेधित समकक्षहरू परिभाषित गरेर शब्दावली स्थिरता सुनिश्चित गर्ने क्षमता
  • आर्टिफिसियल इन्टेलिजेन्सको प्रयोग गरेर टर्म उम्मेदवारहरू छिटो निकाल्न र विशेषज्ञ र ग्राहकसँग अन्तिम टर्म निर्णय गर्न
  • अनुवादको क्रममा टर्मबेसलाई उपकरण/प्रम्प्टमा जडान गर्ने क्षमता र पोस्ट-अनुवाद शब्द QA भ्रमणको साथ असंगतताहरू पत्ता लगाउने क्षमता।

प्राविधिक अनुवादमा, यदि तपाईंले "प्रयोगकर्ता खाता" शब्दलाई एक ठाउँमा "प्रयोगकर्ता खाता", अर्को ठाउँमा "सदस्य खाता", अर्को ठाउँमा "प्रयोगकर्ता प्रोफाइल" को रूपमा अनुवाद गर्नुभयो भने, प्रयोगकर्ता हराउनेछ, ब्रान्ड असंगत देखिनेछ, र खोज/कागजातीकरण भङ्ग हुनेछ, पाठ प्राविधिक रूपमा "सही" भए पनि। अनुवादको मौन तर सबैभन्दा निर्णायक गुणस्तर तत्व शब्दीय स्थिरता हो। यस एकाइमा, तपाईंले शब्दावली व्यवस्थापन, टर्मबेस (टर्म डाटाबेस), एआईसँग शब्द निकासी, र अनुवादमा शब्दावली अनुशासन कसरी कायम राख्ने भन्ने कुरा सिक्नुहुनेछ। उद्देश्य भनेको विज्ञ हुनु हो जसले हरेक परियोजनामा ​​एउटै अवधारणालाई सबै ठाउँमा एउटै तरिकाले पूरा गर्दछ र कर्पोरेट भाषाप्रति वफादार हुन्छ।

आधारभूत अवधारणाहरू

शब्दावली भनेको क्षेत्र वा संस्था ("चेकआउट", "रिटर्न नीति", "स्टेम सेल") को विशिष्ट अवधारणाहरूसँग मेल खाने शब्द र अभिव्यक्ति हो। Termbase (TB - शब्द डेटाबेस) एक संरचित शब्दकोश हो जसले स्रोत-लक्ष्य समकक्षहरू, परिभाषा, उपयोग नोट र यी सर्तहरूको "निषेधित समकक्ष" राख्छ; यसले CAT उपकरणहरूमा जडान गर्दछ र स्वचालित रूपमा अनुवाद सुझाव दिन्छ। टर्म एक्स्ट्र्याक्शन भनेको स्वचालित रूपमा सर्तहरू सङ्कलन गर्ने प्रक्रिया हो जुन पाठबाट अनुवाद/मानकीकृत गर्न आवश्यक छ। शब्दावली एक सरल, सर्तहरूको दुई-स्तम्भ सूची हो; यो साना कामहरूमा टर्मबेसको सट्टा प्रयोग गरिन्छ।

यो किन यति महत्त्वपूर्ण छ? किनभने मेसिन अनुवाद र LLM आफैंले शब्दावली स्थिरताको ग्यारेन्टी गर्दैन। एनएमटीले प्रत्येक वाक्यलाई स्वतन्त्र रूपमा अनुवाद गर्न सक्छ; LLM ले लामो पाठमा आफ्नो निर्णय परिवर्तन गर्न सक्छ। के टर्म अनुशासन प्रदान गर्दछ टर्मबेस जुन तपाईले तयार गर्नुभएको छ र गाडीमा जडान गर्नुभयो।

सुझाव: ग्राहकसँग आफ्नो पहिलो काममा टर्मबेस सेटअप गर्न ३० मिनेट खर्च गर्नुहोस्। यो लगानीले सबै पछिल्ला कामहरूमा गति र गुणस्तर दुवै बढाउँछ र "तपाईँका अनुवादहरूमा ब्रान्ड अनुरूप" को प्रतिष्ठा दिन्छ।

एआई संग टर्म निकासी र टर्मबेस निर्माण

AI ले टर्मबेस सेटअप गर्ने सबैभन्दा कठिन भागलाई गति दिन्छ: उम्मेद्वारहरू खोज्दै। तपाईं LLM लाई स्रोत पाठ दिन सक्नुहुन्छ र भन्न सक्नुहुन्छ, "यस पाठमा डोमेन-विशिष्ट सर्तहरू सूचीबद्ध गर्नुहोस्, ती जो दोहोरिने छन्, र ती जसलाई अनुवादमा स्थिरता चाहिन्छ।" त्यसपछि तपाइँ उम्मेद्वारहरूको यो सूची अनुमोदन गर्नुहुन्छ, सही लक्ष्य प्रतिक्रिया निर्धारण गर्नुहोस् र आवश्यक पर्दा ग्राहकसँग पुष्टि गर्नुहोस्। महत्वपूर्ण बिन्दु: AI ले शब्द उम्मेदवारहरूलाई सुझाव दिन्छ, विशेषज्ञ र ग्राहकले शब्दको निर्णय लिन्छन्। कुनै ब्रान्डले "अपोइन्टमेन्ट" कल गर्ने वा "बुकिङ" गर्ने भन्ने कुरा ग्राहकको छनोट हो, एआईको होइन।

प्रत्येक शब्दको लागि, निम्नलाई Termbase मा राख्नुहोस्: स्रोत शब्द, अनुमोदित लक्ष्य समकक्ष, छोटो विवरण/सन्दर्भ, "प्रयोग नगर्नुहोस्" (निषिद्ध) समकक्ष, र लागू भएमा डोमेन/प्रोजेक्ट ट्याग। प्रतिबन्धित समकक्षहरू लेख्नु असंगतताबाट बच्नको लागि सबैभन्दा प्रभावकारी तरिका हो ("खाता" को लागी, "खाता" मात्र प्रयोग नगर्नुहोस्; "प्रोफाइल", "सदस्यता")।

अनुवाद भरि शब्दावली अनुशासन कायम गर्दै

टर्मबेस स्थापना गर्न पर्याप्त छैन; यसलाई कार्यान्वयन गर्न आवश्यक छ। तीन तहहरू:

  1. अनुवादको क्रममा: LLM मा अनुवाद गर्दा, प्रम्प्टमा टर्मबेस थप्नुहोस् ("यी सर्तहरू यी समकक्षहरूसँग प्रयोग गर्नुपर्छ")। यदि तपाइँ CAT उपकरण प्रयोग गर्दै हुनुहुन्छ भने, टर्मबेस जडान गर्नुहोस्; उपकरणले तुरुन्तै मिलान देखाउँछ।
  2. पोस्ट-अनुवाद QA: टर्मबेस विरुद्ध समाप्त पाठ स्क्यान गर्नुहोस्। मैले LLM लाई सोधें "के यस पाठमा टर्मबेसको पालना नगर्ने ठाउँहरू छन्?" वा CAT उपकरणको QA प्रकार्य चलाउनुहोस्।
  3. परियोजनाको अन्त्यको अद्यावधिक: नयाँ सर्तहरू र ग्राहक प्रतिक्रिया टर्मबेसमा थप्नुहोस् जब काम समाप्त हुन्छ; टर्मबेस एक जीवित दस्तावेज हो।
सावधानी: तपाईंले LLM लाई लामो टर्मबेस दिँदा यसले केही सर्तहरू "बिर्सन" वा सन्दर्भको आधारमा तिनीहरूलाई परिवर्तन गर्न सक्छ। त्यसैले अनुवाद पछि QA राउन्ड कहिल्यै नछोड्नुहोस्; प्रोम्प्टिङ जाँचको विकल्प होइन।

तीन मिनी केसहरू

केस 1 - Termbase ले विसंगति हटायो। 60,000-शब्दको कागजातमा सफ्टवेयर कम्पनीले 5 फरक स्वतन्त्र अनुवादकहरूको साथमा, उही 40 शब्दहरू दर्जनौं फरक तरिकामा अनुवाद गरिएको थियो। एक पटक एक साझा टर्मबेस स्थापना भएपछि र सबै अनुवादहरू यसमा पङ्क्तिबद्ध भएपछि, प्रयोगकर्ता समर्थनमा "मैले यो स्क्रिन फेला पार्न सक्दिन" जस्ता गुनासोहरू उल्लेखनीय रूपमा घट्यो।

केस २ — AI ले अनुमानलाई २ दिनबाट २ घण्टामा घटाएको छ। म्यानुअल रूपमा 200-पृष्ठ उपकरण कागजातबाट सर्तहरूको सूची निकाल्नुको सट्टा, एक मेडिकल अनुवाद टोलीले LLM ड्राफ्ट गरेको थियो: 380 उम्मेद्वार सर्तहरू 2 घण्टामा सूचीबद्ध गरियो। विशेषज्ञले यसलाई 1 दिनमा अनुमोदन गरे र तिनीहरूका प्रतिक्रियाहरू स्पष्ट गरे; म्यानुअल तरिकाले गरेको भए हप्ता दिन लाग्थ्यो। निर्णय फेरि जनताको हो।

केस 3 - निषेध नियमले संकटलाई टाल्यो। ब्रान्डको टर्मबेसमा, "ग्राहक" को लागि "ग्राहक" अनुमोदन गरिएको थियो र "प्रयोगकर्ता" निषेध गरिएको थियो (ब्रान्ड स्थितिको कारणले)। जब एक नयाँ अनुवादकले "प्रयोगकर्ता" टाइप गर्यो, शब्द QA ले यसलाई समात्यो र ब्रान्ड भाषा विकृतिलाई लाइभ हुनु अघि फिक्स गरियो।

चार प्रतिलिपि गर्न मिल्ने टेम्प्लेटहरू

1) अवधि उम्मेदवार निकासी:

तपाईंको भूमिका: शब्दविज्ञानी। निम्न [डोमेन] पाठ निकाल्ने सर्तहरूबाट अनुवादमा एकरूपता चाहिन्छ: डोमेन-विशिष्ट अवधारणाहरू, दोहोरिने वाक्यांशहरू, उत्पादन/सुविधा नामहरू, संक्षिप्तहरू। स्रोत भाषामा प्रत्येक शब्दहरू सूचीबद्ध गर्नुहोस्, संक्षिप्त सन्दर्भ टिप्पणी थप्नुहोस्। निर्णय मेरो हो; तपाईले मात्र उम्मेदवार सुझाव दिनुहोस्। सामान्य शब्दहरू थप्दै (र, तर) पाठ: [...]

2) टर्मबेस लाइन सिर्जना गर्दै:

निम्न सर्तहरूको लागि टर्मबेस पङ्क्ति तयार गर्नुहोस्: स्रोत शब्द | सुझाव लक्षित प्रतिक्रिया | संक्षिप्त विवरण | जोगिन गलत जवाफ। यदि तपाइँ निश्चित हुनुहुन्न भने, उत्तरमा [?] चिन्ह लगाउनुहोस्; म निर्णय गर्नेछु। एलन: [...] | सर्तहरू: [...]

3) Termbase संगत अनुवाद:

यो पाठ अनुवाद गर्नुहोस् [स्रोत] → [लक्ष्य]। तलको टर्मबेस लागू गर्नुपर्छ; प्रतिबन्धित समकक्षहरू प्रयोग नगर्नुहोस्:- [स्रोत1] → [लक्ष्य1] (प्रयोग गर्नुहोस्: [निषिद्ध१])- [स्रोत2] → [लक्ष्य2] यदि तपाईंले टर्मबेसमा नभएको शब्द भेट्नुभयो भने, यसलाई [?] बाट चिन्ह लगाउनुहोस्। पाठ: [...]

४) अनुवादपछिको शब्द QA:

मैले प्रदान गरेको टर्मबेस विरुद्ध तलको अनुवाद स्क्यान गर्नुहोस्। केवल असंगतिहरू सूचीबद्ध गर्नुहोस्: कुन शब्द प्रयोग गरियो, कहाँ, कुन गलत अर्थको साथ, सही के हुनुपर्छ। मिल्दो स्थानहरू रिपोर्ट गर्दै। टर्मबेस: [...] | अनुवाद: [...]

कमजोर प्रम्प्ट / बलियो प्रम्प्ट

कमजोर: "सर्तहरूसँग सावधान रहनुहोस्।" (कुन शब्द, कुन बराबर, कुन निषेध - अस्पष्ट छ; मेसिनले आफैं छान्छ।)

बलियो: "यो पाठ अनुवाद गर्दा, निम्न टर्मबेस लागू गर्नुहोस्: 'ड्यासबोर्ड' → 'ड्यासबोर्ड', 'लग इन' → 'लग इन'। यदि तपाइँ गैर-टर्मबेस शब्द भेट्नुहुन्छ भने, [?] राख्नुहोस् र यसलाई आफैं बनाउनुहोस्।"

भिन्नता: बलियो प्रम्प्टले अनुमोदित समकक्ष, निषेधित समकक्ष, र अज्ञात शब्द व्यवहार निर्दिष्ट गर्दछ; स्थिरता सुनिश्चित छ।

शब्दावली उपकरण / दृष्टिकोण को तालिका

दृष्टिकोण

यसले के गर्छ?

सीमा

शब्दावली (दुई स्तम्भ)

सानो व्यापार, छिटो सुरु

कुनै परिभाषा/निषेध छैन

Termbase (CAT मा जडान गरिएको)

स्वचालित सिफारिस, QA

स्थापना गर्न श्रम चाहिन्छ

LLM को साथ अवधि निकासी

उम्मेदवार सूचीलाई गति दिनुहोस्

जनताले निर्णय गर्छन्

अवधि QA स्क्यान

विसंगति समात्छ

Termbase अप टु डेट हुनुपर्छ

निषेधित प्रावधानहरूको सूची

ब्रान्ड भाषा कायम राख्छ

निरन्तर मर्मत आवश्यक छ

सामान्य गल्तीहरू

  • Termbase स्थापना नगरी ठूलो काम सुरु गर्दै। विसंगति पछि बढ्दै जान्छ।
  • बिना प्रश्न AI द्वारा सुझाव दिएको प्रतिक्रिया स्वीकार गर्दै। शब्दावली निर्णय ग्राहक / विशेषज्ञ मा निर्भर छ।
  • प्रतिबन्धित प्रतिक्रियाहरू लेख्ने छैन। "सही" लेखेर मात्र "गलत" लाई रोक्दैन।
  • पोस्ट-अनुवाद शब्द QA छोड्दै छ। प्रम्प्टमा टर्मबेस राख्नुले यसको कार्यान्वयनको ग्यारेन्टी गर्दैन।
  • Termbase अद्यावधिक गर्दैन। एक मृत टर्मबेस समय संग भ्रमित हुनेछ।

बहुभाषी टर्मबेस र ग्राहक अनुमोदन

ठूला परियोजनाहरूमा, टर्मबेस प्रायः बहुभाषी हुन्छ: एक अवधारणाको एक भन्दा बढी लक्षित भाषाहरूमा समकक्ष हुन्छ (स्रोत → अंग्रेजी, जर्मन, टर्की, अरबी)। यसले सबै भाषाहरूमा समान अवधारणाको निरन्तर अनुवाद सुनिश्चित गर्दछ र नयाँ भाषा थप्दा कामलाई गति दिन्छ। बहुभाषिक टर्मबेसमा ध्यान दिनु पर्ने कुरा यो हो कि प्रत्येक भाषाको आफ्नै सांस्कृतिक र व्याकरणीय समकक्ष छ। एक भाषाको समानलाई अन्धाधुन्ध रूपमा अर्को भाषामा प्रतिलिपि गर्नु गलत हो।

शब्दावलीमा पनि अनुमोदन आयामको एक श्रृंखला छ। आलोचनात्मक सर्तहरूमा, अन्तिम निर्णय प्रायः ग्राहकको विषय विशेषज्ञ वा ब्रान्ड टोलीले गर्नुपर्छ, अनुवादकले होइन; किनभने उनीहरूलाई पदको आधिकारिक/कानूनी/ब्रान्ड बराबर थाहा छ। त्यसैले ठूला कामहरूमा टर्मबेसलाई "अनुमोदित", "उम्मेद्वार" र "विवादित" भनी ट्याग गर्नु राम्रो अभ्यास हो: तपाइँ ग्राहकलाई उम्मेदवार र विवादास्पद सर्तहरूको लागि सोध्नुहोस्, तिनीहरूलाई अनुमोदन गर्नुहोस्, त्यसपछि तिनीहरूलाई लक गर्नुहोस्। यो अनुशासनले मध्य-कार्यलाई रोक्छ "यो शब्द वास्तवमा हुनुपर्दछ" आश्चर्य र सामूहिक पुन: अनुवाद।

संक्षेपमा

शब्दावली स्थिरता अनुवादको अदृश्य तर सबैभन्दा निर्णायक गुणस्तर तत्व हो। मास्टर अनुवादकले काममा टर्मबेस स्थापना गर्दछ; यसले टर्म उम्मेदवारहरू द्रुत रूपमा निकाल्न AI प्रयोग गर्दछ, तर निर्णय ग्राहक र विशेषज्ञलाई छोड्छ; स्पष्ट रूपमा स्वीकृत र निषेधित प्रतिक्रियाहरू लेख्छ; यसले अनुवादको क्रममा टर्मबेसलाई प्रम्प्ट/उपकरणमा जडान गर्दछ र पोस्ट-अनुवाद शब्द QA राउन्डलाई कहिल्यै छोड्दैन। Termbase एक जीवित कागजात हो; हरेक व्यवसायमा बढ्छ र ब्रान्डको सुरक्षा गर्दछ।

आवेदन कार्य

क्षेत्र पाठ चयन गर्नुहोस् (प्राविधिक, चिकित्सा वा मार्केटिङ)। "टर्म उम्मेद्वार निकासी" टेम्प्लेटको साथ कम्तिमा 15 टर्म उम्मेद्वारहरू निकाल्नुहोस्, तिनीहरूलाई पुष्टि गर्नुहोस् र "टर्मबेस लाइन" टेम्प्लेटसँग समकक्ष, परिभाषा र निषेधित समकक्षहरू लेख्नुहोस्। त्यसपछि यो टर्मबेसको साथ छोटो पाठ अनुवाद गर्नुहोस्, "टर्म QA" टेम्प्लेटसँग असंगतताहरूको लागि स्क्यान गर्नुहोस् र तपाईंले फेला पार्नु भएको कुरा ठीक गर्नुहोस्।

चेकलिस्ट

  • [] मैले काममा टर्मबेस/शब्दावली सेटअप गरेको छु।
  • [ ] मैले AI को कार्यकालका उम्मेदवारहरूलाई स्वीकृत गरें र निर्णय गरें।
  • [] अनुमोदित प्रतिक्रियाहरूको अतिरिक्त, मैले निषेधित प्रतिक्रियाहरू पनि लेखें।
  • [ ] मैले अनुवादको क्रममा प्रम्प्ट/उपकरणमा टर्मबेस जडान गरें।
  • [ ] मैले अनुवाद पछिको शब्द QA स्क्यान गरें र असंगतताहरू फिक्स गरें।