Единица 11 / 11

Доверливост, етика, авторско право, автентичност и иднината на професијата

Добивки:

  • Способност за примена на принципите на доверливост, NDA, лични податоци (KVKK/GDPR) и избор на вистинска алатка за преведувачка работа
  • Способност да се усвои транспарентност, одговорност, одговорност за авторски права и оригиналност и рефлекс за проверка на изворот при машинска употреба
  • Разбирање зошто човечката верификација е незаменлива и трансформацијата на професијата во ерата на вештачката интелигенција

Овој модул го затвораме не со техничка вештина, туку со принципи кои го штитат интегритетот на професијата. ВИ му дава голема моќ на преведувачот; Но, оваа моќ носи и нови и сериозни одговорности во однос на доверливоста, етиката, авторските права и оригиналноста. Еден погрешно споделен доверлив документ, едно прикриено користење на машината, едно прекршување на авторските права или едно лажно тврдење за „човечки превод“ може да уништи не само еден бизнис, туку кариерата и довербата на клиентите. Во оваа единица, ќе научите за приватноста, професионалната етика, проблемите со авторските права и податоците, зошто човечката проверка е незаменлива и иднината на професијата во ерата на вештачката интелигенција.

Приватност и податоци: непроменливи принципи

Повеќето документи кои доаѓаат во рацете на преведувачот се доверливи, а доверливоста е основна посветеност на професијата. Четири правила во ерата на вештачката интелигенција:

  1. Внесување доверлив/личен/необјавен текст во јавна алатка чија политика за податоци не обезбедува сигурност. Текстот што го внесувате се обработува на надворешниот сервер; Може да се користи и складира при обука на моделот.
  2. Во согласност со NDA (договор за необјавување). Многу работни места доаѓаат со NDA; Давањето на текстот на надворешна алатка е директно прекршување и предизвикува правна одговорност.
  3. Изберете ја вистинската алатка. Корпоративни, договорени алатки кои не „чуваат/обучуваат податоци“ само за доверлива работа; општи алатки за јавни работи.
  4. Заштитете ги личните податоци (обем на KVKK/GDPR) приватно. Текстовите што содржат информации за име, здравје, финансиски и идентитет бараат дополнителна грижа; Потребна е анонимизација или безбедно опкружување.

KVKK (Закон за заштита на лични податоци — Турција) и GDPR (Европска регулатива за заштита на податоците) со закон одредуваат како ќе се обработуваат личните податоци; повредата не е само етички туку и правен проблем.

Внимание: „Само брз превод, никој нема да го види“ е најчестото оправдување за нарушување на приватноста. Откако ќе излезе, информациите не може да се вратат назад. Ако се сомневате, не извезувајте го текстот во надворешна алатка; изберете безбеден начин.

Етика и транспарентност: да не се крие употребата на машината

Новата оска на професионалната етика во ерата на вештачката интелигенција е транспарентноста. Клиентот има право да знае како се врши неговата работа. Две правила за искреност:

  • Скривање употреба на машина. Ако сте завршиле работа со МТПЕ и клиентот очекувал „чист човечки превод“, не е етички да го криете тоа. Цените и очекувањата треба да се обликуваат соодветно.
  • Искрено наведете ги вашите граници. Ризично е да преземете работа надвор од вашето поле на експертиза (на пример, напредно право или медицина) мислејќи дека можете да „се справите“ со вештачката интелигенција; ВИ не го затвора вашиот јаз во знаењето.

Исто така одговорност: преведувачот е одговорен за секој доставен текст. „Ви го преведе тоа така“ не е изговор; Вие сте одговорни пред клиентот.

Авторско право, податоци и оригиналност

Три одделни, но поврзани теми:

  • Авторско право: Текстот што треба да се преведе може да има авторски права; Преводот е исто така изведена работа. Преведувањето и објавувањето на дело без дозвола е прекршување. Вештачката интелигенција „препишувањето“ на текст не ги елиминира проблемите со авторските права.
  • Податоци за обука и согласност: алатките за вештачка интелигенција се обучуваат со јавно достапни, а понекогаш и текстови заштитени со авторски права; Ова е контроверзно етичко прашање во индустријата. Вашиот придонес: не ги „подарувајте“ податоците на вашиот клиент за обука на модел без дозвола.
  • Оригиналност и халуцинација: Особено во човечки/книжевни текстови, вештачката интелигенција може да произведе измислени цитати, лажни извори, непостоечки идиоми. Секое културно/факто тврдење на текстот што го поднесувате мора да биде потврдено и автентично.
Совет: Поставете си рефлекс „проверка на изворот“: кога вештачката интелигенција дава име, датум, цитат, извор или „познат факт“, не ставајте го во текстот без независно да го потврдите. Фабрикувана референца во хуманистичките науки го уништува кредибилитетот на целото дело.

Човечка верификација: неопходна последна врска

Заедничката лекција на секоја единица од овој модул: ВИ забрзува, луѓето потврдуваат и сносат одговорност. Верификацијата не е „дополнителен чекор“ туку составен дел од работата. Во текстовите со висок ризик (правен, медицински, безбедносен, бренд) верификацијата е поважна од самиот превод. Излезот за вештачка интелигенција испорачан без човечка проверка е брз, но ранлив.

Иднината на професијата: трансформација, а не преместување

ВИ не ги прави преведувачите невработени; Ја менува природата на работата. Како што рутинските, едноставни, повторувачки задачи за превод се префрлаат на машината, вредноста на преведувачот се префрла на слоеви што машината не може да ги направи, како што се експертиза по уредувањето, проценка на квалитетот, културна длабочина, знаење од експертски домен, транскреација и верификација. Преведувач на иднината; Тој е личност која вешто користи вештачка интелигенција, но знае каде да не верува и прави разлика со својата стручност на теренот и културната проценка. Оние кои ја отфрлаат вештачката интелигенција и оние кои слепо ѝ се предаваат ќе бидат оставени; Тој што го скротува како алатка е на прво место.

три мини футроли

Случај 1 — Транспарентноста изгради доверба. Преведувач однапред му објасни на купувачот дека тој ќе ја заврши работата со МТПЕ, кои делови ќе бидат интензивни за луѓе и цената соодветно. Клиентот беше задоволен од транспарентноста и обезбеди редовно работење; Да го сокриеше, довербата ќе беше скршена уште при првиот проблем.

Случај 2 - Прекршувањето на доверливоста стана ризик за кариера. Хонорарен преведувач склучил доверлив договор во јавна алатка; Откако клиентот го откри прекршувањето на NDA, деловниот однос заврши и референцата беше изгубена. Една единствена погодност ја уништи долгорочната доверба.

Случај 3 - Валидација зачувана автентичност. Во еден академски превод, вештачката интелигенција додаде „цитат“ што не беше во изворот и измислено име на автор. Рефлексот за проверка на изворот на преведувачот го фати ова; Доколку се поднесе, тоа би претставувало повреда на академскиот интегритет и губење на угледот.

Четири шаблони за копирање

1) Одлука за приватност/достапност на алатки:

Вашата улога: советник за приватност на податоците. Ќе опишам што вклучува преведувачката работа. Кажете ми (1) дали овој текст е доверлив/личен/ заштитен со авторски права, (2) дали е соодветно да се обработи во јавна алатка за вештачка интелигенција, (3) ако не, која безбедна алтернатива треба да ја користам. Содржина: [...]

2) Нацрт-белешка за транспарентност до клиентот:

Напишете кратка, професионална белешка до клиентот, објаснувајќи искрено како ќе ја работам оваа работа: машински превод + човечко пост-уредување, кои делови ќе бидат интензивни за луѓе, како ќе се изврши верификацијата, соодветно цена/време. Не претерувајте, давајте доверба. Вид на работа: [...]

3) Извор/список за проверка на факти:

Исфрлете ги сите фактички елементи што треба да се потврдат во следниот превод: имиња, датуми, бројки, цитати, извор/атрибути, тврдења за „вистината“, идиоми/поговорки. Наведете го секој како „потврдете со независен извор“. Не верувајте во текстот, само на она што може да се потврди. Превод: [...]

4) Претходна проверка на етика/авторски права:

Ќе ја опишам работата подолу. Означете ме можни етички и авторски прашања: статус на авторски права на текстот, изведени дела на преводот, лични податоци, заштита на податоците на клиентите, потреба од транспарентност. Наведете ризици и мерки на претпазливост. Работа: [...]

Слаб промпт / Силен промпт

Слаб: „Преведи го овој документ“. (Скриениот текст може да оди на надворешна алатка без да се доведува во прашање доверливоста, авторските права или компатибилноста на алатката.)

Güçlü: "Прво оценете го ова: овој документ е извештај за пациентот; содржи лични податоци за здравјето. Дали треба да се обработи во јавна алатка или е потребна безбедна/институционална средина? На што треба да обрнам внимание во однос на KVKK? Дајте го планот за превод откако ќе ја одредите соодветната средина."

Разликата: силна брзина започнува со приватност и правна контрола; Преводот доаѓа откако ќе се утврди правилната и безбедна средина.

Табела со етички димензии

Големина

Ризик

претпазливост

Приватност

Протече документ, прекршување на НДА

Безбедна алатка, политика за податоци

лични податоци

Прекршување на KVKK/GDPR

Анонимизирајте/обезбедете ја околината

авторски права

Неовластено изведено дело

Проверете ја дозволата/правата

транспарентност

Скриена употреба на машината

Бидете отворени за клиентот

оригиналност

Халуцинација, лажен извор

проверка на изворот

отчетност

Изговорот „Ви го направи тоа“.

Преземете одговорност

Вообичаени грешки

  • Внесување таен текст во јавна алатка „да се направи брзо“. Неотповиклива повреда.
  • Сокривање на употребата на машината од клиентот. Кога довербата е скршена, тешко е да се опорави.
  • Игнорирање на авторските права и правата на изведени дела. Правен ризик.
  • Ставање на изворот/цитатот направен од ВИ без да се потврди. Губење на оригиналност и углед.
  • Ставајќи ја одговорноста на вештачката интелигенција. Сопственик на испорачаното дело е преведувачот.

Сумирано

Во ерата на вештачката интелигенција се зголемува одговорноста на преведувачот како и неговата моќ. Приватноста е неповредлива: доверлив, личен и заштитен текст со авторски права не влегува во необезбедениот медиум. Етиката бара транспарентност и отчетност: употребата на машината не е скриена, одговорноста се прифаќа. Авторското право и оригиналноста се сфаќаат сериозно; Изворите и фразите што вештачката интелигенција може да ги состави се потврдени. Човечката проверка е незаменливата последна алка на работата. Иднината на професијата му припаѓа на преведувачот кој вешто користи вештачка интелигенција, но ги знае нејзините граници и прави разлика со својата културна и стручна проценка.

Задача за апликација

Направете целосна проверка на „одговорен превод“ за работа при рака (или примерок): Идентификувајте ја вистинската алатка со шаблонот „одлука за доверливост/погодност на алатката“; Наведете ги ризиците со „претходна проверка на етика/авторски права“; изготви „меморандум за транспарентност до клиентот“; и извлечете „листа за проверка на извори/факти“ во примерок од превод и независно потврдете најмалку три ставки. Додадете ги овие четири чекори во вашиот стандарден работен тек.

листа за проверка

  • [ ] Проценив дали текстот е доверлив/личен/ заштитен со авторски права и ја избрав вистинската алатка.
  • [ ] Посветив дополнително внимание на податоците во опсегот на KVKK/GDPR.
  • [ ] Бев транспарентен кон клиентот во однос на употребата и процесот на машината.
  • [ ] Независно ги потврдив изворите, цитатите и фактите произведени од YZ.
  • [ ] Одговорноста за испорачаното дело ја препуштив на себе, а не на вештачката интелигенција.

Модул испит

1. Кое од наведеното е најточно позиционирање на вештачката интелигенција во преводот и толкувањето?

  • А) Вештачката интелигенција е план, терминологија и алатка за квалитет; Одговорноста за значењето, тонот, културата и конечната испорака е на човечкото суштество ✔
  • Б) Вештачката интелигенција може директно да испорача правни и медицински преводи без човечко одобрение
  • В) Вештачката интелигенција работи само во преведување зборови, нема врска со квалитетот и терминологијата
  • Г) Бидејќи вештачката интелигенција е секогаш попрецизна од луѓето, сите одлуки за превод треба да се препуштат на неа.

Опис: Вештачка интелигенција; Тоа е нацрт на превод, терминологија, резиме и квалитетна помош. Одговорноста за значењето, тонот, културата, креативноста и конечната испорака е на надлежниот преведувач; Непроверениот резултат може да доведе до договорна грешка, медицинска грешка или криза со заштитен знак.

2. Што значи ако излезот од машинскиот превод е „течен, но неточен“ и зошто е тоа опасно?

  • А) Течниот превод е секогаш точен, затоа дополнителна проверка е непотребна
  • Б) Дури и ако реченицата изгледа природно во целниот јазик, можеби погрешно го пренела значењето, бројот или негацијата; Флуентноста не гарантира точност ✔
  • В) Неточните преводи се секогаш граматички неточни и лесно се забележуваат.
  • Г) Флуентноста е важна само во литературните текстови, неважна е во техничките текстови

Објаснување: Дури и ако машинскиот превод произведува совршена, природна реченица, тоа може да го оштети бројот, негацијата или значењето во изворот. Течноста не е гаранција за точноста; Затоа, бројките, датумите, соодветните имиња и негативностите треба да се проверуваат посебно со изворот без да бидат измамени од флуентност.

3. Кое од следново е главната разлика помеѓу NMT (невронски машински превод) и превод базиран на LLM?

  • А) NMT зема инструкции, но LLM не може; така што LLM преведува само збор до збор
  • Б) Тие се сосема исти, нема практична разлика меѓу нив
  • В) LLM разбира инструкции како што се тон, терминологија и публика и го гледа поширокиот контекст; NMT е брз и конзистентен, но слаб во преземањето инструкции ✔
  • Г) LLM е секогаш побрз од NMT и никогаш не додава

Опис: NMT е брз и конзистентен, но е слаб во преземањето инструкции и гледање на поширокиот контекст. LLM, од друга страна, ги разбира инструкциите како тон, список на термини и публика и го гледа контекстот пошироко, но бара контрола против ризикот од халуцинација бидејќи може да направи дополнувања.

4. Која е разликата помеѓу лесно пост-уредување и целосно пост-уредување?

  • А) Лесното пост-уредување има подобар квалитет, целосното пост-уредување е само брзо скенирање
  • Б) Нема разлика меѓу двете, само нивните имиња се различни
  • В) Целосното пост-уредување се користи само на текстови за внатрешна употреба, лесно пост-уредување се користи на текстови што треба да се објават
  • Г) Лесното пост-уредување го прави текстот точен и разбирлив; Целосното пост-уредување има за цел квалитет на човечки превод, резултат подготвен за објавување ✔

Коментар: При лесно пост-уредување, целта е текстот да биде точен и разбирлив; Без стилски допири, погоден за внатрешни/привремени текстови. Во целосното пост-уредување, целта е излезот да не се разликува од човечкиот превод; Задолжително за текстови со видливост на бренд што ќе бидат објавени.

5. Зошто „прекумерното уредување“ е проблем во МТПЕ?

  • А) Прекумерната корекција секогаш го прави преводот попрецизен, па затоа се охрабрува
  • Б) Препишувањето правилни и соодветни реченици непотребно ја уништува временската предност на МТПЕ; Треба да се поправат само неисправните места ✔
  • В) Прекумерната корекција само ја зголемува брзината, воопшто не влијае на квалитетот
  • Г) Прекумерната корекција е проблем не само во машинскиот превод, туку и во преводот со гребење

Објаснување: Прекумерна корекција е препишување на точната и соодветна реченица дадена од машината едноставно од лична преференца. Ова ја уништува целата временска предност на МТПЕ. Правило: ако излезот од машината е точен, разбирлив и соодветен, не допирајте го; Само поправете го ако не е во ред.

6. Која е главната придобивка од специфицирањето на „забранета одредба“ (превод што не треба да се користи) во базата на термини?

  • А) Непотребно е да се наведе забранет одговор бидејќи машината и онака никогаш не прави грешки.
  • Б) Забранетите еквиваленти се корисни само во литературниот превод, тие се непотребни во техничкиот текст
  • В) Експлицитното забранување на погрешни алтернативи заедно со вистинскиот партнер спречува недоследност и искривување на јазикот на брендот ✔
  • Г) Назначувањето на забранет еквивалент го забавува преводот и не дава никаква корист.

Објаснување: Едноставното пишување на точниот одговор не ја спречува употребата на неточни, но веродостојни алтернативи. Експлицитно наведување на забранети еквиваленти (користејќи само „сметка“; „профил“, „членство“ за „сметка“) е најефективниот начин да се избегне недоследност и скршен јазик на брендот.

7. Што треба да се запише во преведувачката меморија (TM) и зошто?

  • А) Секој излез од машината треба да се запише на TM без верификација бидејќи брзината е најважна
  • Б) Не треба да се пишуваат преводи на ТМ, треба да се чуваат само изворните текстови
  • В) ТМ на различни клиенти треба да се мешаат заедно во една голема ТМ
  • Г) Треба да се напишат само заверени, заверени преводи; Ако сировиот излез од машината влезе во TM, грешката ќе се пренесе на идните работни места и ќе се пропагира ✔

Забелешка: До ТМ треба да се доставуваат само заверени, заверени преводи. Зачувувањето на сировиот излез од машината во TM без нејзино валидирање ќе предизвика грешката да се враќа одново и одново на идните работни места, што се чини дека ѝ се верува како „100% совпаѓање“. Ѓубре внатре, ѓубре надвор.

8. Како треба да се постапува при локализацијата со местата (на пр. {name}, %s) во текстовите на софтверот?

  • А) Местото е зачувано како што е; Не се преведува, брише, форматира, се преместува само доколку е потребно и се проверува со QA ✔
  • Б) Местата, како и другите зборови, мора да бидат преведени на целниот јазик
  • В) Местата треба да се избришат бидејќи ја нарушуваат читливоста
  • Г) Местата се неважни, не треба воопшто да се земаат предвид при преводот

Опис: Местата се знаци кои се полни со променливи во времето на извршување. Нивното преведување, бришење или форматирање ќе предизвика паѓање на софтверот или прикажување необработен текст. Местото е зачувано како што е; само заштитникот на место може да се премести според синтаксата на целниот јазик и дефинитивно е направена турнеја за QA на место.

9. Што значи ограничувањето на CPS (знаци во секунда) во преводот на титловите?

  • А) Определува колку бои ќе се користат, а не колку секунди титлот ќе остане на екранот.
  • Б) Важи само за синхронизација, нема врска со преводи
  • В) Тоа е ограничување на брзината на преводите за публиката да може лесно да ги чита; така што преводите бараат скратување додека го зачувуваат значењето ✔
  • Г) Колку е поголем CPS, толку подобри се преводите, нема потреба да се поставуваат граници

Опис: CPS е ограничување на брзината што е потребна за гледачот удобно да чита преводи (обично ~ 17 знаци/секунда за содржина за возрасни). Затоа преводот на титлот не е превод од збор до збор, туку прашање на приспособување и скратување при зачувување на значењето; Гледачот и ја гледа и чита сликата.

10. Зошто не треба да се започне преводот пред да се потврди транскрипцијата произведена со автоматско препознавање говор (ASR)?

  • А) ASR е секогаш сигурен, така што верификацијата е губење време
  • Б) ASR прави само граматички грешки, никогаш не го искривува значењето
  • В) Излезот ASR е веќе преведен, нема потреба дополнително да се преведува
  • Г) ASR е особено погрешен во соодветните имиња, броеви, акценти и шумови; Неточната транскрипција мора да се потврди со глас бидејќи ќе се пренесе во превод ✔

Објаснување: ASR прави чести грешки во бучавата, акцентот, преклопувачкиот говор, соодветните имиња, бројките и техничките термини. Неточната транскрипција се пренесува директно на преводот и титлувањето. Затоа, особено соодветните имиња, марки и броеви треба да се проверат со споредување со звуци.

11. Што обезбедува рамката за грешки како MQM при оценувањето на квалитетот на преводот?

  • А) Овозможува класификација на секоја грешка по категорија и сериозност (критична/голема/ситна) и оценување на квалитетот на објективен и споредлив начин ✔
  • Б) Автоматски го коригира преводот, целосно елиминирајќи ја човечката евалуација
  • В) Ги фаќа само броевите грешки, не се занимава со семантички и терминолошки грешки
  • Г) Не го мери квалитетот, само ја пресметува должината на преводот

Опис: MQM (мултидимензионална метрика за квалитет) ја доделува секоја грешка на категорија (точност, терминологија, флуентност, стил, формат) и тежина (критична/голема/ситна). На овој начин, може да се дадат оценки за грешка наместо субјективност „добар/лош“, преведувачите/моторите објективно се споредуваат, а одлуката за испорака може да се врзе за нумерички праг.

12. Која е главната граница на метриката за автоматско преведување како што е BLEU?

  • А) Ја прави човечката евалуација непотребна затоа што го разбира значењето подобро од луѓето
  • Б) Гледа во преклопување на зборовите, навистина не го разбира значењето; така што системот го мери трендот, но не може да одлучи за испорака на еден текст ✔
  • В) Тој е секогаш беспрекорен и може сам да одлучи за доставливоста на текстот
  • Г) Се користи само во устен превод, нема врска со писмен превод.

Објаснување: BLEU го оценува преводот врз основа на преклопување на зборови со човечка референца, но всушност не го разбира значењето. Преводот што е различен од референцата, но точен може да добие низок резултат, додека преводот што е сличен на референцата, но неточен може да добие висока оценка; Критична грешка во негативата има мало влијание врз резултатот. Затоа, метричкиот систем го мери трендот, а не одлучува за испорака на еден текст.

13. Која е најсилната и најсоодветната улога на вештачката интелигенција во толкувањето на конференциите?

  • А) Елиминирање на потребата од преведувачи со целосно преземање на симултан превод во живо
  • Б) Автоматско пренесување на аудио од доверливи состаноци на надворешни услуги
  • В) Не е од никаква корист во ниту една фаза од преводот, вклучително и подготовка.
  • Г) Силен во подготовката пред настанот (брифинг, двојазичен речник, картички за броеви и соодветни имиња); Симултаниот превод во живо е оставен на човекот ✔

Опис: во толкувањето, голем дел од работата доаѓа во подготовка, и тука е силна вештачката интелигенција: подготвување теренски брифинзи, двојазични речници, тон на говорникот, броеви и картички со соодветни имиња. Самиот симултан превод во живо е одговорност на човечкиот преведувач поради доцнење, грешка, доверливост и контекст.

14. По што се разликува транскреацијата (творечкиот превод) од другите видови превод?

  • А) Тоа е верност на емоционалното влијание и целта на изворот, а не на неговите зборови; Може да се оддалечи од изворот за да се создаде истиот ефект во целната култура ✔
  • Б) Секогаш преведувајте го изворот збор по збор, без да го менувате
  • В) Тоа е еден вид буквален превод кој се користи само во правните и медицинските текстови.
  • Г) Целосно игнорирајте го значењето и напишете нов случаен текст

Опис: Транскреацијата, особено во текстовите за рекламирање и брендови, е да се рекреира емоционалното влијание и целта на изворот, а не зборовите во целната култура; Понекогаш некој намерно се оддалечува од изворот бидејќи целта не е буквално верност, туку истиот ефект. ВИ е множител на идеи овде; Конечната културна одлука ја донесуваат луѓето.

15. Кој е правилниот пристап при преведување на доверлив документ (на пример, непотпишан договор или извештај за пациентот)?

  • А) Внесете ја најпрактичната алатка за јавен превод за брзина, приватноста е последователна мисла
  • Б) Ако документот сепак ќе биде преведен, доверливоста не е важна, може да се користи каква било алатка
  • В) Јавните возила не се дозволени; Се користат само безбедни и корпоративни алатки кои не складираат податоци, во случај на сомневање текстот не се дава на надворешни алатки ✔
  • Г) Не постои ризик за приватност ако доверливите документи се преведуваат само гласовно

Обелоденување: доверливи, лични или необјавени текстови не се внесуваат во јавни алатки чија политика за податоци не обезбедува гаранција; ова е кршење на NDA/приватноста и правен ризик во однос на KVKK/GDPR. Се користат само корпоративни и безбедни алатки кои не складираат/обучуваат податоци; Ако се сомневате, текстот не се дава на надворешната алатка.