Egység 6 / 11

Lokalizáció (L10n): szoftver, web, játék és kulturális adaptáció

Nyereség:

  • Képes megkülönböztetni a lokalizációt a fordítástól, és megfelelően kezelni a helyőrző integritását, a szöveg hosszát és a dátum/pénz/mérték formátumát
  • Képes a műszaki jellemzők, például a többes számú szabályok és a jobbról balra író nyelvek hozzáigazítására a célterülethez
  • Képes a kulturális elemek helyi szakértő szemszögéből történő értékelésére, és a minőségbiztosítással megragadni a mesterséges intelligencia helyőrzőit és kulturális kockázatait

Az alkalmazás „Mentés” gombjának „Mentés”-re fordítása egy fordítás; De az alkalmazás dátumformátumának, pénznemének, jobbról balra írásának, gombhosszának, kulturális képeinek és jogi szövegeinek a célpiachoz való igazítása a lokalizáció. Ebben az egységben megismerheti a lokalizációt, annak technikai jellemzőit (helyőrző, hosszúság, kódolás), az AI szerepét ebben a folyamatban és a kulturális alkalmazkodást. A cél az, hogy lokalizációs szakértőként gondolkodjunk, „hogy a termék illeszkedjen a célkultúrához, ne a szavakhoz”.

Alapfogalmak

A lokalizáció (L10n – lokalizáció; L10n, mert az „l” és az „n” között 10 betű van) egy termék (szoftver, web, játék, alkalmazás) egy adott nyelvhez és kultúrához való teljes adaptálásának folyamata; Tartalmazza, de meghaladja a fordítást. Az internacionalizálás (i18n – internacionalizálás) az a lépés, amikor a terméket az alapoktól kezdve úgy tervezik, hogy az nagyon nyelvi készen álljon (a szöveg elválasztása a kódtól, ami lehetővé teszi a hossz rugalmasságát); Megelőzi és lehetővé teszi a lokalizációt.

A karakterlánc az a szövegrész, amelyet le kell fordítani a szoftverben. A helyőrzők a karakterláncon belüli jelölések, amelyek futás közben a következő változókkal vannak feltöltve: "Hello, {name}", "{count} items". A locale a nyelv + régió kombinációja (tr-TR, en-US); Meghatározza a dátumot, az időt, a számot és a pénznem formátumát.

A lokalizáció eltér a fordítástól: nemcsak a jelentést közvetíti, hanem a funkciót és a kulturális megfelelőséget is. A „2026.03.04.” dátum az USA-ban március 4., Türkiye-ben pedig értelmetlen (2026.04.03-át írjuk); "₺" a "$" helyett; A piros szín figyelmeztetés lehet az egyik kultúrában, és ünnep egy másikban.

Tipp: A fordítók a lokalizáció során leggyakrabban a szövegen kívüli elemeket hiányolják: dátum/idő/számformátum, pénznem, mértékegység (mérföld/km), keresztnévsorrend, címformátum, telefonformátum. Keresse meg ezeket minden projektben egy "helyi ellenőrzőlista" segítségével.

Helyőrző és műszaki integritás

A lokalizáció legveszélyesebb technikai hibája a helyőrzők és címkék megsértése. Ha törli a(z) {n}-et a „Van {n} üzenete” mondatból, rosszul írja be, vagy a török ​​szintaxis szerint rossz helyre teszi, a szoftver összeomlik, vagy „{n} üzenete van” durván jelenik meg. Szabályok:

  • Soha ne forgassa el, ne törölje vagy formázza a helyőrzőket. {name}, %s, {{count}} változatlan marad.
  • A török ​​szintaxis helyettesítheti a helyőrzőt; Helyezze át az új helyre, megőrizve a jelentését, de magát a táblát ne semmisítse meg.
  • A többes szám szabályai a nyelvtől függően változnak: Míg az angol azt mondja, hogy "1 item / 2 items", a törökben nincs többes számú utótag a szám után ("2 items"). A lokalizációs keretrendszerek ezt külön kezelik.

Az AI itt egy kétirányú eszköz: gyorsan lefordítja a karakterláncokat, de véletlenül megfordíthatja vagy elveszítheti a helyőrzőt. Éppen ezért a helyőrző minőségbiztosítási kör elengedhetetlen a lokalizációban.

Figyelem: A szövegbővítés a lokalizáció rejtett problémája. Az angolról törökre fordított szöveg gyakran 20-40%-kal hosszabb; Az „OK” 2 betűből áll, az „OK” megfelelője 5 betűből áll. A szűk gombba nem férő fordítás megtöri a felületet. Ha lehetséges, nézze meg a valós felületen, hogy megfelel-e a célszöveg.

Lokalizációs folyamat és kulturális adaptáció AI-val

A mesterséges intelligencia a következő feladatokat gyorsítja fel a lokalizáció során: karakterláncok kezdeti fordítása, konzisztencia-ellenőrzés, hosszra vonatkozó figyelmeztetés („ez a fordítás 35%-kal hosszabb, mint az eredeti”), kulturális megfelelőség szűrése („problémákat okoz-e ez a kép/példa a célkultúrában?”). De a kulturális döntés az emberé: a helyi szakember tudja, hogyan fog érzékelni egy viccet, ünnepet, példát, színt a célkultúrában. A mesterséges intelligencia általános figyelmeztetést adhat; A végső döntést a helyi piacot ismerő fordító hozza meg.

Példák kulturális adaptációkra: fizetési módok (helyi kártyák), példanevek (helyi nevek), mértékegységek, jogi kötelezettségek (KVKK/GDPR szövegek), ünnepnapok, lakcímforma (te/te), szín- és szimbólumjelentések.

három mini tok

1. eset – A QA helyőrző megakadályozta az összeomlást. Egy mobilalkalmazás 1200 karakterláncból álló fordításában az AI 18 helyen fordította le a {count} helyőrzőt "{number}"-re. A Helyőrző QA kör megfogta ezeket; Ha nem javítják, az alkalmazás összeomlik ezeken a képernyőkön.

2. eset – A hossza megszakította az interfészt. Az egyik szoftver menüje angol nyelven készült; Amikor a török ​​fordítások átlagosan 30%-kal hosszabbak lettek, három menüpontot áthelyeztek és kivágtak. Ha a csapat korán megkapta volna a hosszra vonatkozó figyelmeztetést, rövid alternatívákat készített volna (ha szükséges, a "Beállítások" helyett rövidítés); a feladatot újra elkészítették, és folyamathossz-szabályozással frissítették.

3. eset – A kulturális alkalmazkodás megmentette az eladást. Egy játék promóciójában érdemjelvény volt disznófigurával; a célpiacon ez kulturálisan nem volt helyénvaló. A helyi fordító figyelmeztetett, az ábra megváltozott. Az AI fordította le a szöveget, de a helyi szakértő hívta fel a figyelmet a kulturális kockázatra.

Négy másolható sablon

1) String fordítás (helyőrző védett):

Fordítsa le a következő szoftverkarakterláncokat [célnyelv] nyelvre. SZABÁLY: SOHA NE fordítsa le, törölje vagy formázza az olyan helyőrzőket, mint például {name}, %s, {{count}}; maradjon meg úgy, ahogy van (áthelyezheti a török ​​szintaxis szerint). A HTML/címkék megőrzése. Írd le tömören és a felülethez illően. Formátum: forrás → fordítás. Karakterláncok: [...]

2) Helyőrző/címke QA:

Az alábbiakban a forrás és a lefordított karakterláncok találhatók. CSAK helyőrzővel és címkével kapcsolatos problémák megjelölése: lefordítva/törölve/sérült{...}, %s, {{...}}, <címke>. Sorolja fel, hány helyőrző található a forrásban, hány a fordításban, és sorolja fel azokat, amelyek nem egyeznek. Forrás: [...] | Fordítás: [...]

3) Hosszra és interfészre vonatkozó figyelmeztetés:

Értékelje a következő UI-fordítások hosszát. Minden fordításnál adja meg a forrás szerinti százalékos kiterjesztést, és jelölje meg azokat, amelyek esetleg nem férnek el szűk helyekre (gombok, menük). Azok számára, akik nem illenek, javasoljanak egy rövidebb alternatívát, amely megőrzi a jelentést. Párok (forrás | fordítás): [...]

4) Kulturális alkalmassági szűrés:

Az Ön szerepe: [célpiac] lokalizációs tanácsadó. Jelölje meg a következő tartalomban azokat az elemeket, amelyek problémákat okozhatnak a célkultúrában: kép, példa, név, szín, szimbólum, vicc, dátum/mérési formátum, jogi szöveg. A végső döntés az enyém; rámutat a kockázatra és alternatívákat javasol.Tartalom: [...]

Gyenge felszólítás / Erős felszólítás

Gyenge: "Fordítsa le ezeket az alkalmazásszövegeket." (Helyőrző, hossz, nincs interfész kontextus; gépi lefordítja a helyőrzőt, a szöveg hosszabb lesz.)

Erős: "Fordítsa le ezeket a mobilalkalmazás-karakterláncokat törökre. Tartsa meg a {user} és %d helyőrzőt úgy, ahogy van. Ezek a szövegek keskeny gombokban jelennek meg; lehetőleg legyen rövid. 'Beállítások'→ 'Beállítások', 'Profil'→ 'Profil'. Kövesse a török szabályt a többes számú kifejezéseknél (nem többes számú utótag a szám után)."

Különbség: az erős prompt helyőrzőt, hosszt, kifejezést és többes számot ad; a kimenet közel állna ahhoz, hogy közvetlenül belépjen az interfészre.

Lokalizációs méretek táblázata

Méret

példa

Kockázat

Helyőrző/címke

{name}, %s, <b>

Szoftver összeomlik

hossza

"OK" → "OK" (150%)

Az interfész túlcsordul

Dátum/szám/pénz

03.04.26., 1000,50 USD

hamis információ

többes számú szabály

2 elem → 2 elem

rossz nyelvtan

kulturális elem

kép, szín, humor

hírnév/értékesítés

jogi szöveg

KVKK/GDPR

jogi kockázat

Gyakori hibák

  • Helyőrző átfordítása/törlése. Emiatt a szoftver összeomlik, vagy nyers szöveg jelenik meg.
  • Nem veszik figyelembe a szöveg nyújtását. Az interfész túlcsordul, az elemek csonkoltak.
  • A dátum/pénznem/mérési formátum nem konvertálva. Az "5 mérföld" maradt, nem a "8 km".
  • A kulturális elem átadása a helyi szakértő megkérdezése nélkül. Hírnév és értékesítési kockázat.
  • Többes számú szabályok fordítása angol logikával. Rossz nyelvtan, például "2 elem".

Pszeudo-lokalizáció és jobbról balra író nyelvek

Két technikai probléma határozza meg a lokalizáció minőségét. Az első a pszeudo-lokalizáció: a termék tesztelése hamis, de valósághű hosszúságú szöveggel és speciális karakterekkel (pl. "Beállítások" → "[Ŝéttîngŝ~~]") a tényleges fordítás előtt. Ez megmutatja, hogy az interfész képes-e kezelni a hosszú szövegeket és speciális karaktereket, hogy a szövegek kibontása valóban megtörténik-e a fordítás megkezdése előtt. Ha a fejlesztővel együttműködő fordító ezt a tesztet javasolja, sok interfész-hibát észlel a rendszer, mielőtt azok bekövetkeznének.

A második a jobbról balra (RTL) nyelvek: Az olyan nyelveket, mint az arab, a héber, a perzsa, jobbról balra írják, és a lokalizáció nem csak a szöveget, hanem a teljes felület elrendezését (menü helyzete, nyilak, igazítás) is tükrözi. Az RTL fordításban a számok és a latin betűs kifejezések zavart okozhatnak; A „kétirányú szöveg” problémája különös figyelmet igényel. A mesterséges intelligencia le tudja fordítani az RTL szöveget, de az elrendezés tükrözése és a kétirányú áramlási döntések technikai-kulturális szakértelmet igényelnek. Ez a két kérdés azt mutatja, hogy a lokalizáció a fordításon túlmutató mérnöki-kulturális munka.

Összefoglalva

A lokalizáció azt jelenti, hogy nem a szavakat, hanem a terméket a célnyelvhez és kultúrához kell igazítani; magában foglalja a fordítást, de tartalmazza a helyőrző integritását, a szöveg hosszát, a dátum/pénz/mérték formátumát, a többes számú szabályokat és a kulturális elemeket is. A mesterséges intelligencia felgyorsítja a karakterláncok fordítását, a hosszt és a kulturális kockázatok szűrését; De a minőségbiztosítási túra elengedhetetlen, mert megzavarhatja a helyőrzőt, és a kulturális döntést a helyi piacot ismerő szakember hozza meg. A lokalizáció sikere a szövegen túli részletekre való odafigyelés.

Pályázati feladat

Vegyünk egy 15-20 karakterláncból álló interfész-minta szöveget ({...} vagy %s helyőrzőkkel és dátummal/pénzzel). Fordítsa le a "String translation" mintával, majd ellenőrizze a helyőrző integritását a "placeholder QA"-val, és ellenőrizze a túlcsordulás kockázatát a "hosszúsági figyelmeztetéssel". Igazítsa a dátum- és pénzformátumot a célterülethez, és végezzen „kulturális alkalmassági vizsgálatot”, ha van kulturális elem.

ellenőrző lista

  • [ ] Megtartottam a helyőrzőt és a címkéket, és megerősítettem a minőségbiztosítással.
  • [ ] Szabályoztam a szöveg nyújtását, és megakadályoztam a túlcsordulást a szűk területeken.
  • [ ] A dátumot, a számot, a pénznemet és a mértékegységeket a célterülethez igazítottam.
  • [ ] Többes számú kifejezéseket fordítottam a célnyelv szabályai szerint.
  • [ ] A kulturális elemeket helyi szakértő szemszögéből értékeltem.