Keuntungan:
- Keupayaan untuk memahami konsep transkripsi automatik dan pemisahan pembesar suara dan menukar rakaman mentah kepada teks berkod masa
- Keupayaan untuk memahami format sari kata (SRT/VTT), kelajuan membaca dan peraturan baris, serta menghasilkan dan mengedit draf sari kata berbilang bahasa
- Memahami bahawa adalah menjadi tanggungjawab editor untuk mengesahkan terminologi, nama yang betul, kesilapan tanda baca dan kesilapan terjemahan dalam transkrip automatik sebelum diterbitkan.
Tugas pasca produksi yang paling membosankan dan memakan masa ialah transkripsi tradisional: seorang editor akan mendengar tanpa henti rakaman temu bual berjam-jam, menaip setiap ayat dengan tangan. Rakaman satu jam dengan mudah akan mengambil masa empat hingga lima jam untuk ditranskripsikan. Kecerdasan buatan telah mengubah perniagaan ini secara radikal: hari ini rakaman selama sejam boleh ditukar menjadi teks berkod masa dalam beberapa minit. Ini kedua-duanya mempercepatkan saluran pengeditan dan membolehkan kebolehaksesan (sari kata untuk penonton bermasalah pendengaran dan tontonan senyap). Tetapi output automatik tidak pernah sesuai untuk diterbitkan dalam bentuk mentahnya; Dalam unit ini kita akan melihat kedua-dua kuasa dan perangkap.
Mari kita mulakan dengan terma. Transkripsi ialah penyampaian ucapan dalam bentuk tulisan. Pengecaman pertuturan automatik (ASR) ialah teknologi yang menterjemah suara ke dalam teks. Kod masa ialah tanda yang menunjukkan pada detik mana teks itu sepadan dalam video. Diarisasi pembesar suara membezakan "siapa yang bercakap" dan membahagikan teks kepada pembesar suara. Sari kata (sari kata/kapsyen) ialah teks berkod masa yang muncul pada skrin. SRT dan VTT ialah format fail sari kata yang paling biasa; Ia mengandungi susunan, masa mula-akhir dan teks setiap baris. Kelajuan membaca (CPS: aksara sesaat) menentukan berapa lama garis mesti kekal pada skrin untuk penonton membaca sari kata dengan selesa.
Kuasa dan had transkripsi automatik
Transkripsi AI menyalin suara yang jelas dan satu pembesar suara yang dirakam dalam bahasa Turki yang betul dengan ketepatan yang sangat tinggi. Tetapi ia membuat kesilapan dalam situasi berikut, dan mengetahui perkara ini membolehkan anda menyasarkan pengesahan: nama yang betul (nama orang, jenama, tempat sering disalah eja), istilah dan singkatan teknikal, perkataan bunyi yang serupa (“kar/kar”, “pegun/pegun”), pertuturan bertindih (dua orang pada masa yang sama), bunyi latar belakang dan muzik, perbezaan dialek/aksen atau tanda baca). Selain itu, model mungkin "mendengar" dan menyalin perkataan yang tidak pernah disebut dalam saat yang bising-ini adalah halusinasi transkripsi.
Jadual berikut meringkaskan keadaan kuat dan lemah untuk transkripsi automatik:
syarat
ketepatan
Fokus editor
Pembesar suara tunggal, bunyi yang jelas, persekitaran yang tenang
sangat tinggi
Nama yang betul, tanda baca
Panel berbilang pembesar suara
sederhana
Pemisahan pembesar suara, ucapan bertindih
Rakaman bising/luar
rendah-sederhana
Kata yang dibuat-buat, lompat
Kandungan teknikal/jargon
sederhana
Penulisan istilah dan singkatan
pertuturan beraksen
Pembolehubah
Kesalahan perkataan, makna
Format sari kata dan peraturan kebolehbacaan
Sari kata yang baik bukan sekadar "teks yang betul"; mesti boleh dibaca. Terdapat beberapa peraturan praktikal dalam amalan antarabangsa: baris sari kata biasanya tidak lebih daripada dua baris; setiap baris hendaklah disimpan pada panjang yang munasabah (kira-kira 37-42 aksara); Sari kata mesti kekal pada skrin cukup lama untuk dibaca (biasanya 1-6 saat); Kelajuan membaca tidak boleh terlalu tinggi (kebanyakan panduan menganggap ~15-17 aksara/saat sebagai had). Alat AI membelah sari kata secara automatik, tetapi pemisahan ini kadangkala memotong ayat di tempat yang buruk (baris berakhir dengan "dan", pecahan yang membahagikan makna). Tugas editor adalah untuk membuat teks tepat dan lancar.
Peranan anda: pembantu editor sari kata. Di bawah ialah transkrip automatik. Tugasan:1) Bahagikan teks kepada blok sari kata mengikut logik SRT.2) Setiap blok hendaklah maksimum 2 baris, setiap baris tidak boleh melebihi ~40 aksara.3) Bahagikan ayat di tempat yang bermakna; Baris yang berakhir dengan "dan", "tetapi", "itu".4) Tandakan kata nama dan istilah khas dengan teg [SEMAK] supaya saya boleh mengesahkannya secara manual.5) Jangan tukar teks, hanya belah dan tanda.
Idea "teg [CONTROL]" dalam gesaan ini adalah berharga: Mempunyai AI menandakan kawasan yang tidak pasti atau berisiko (nama betul, istilah) mengarahkan mata editor ke tempat yang betul dan menghalang kepercayaan buta.
Sari kata dan terjemahan berbilang bahasa
Membuka video kepada berbilang bahasa meningkatkan penonton. AI boleh mengambil transkrip, menterjemahkannya ke dalam bahasa sasaran, dan menghasilkan fail sari kata. Ini adalah keupayaan yang kuat, tetapi ia adalah yang paling terdedah: terjemahan mesin boleh menyalahgambarkan simpulan bahasa, rujukan budaya, jenaka dan permainan kata, istilah dan konteks. Menterjemah ayat "Hujan kucing dan anjing" perkataan demi perkataan adalah bencana. Terdapat juga kekangan ruang dalam terjemahan sari kata: ayat dalam bahasa sasaran mungkin lebih panjang dan melebihi kelajuan membaca. Itulah sebabnya penting bagi sari kata berbilang bahasa untuk meminta seseorang yang mengetahui bahasa sasaran mengesahkan terjemahan — terutamanya untuk kandungan sensitif seperti penjenamaan, undang-undang atau kesihatan, terjemahan yang salah boleh membawa akibat yang serius.
Terjemah blok sari kata Turki berikut ke dalam bahasa Inggeris. Peraturan: - Pindahkan simpulan bahasa dan jenaka, bukan verbatim, tetapi memelihara MAKNAnya. - Biarkan nama jenama dan nama produk seperti sedia ada, jangan terjemah. - Biarkan setiap blok mengekalkan kelajuan bacaannya; Pendekkan jika perlu, tetapi jangan memutarbelitkan maksudnya. - Nyatakan rujukan budaya atau istilah yang anda tidak pasti dengan [NOTA PENJEMAHAN].
tiga kes mini
Kes 1 — Garis pecutan. Krew dokumentari menghabiskan masa tiga minggu untuk menyalin arkib temu bual selama 12 jam. Dengan transkripsi automatik, teks mentah dikeluarkan dalam sehari; Dengan mencari melalui teks (perkataan demi perkataan), pasukan itu menemui detik yang mereka inginkan dalam beberapa saat. Kemudian mereka menyunting dan menyari kata dengan teliti hanya episod 40 minit yang akan mereka gunakan. Tiga minggu bertukar menjadi empat hari; usaha pengesahan tertumpu pada bahagian yang digunakan.
Kes 2 — Perkataan rekaan. Sebuah saluran berita menyiarkan wawancara jalanan yang riuh rendah dengan sari kata automatik, tanpa menyemak. Model itu "mendengar" perkataan yang tidak diucapkan di latar belakang, dan kapsyen itu mengaitkan perkataan yang tidak diucapkan kepada orang yang ditemuduga. Terdapat reaksi di media sosial dan pembetulan itu diterbitkan. Pengajaran: dalam rakaman bising, sari kata automatik mesti dibandingkan dengan audio asal.
Kes 3 — Bencana terjemahan. Sebuah jenama menerbitkan sari kata bahasa Inggeris bagi video promosinya dengan terjemahan mesin dan tanpa kawalan. Apabila simpulan bahasa Turki ("jaga mata") diterjemahkan perkataan demi perkataan, ia kelihatan tidak bermakna dan malah melucukan kepada penonton Inggeris, dan keseriusan jenama itu telah rosak. Cara yang betul: untuk memastikan terjemahan disahkan oleh seseorang yang mengetahui bahasa sasaran.
Gesaan lemah / Gesaan kuat
Gesaan yang lemah:
Sari kata video ini dan terjemahkannya ke dalam bahasa Inggeris.
Tiada pemformatan, tiada peraturan kebolehbacaan, tiada tanda pengesahan. Keluaran akan menjadi mentah dan berisiko.
Gesaan kuat:
Peranan anda: editor sari kata dwibahasa.Input: transkrip kod masa Turki.Tugas:1) Edit sari kata Turki sebanyak 2 baris / ~40 aksara / peraturan pembahagian yang baik.2) Tandakan nama dan istilah yang betul dengan [CONTROL].3) Hasilkan terjemahan bahasa Inggeris secara berasingan; Pindahkan frasa secara literal, kekalkan nama jenama.4) Tandakan blok yang melebihi kelajuan bacaan dengan [LONG].5) Jangan membentuk sebarang perkataan; Tulis bunyi yang tidak tentu [TANPA DIDIKASI].
Kesilapan biasa
- Menerbitkan transkrip automatik tanpa kawalan. Ralat dalam nama yang betul, istilah, tanda baca dan perkataan yang dibuat-buat kekal.
- Pemisahan garisan buruk. Baris yang berakhir dengan "dan/tetapi/ki" menyukarkan membaca.
- Melebihi kelajuan membaca. Sari kata panjang yang terlalu pendek pada skrin tidak boleh dibaca.
- Tidak mengesahkan terjemahan mesin. Jika simpulan bahasa, jenaka atau istilah salah, jenama itu menderita.
- Melangkaui perbezaan pembesar suara. Jika terdapat kekeliruan tentang "siapa berkata apa" dalam panel, sari kata akan mengelirukan.
Petua: Semasa mengedit transkrip, tonton video pada kelajuan 1.25-1.5 dan pastikan ia disegerakkan dengan sari kata. Dengan cara ini anda cepat menangkap kedua-dua timecode drift dan perkataan yang dibuat/terlepas.
Awas: Dalam bidang seperti penjagaan kesihatan, undang-undang, kewangan, satu perkataan yang ditranskripsi dengan salah (cth. dos, nombor ramuan) boleh membawa akibat yang serius. Dalam kandungan ini, setiap nombor dan istilah mesti disahkan secara berasingan.
Secara ringkasnya
Transkripsi dan sari kata automatik ialah penjimat masa terbesar pasca pengeluaran dan membolehkan kebolehaksesan. AI mengurangkan jam transkripsi kepada minit dan membolehkan carian melalui teks. Tetapi output tidak sesuai untuk penerbitan dalam bentuk mentahnya: nama yang betul, istilah, tanda baca, perkataan yang dibuat-buat dan pemisah baris yang buruk mesti diperbetulkan. Peraturan kebolehbacaan (panjang baris, tempoh, kelajuan membaca) menjadikan teks lancar untuk penonton. Dalam sari kata berbilang bahasa, terjemahan mesin mesti disahkan oleh seseorang yang mengetahui bahasa sasaran. AI menuangkan dan mencadangkan; Ketepatan, kebolehbacaan dan makna adalah tanggungjawab editor.
Tugasan permohonan
Ambil rakaman perbualan pendek (mungkin suara anda sendiri, 2-3 minit) dan transkripsikannya secara automatik. Bandingkan output dengan audio asal dan tandakan kata nama khas, istilah dan ralat tanda baca; Cari sekurang-kurangnya lima ralat. Kemudian, minta teks dibahagikan kepada blok sari kata mengikut peraturan di atas, diterjemahkan ke dalam satu bahasa dan betulkan sekurang-kurangnya dua perkara berisiko (simpulan bahasa/istilah) dalam terjemahan. Laporkan proses dan sebarang ralat yang anda temui.
senarai semak
- [ ] Adakah saya telah membandingkan transkrip dengan audio asal dan membetulkan sebarang kesilapan kata nama/istilah/tanda baca yang sepatutnya?
- [ ] Adakah saya telah menyemak perkataan yang dibuat atau ditinggalkan?
- [ ] Adakah saya telah menyunting sari kata mengikut peraturan panjang baris, tempoh dan kelajuan membaca?
- [ ] Untuk sari kata berbilang bahasa, adakah saya telah mengesahkan terjemahan dengan teliti dengan seseorang yang mengetahui bahasa sasaran?
- [ ] Adakah saya telah mengesahkan secara berasingan setiap nombor dan istilah dalam kandungan sensitif?