Satuan 4 / 11

Transkripsi dan Subtitling: Pidato ke Teks dan Subtitling Multibahasa

Keuntungan:

  • Kemampuan untuk memahami konsep transkripsi otomatis dan pemisahan speaker serta mengubah rekaman mentah menjadi teks berkode waktu
  • Kemampuan untuk memahami format subtitle (SRT/VTT), kecepatan membaca dan aturan garis, serta memproduksi dan mengedit draf subtitle multibahasa
  • Memahami bahwa merupakan tanggung jawab editor untuk memverifikasi terminologi, nama diri, kesalahan tanda baca, dan kesalahan terjemahan dalam transkrip otomatis sebelum dipublikasikan.

Tugas pasca-produksi yang paling membosankan dan memakan waktu biasanya adalah transkripsi: seorang editor akan mendengarkan rekaman wawancara selama berjam-jam tanpa henti, mengetik setiap kalimat dengan tangan. Rekaman satu jam akan membutuhkan empat hingga lima jam untuk ditranskrip. Kecerdasan buatan telah mengubah bisnis ini secara radikal: saat ini rekaman berdurasi satu jam dapat diubah menjadi teks berkode waktu dalam hitungan menit. Hal ini mempercepat proses pengeditan dan memungkinkan aksesibilitas (subtitel untuk pemirsa dengan gangguan pendengaran dan menonton tanpa suara). Namun keluaran otomatis tidak pernah cocok untuk dipublikasikan dalam bentuk mentah; Dalam unit ini kita akan melihat kekuatan dan jebakannya.

Mari kita mulai dengan persyaratannya. Transkripsi adalah penyampaian pidato ke dalam tulisan. Pengenalan ucapan otomatis (ASR) adalah teknologi yang menerjemahkan suara menjadi teks. Kode waktu adalah tanda yang menunjukkan detik mana yang sesuai dengan teks dalam video. Diarisasi pembicara adalah membedakan “siapa yang berbicara” dan membagi teks menjadi pembicara. Subtitle (subjudul/caption) adalah teks berkode waktu yang muncul di layar. SRT dan VTT adalah format file subtitle yang paling umum; Mereka berisi urutan, waktu mulai-berakhir, dan teks setiap baris. Kecepatan membaca (CPS: karakter per detik) menentukan berapa lama garis harus tetap berada di layar agar pemirsa dapat membaca subtitle dengan nyaman.

Kekuatan dan batas transkripsi otomatis

Transkripsi AI mentranskripsikan suara satu speaker yang jelas dan direkam dalam bahasa Turki dengan akurasi sangat tinggi. Namun ia membuat kesalahan dalam situasi berikut, dan mengetahui hal ini memungkinkan Anda menargetkan verifikasi: nama diri (nama orang, merek, tempat sering kali salah eja), istilah teknis dan singkatan, kata-kata yang terdengar serupa (“kar/kar”, “masih/masih”), ucapan yang tumpang tindih (dua orang pada saat yang sama), kebisingan latar belakang dan musik, perbedaan dialek/aksen dan tanda baca (pertanyaan atau akhir kalimat). Selain itu, model mungkin “mendengar” dan menuliskan kata yang belum pernah diucapkan di saat-saat ramai—inilah halusinasi transkripsi.

Tabel berikut merangkum kondisi kuat dan lemah untuk transkripsi otomatis:

kondisi

akurasi

Fokus redaksi

Speaker tunggal, suara jernih, lingkungan tenang

sangat tinggi

Nama yang tepat, tanda baca

Panel multi-speaker

sedang

Pemisahan pembicara, pidato yang tumpang tindih

Rekaman berisik/di luar ruangan

rendah-sedang

Kata yang dibuat-buat, lompat

Konten teknis/jargon

sedang

Penulisan istilah dan singkatan

ucapan beraksen

Variabel

Kesalahan kata, artinya

Format subtitle dan aturan keterbacaan

Subjudul yang baik bukan sekadar "teks yang benar"; harus dapat dibaca. Ada beberapa aturan praktis dalam praktik internasional: satu baris subjudul umumnya tidak boleh lebih dari dua baris; setiap baris harus dijaga dengan panjang yang wajar (kira-kira 37-42 karakter); Subtitle harus tetap berada di layar cukup lama untuk dibaca (biasanya 1-6 detik); Kecepatan membaca tidak boleh terlalu tinggi (kebanyakan panduan menganggap ~15-17 karakter/detik sebagai batasnya). Alat AI secara otomatis membagi subjudul, tetapi pemisahan ini terkadang memotong kalimat di tempat yang buruk (baris diakhiri dengan "dan", pemisah yang membagi makna). Tugas editor adalah membuat teks akurat dan lancar.

Peran Anda: asisten editor subtitle. Di bawah ini adalah transkrip otomatis. Tugas:1) Membagi teks menjadi blok subjudul sesuai dengan logika SRT.2) Setiap blok maksimal 2 baris, setiap baris tidak boleh melebihi ~40 karakter.3) Bagilah kalimat di tempat yang bermakna; Baris diakhiri dengan "dan", "tetapi", "itu".4) Tandai kata benda dan istilah yang tepat dengan tag [PERIKSA] sehingga saya dapat memverifikasinya secara manual.5) Jangan mengubah teks, cukup pisahkan dan tandai.

Ide "tag [CONTROL]" dalam prompt ini sangat berharga: Memiliki AI menandai area yang tidak pasti atau berisiko (nama yang tepat, istilah) mengarahkan mata editor ke tempat yang tepat dan mencegah kepercayaan buta.

Subtitle dan terjemahan multibahasa

Membuka video ke berbagai bahasa akan meningkatkan jumlah penontonnya. AI dapat mengambil transkripnya, menerjemahkannya ke dalam bahasa target, dan menghasilkan file subtitle. Ini adalah kemampuan yang hebat, namun paling rentan: terjemahan mesin dapat salah menggambarkan idiom, referensi budaya, humor dan permainan kata-kata, istilah, dan konteks. Menerjemahkan kalimat "Hujan kucing dan anjing" kata demi kata adalah sebuah bencana. Ada juga batasan ruang dalam terjemahan subtitle: kalimat dalam bahasa target mungkin lebih panjang dan melebihi kecepatan membaca. Oleh karena itu, dalam pembuatan teks multibahasa, penting bagi seseorang yang mengetahui bahasa target untuk memverifikasi terjemahannya — terutama untuk konten sensitif seperti branding, hukum, atau kesehatan, terjemahan yang salah dapat menimbulkan konsekuensi yang serius.

Terjemahkan blok subtitle bahasa Turki berikut ke dalam bahasa Inggris. Aturan: - Alihkan idiom dan lelucon, bukan kata demi kata, tetapi pertahankan MAKNANYA. - Biarkan nama merek dan nama produk apa adanya, jangan diterjemahkan. - Biarkan setiap blok mempertahankan kecepatan membaca; Persingkatlah bila perlu, tetapi jangan sampai menyimpangkan maknanya. - Tentukan referensi budaya atau istilah yang Anda tidak yakin dengan [CATATAN PENERJEMAH].

tiga kasus mini

Kasus 1 — Garis percepatan. Seorang kru film dokumenter menghabiskan waktu tiga minggu untuk menyalin arsip wawancara berdurasi 12 jam. Dengan transkripsi otomatis, teks mentah dihasilkan dalam satu hari; Dengan melakukan pencarian melalui teks (kata demi kata), tim menemukan momen yang mereka inginkan dalam hitungan detik. Kemudian mereka dengan cermat mengedit dan memberi subtitle hanya pada episode berdurasi 40 menit yang akan mereka gunakan. Tiga minggu berubah menjadi empat hari; upaya verifikasi terfokus pada bagian yang digunakan.

Kasus 2 - Kata yang dibuat-buat. Sebuah saluran berita menyiarkan wawancara jalanan yang riuh itu dengan subtitle otomatis, tanpa memeriksanya. Model "mendengar" kata yang tidak terucapkan di latar belakang, dan keterangannya menyampaikan kata yang tidak terucapkan kepada orang yang diwawancarai. Ada reaksi di media sosial dan koreksi tersebut dipublikasikan. Pelajaran: pada rekaman berisik, subtitle otomatis harus dibandingkan dengan audio aslinya.

Kasus 3 — Bencana penerjemahan. Sebuah merek memublikasikan subtitle bahasa Inggris dari video promosinya dengan terjemahan mesin dan tanpa kendali. Ketika idiom Turki ("awas") diterjemahkan kata demi kata, hal itu terasa tidak berarti dan bahkan lucu bagi penonton Inggris, dan keseriusan merek tersebut pun rusak. Cara yang benar: agar terjemahannya diverifikasi oleh seseorang yang mengetahui bahasa target.

Perintah lemah / Perintah kuat

Perintah yang lemah:

Subtitle video ini dan terjemahkan ke dalam bahasa Inggris.

Tidak ada pemformatan, tidak ada aturan keterbacaan, tidak ada tanda validasi. Outputnya akan kasar dan berisiko.

Perintah yang kuat:

Peran Anda: editor subtitle bilingual.Masukan: Transkrip kode waktu Turki.Tugas:1) Edit subtitle Turki sebanyak 2 baris / ~40 karakter / aturan pembagian yang baik.2) Tandai nama dan istilah yang tepat dengan [CONTROL].3) Menghasilkan terjemahan bahasa Inggris secara terpisah; Transfer frasa secara harfiah, pertahankan nama merek.4) Tandai blok yang melebihi kecepatan membaca dengan [PANJANG].5) Jangan mengarang kata apa pun; Tuliskan bunyi tak tentu [TIDAK DIINDIKASI].

Kesalahan umum

  • Menerbitkan transkrip otomatis tanpa kendali. Masih terdapat kesalahan pada nama diri, istilah, tanda baca, dan kata-kata yang dibuat-buat.
  • Pemisahan garis yang buruk. Baris yang diakhiri dengan "dan/tetapi/ki" membuat pembacaan menjadi sulit.
  • Melebihi kecepatan membaca. Subtitle panjang yang terlalu pendek di layar tidak dapat dibaca.
  • Tidak memverifikasi terjemahan mesin. Jika sebuah idiom, lelucon atau istilah salah, merek akan menderita.
  • Melewati perbedaan pembicara. Jika ada kebingungan mengenai "siapa bilang apa" di panel, subjudulnya akan menyesatkan.
Tip: Saat mengedit transkrip, tonton video dengan kecepatan 1,25-1,5 dan periksa apakah sudah sinkron dengan subtitle. Dengan cara ini Anda dengan cepat menangkap penyimpangan kode waktu dan kata-kata yang dibuat-buat/tidak terjawab.
Perhatian: Di bidang kesehatan, hukum, keuangan, satu kata yang salah ditranskripsikan (misalnya dosis, nomor bahan) dapat menimbulkan konsekuensi serius. Dalam konten ini, setiap nomor dan istilah harus diverifikasi secara terpisah.

Singkatnya

Transkripsi dan subtitle otomatis adalah penghemat waktu pascaproduksi terbesar dan memungkinkan aksesibilitas. AI mengurangi jam transkripsi menjadi menit dan memungkinkan pencarian melalui teks. Namun hasilnya tidak cocok untuk dipublikasikan dalam bentuk mentah: nama diri, istilah, tanda baca, kata-kata yang dibuat-buat, dan jeda baris yang buruk harus diperbaiki. Aturan keterbacaan (panjang garis, durasi, kecepatan membaca) membuat teks lancar bagi pemirsa. Dalam subtitle multibahasa, terjemahan mesin harus diverifikasi oleh orang yang mengetahui bahasa target. AI menuangkan dan menyarankan; Akurasi, keterbacaan dan makna adalah tanggung jawab editor.

Tugas aplikasi

Ambil rekaman percakapan singkat (mungkin suara Anda sendiri, 2-3 menit) dan transkripsikan secara otomatis. Bandingkan keluarannya dengan audio asli dan tandai kesalahan kata benda, istilah, dan tanda baca; Temukan setidaknya lima kesalahan. Kemudian, teks dibagi menjadi blok-blok subjudul sesuai aturan di atas, diterjemahkan ke dalam satu bahasa, dan mengoreksi setidaknya dua poin berisiko (idiom/istilah) dalam terjemahan. Laporkan proses dan kesalahan apa pun yang Anda temukan.

daftar periksa

  • [ ] Sudahkah saya membandingkan transkrip dengan audio asli dan mengoreksi kesalahan kata benda/istilah/tanda baca yang tepat?
  • [ ] Sudahkah saya memeriksa kata-kata yang dibuat-buat atau dihilangkan?
  • [ ] Apakah saya sudah mengedit subtitle sesuai aturan panjang baris, durasi, dan kecepatan membaca?
  • [ ] Untuk subtitle multibahasa, sudahkah saya memverifikasi terjemahannya secara cermat dengan seseorang yang mengetahui bahasa target?
  • [ ] Apakah saya sudah memverifikasi secara terpisah setiap nomor dan istilah dalam konten sensitif?