ಘಟಕಗಳು
1. ಅನುವಾದ ಮತ್ತು ವ್ಯಾಖ್ಯಾನದಲ್ಲಿ ಕೃತಕ ಬುದ್ಧಿಮತ್ತೆಯ ಪರಿಚಯ: ಪಾತ್ರಗಳು, ಗಡಿಗಳು, ದೃಢೀಕರಣ, ಗೌಪ್ಯತೆ ಮತ್ತು ನೀತಿಶಾಸ್ತ್ರ 2. ಯಂತ್ರ ಅನುವಾದದ ಮೂಲಭೂತ ಅಂಶಗಳು: NMT, LLM, ಎಂಜಿನ್ ಆಯ್ಕೆ ಮತ್ತು ಪೂರ್ವ-ಮೌಲ್ಯಮಾಪನ 3. ಯಂತ್ರ ಅನುವಾದ ಪೋಸ್ಟ್-ಎಡಿಟಿಂಗ್ (MTPE): ಹಗುರವಾದ ಮತ್ತು ಪೂರ್ಣ ನಂತರದ ಸಂಪಾದನೆ 4. ಪರಿಭಾಷೆ ನಿರ್ವಹಣೆ ಮತ್ತು ನಿಯಮಾವಳಿ: ಸ್ಥಿರತೆ ಮತ್ತು ಕಾರ್ಪೊರೇಟ್ ಭಾಷೆ 5. CAT ಪರಿಕರಗಳು ಮತ್ತು ಅನುವಾದ ಸ್ಮರಣೆ (TM) ಜೊತೆಗೆ AI ಏಕೀಕರಣ 6. ಸ್ಥಳೀಕರಣ (L10n): ಸಾಫ್ಟ್‌ವೇರ್, ವೆಬ್, ಗೇಮ್ ಮತ್ತು ಕಲ್ಚರಲ್ ಅಡಾಪ್ಟೇಶನ್ 7. ಉಪಶೀರ್ಷಿಕೆ, ಡಬ್ಬಿಂಗ್ ಮತ್ತು ಆಡಿಯೋವಿಶುವಲ್ ಅನುವಾದ 8. ಗುಣಮಟ್ಟ ನಿಯಂತ್ರಣ (QA), ಮೌಲ್ಯಮಾಪನ ಮೆಟ್ರಿಕ್ಸ್ ಮತ್ತು LQA 9. ಇಂಟರ್ಪ್ರಿಟಿಂಗ್ ತಯಾರಿ: ಸತತ ಮತ್ತು ಏಕಕಾಲಿಕ ವ್ಯಾಖ್ಯಾನ 10. ಸಂದರ್ಭ, ಸಂಸ್ಕೃತಿ, ಸ್ವರ ಮತ್ತು ಸೃಜನಾತ್ಮಕ ಅನುವಾದ (ಪ್ರತಿರೂಪ) 11. ಗೌಪ್ಯತೆ, ನೈತಿಕತೆ, ಹಕ್ಕುಸ್ವಾಮ್ಯ, ದೃಢೀಕರಣ ಮತ್ತು ವೃತ್ತಿಯ ಭವಿಷ್ಯ
ಘಟಕ 7 / 11

ಉಪಶೀರ್ಷಿಕೆ, ಡಬ್ಬಿಂಗ್ ಮತ್ತು ಆಡಿಯೋವಿಶುವಲ್ ಅನುವಾದ

ಲಾಭಗಳು:

  • ಉಪಶೀರ್ಷಿಕೆ (ಸಾಲು, ಅಕ್ಷರ, CPS) ತಾಂತ್ರಿಕ ನಿಯಮಗಳನ್ನು ಅನ್ವಯಿಸುವ ಮೂಲಕ ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುವಾಗ ಹೊಂದಿಕೊಳ್ಳುವ ಸಾಮರ್ಥ್ಯ
  • ASR ನೊಂದಿಗೆ ಪ್ರತಿಲೇಖನ ಮತ್ತು ಸ್ವಯಂಚಾಲಿತ ಟೈಮ್‌ಕೋಡಿಂಗ್ ಅನ್ನು ವೇಗಗೊಳಿಸುವಾಗ ಧ್ವನಿಯ ಮೂಲಕ ಸರಿಯಾದ ಹೆಸರು ಮತ್ತು ಸಂಖ್ಯೆ ದೋಷಗಳನ್ನು ಪರಿಶೀಲಿಸುವ ಸಾಮರ್ಥ್ಯ
  • ಡಬ್ಬಿಂಗ್‌ನಲ್ಲಿ ದೃಶ್ಯ ಸಂದರ್ಭ, ನಾದ ವ್ಯತ್ಯಾಸ ಮತ್ತು ಲಿಪ್ ಸಿಂಕ್ ಅನ್ನು ಗಣನೆಗೆ ತೆಗೆದುಕೊಂಡು ಕೃತಕ ಬುದ್ಧಿಮತ್ತೆಯ ಮಿತಿಗಳನ್ನು ನಿರ್ವಹಿಸುವ ಸಾಮರ್ಥ್ಯ

ಚಲನಚಿತ್ರ, ಟಿವಿ ಸರಣಿ, ಕಾರ್ಪೊರೇಟ್ ವೀಡಿಯೊ ಅಥವಾ ಆನ್‌ಲೈನ್ ಕೋರ್ಸ್ ಅನ್ನು ಭಾಷಾಂತರಿಸುವುದು ಸರಳ ಪಠ್ಯವನ್ನು ಅನುವಾದಿಸುವುದಕ್ಕಿಂತ ಆಮೂಲಾಗ್ರವಾಗಿ ವಿಭಿನ್ನವಾಗಿದೆ: ಸಮಯ, ಓದುವ ವೇಗ, ಪರದೆಯ ಮೇಲಿನ ಚಿತ್ರ, ಧ್ವನಿ ಮತ್ತು ಪಾತ್ರಗಳ ತುಟಿ ಚಲನೆ ಸಹ ನಿರ್ಬಂಧಗಳಾಗಿವೆ. ಈ ಘಟಕದಲ್ಲಿ, ನೀವು ಆಡಿಯೊವಿಶುವಲ್ ಅನುವಾದ (ಉಪಶೀರ್ಷಿಕೆ, ಡಬ್ಬಿಂಗ್, ಧ್ವನಿ-ಓವರ್), ಉಪಶೀರ್ಷಿಕೆಗಳ ತಾಂತ್ರಿಕ ನಿಯಮಗಳು, AI- ಬೆಂಬಲಿತ ಪ್ರತಿಲೇಖನ ಮತ್ತು ಸಮಯ ಕೋಡಿಂಗ್ ಮತ್ತು ಈ ಕ್ಷೇತ್ರದ ಗುಣಮಟ್ಟದ ಮೋಸಗಳನ್ನು ಕಲಿಯುವಿರಿ. "ಪಠ್ಯವನ್ನು ಭಾಷಾಂತರಿಸುವ" ಬದಲಿಗೆ "ಪ್ರೇಕ್ಷಕರ ಕಣ್ಣು ಮತ್ತು ಕಿವಿಗೆ ಸರಿಹೊಂದುವ" ಶ್ರವ್ಯ ಅನುವಾದ ತಜ್ಞರಂತೆ ಕೆಲಸ ಮಾಡುವುದು ಗುರಿಯಾಗಿದೆ.

ಮೂಲ ಪರಿಕಲ್ಪನೆಗಳು

ಆಡಿಯೊವಿಶುವಲ್ ಅನುವಾದ (AVT) ಎಂಬುದು ಆಡಿಯೊ ಮತ್ತು ವೀಡಿಯೋ ಹೊಂದಿರುವ ವಿಷಯದ ಅನುವಾದವಾಗಿದೆ; ಮುಖ್ಯ ರೂಪಗಳು ಉಪಶೀರ್ಷಿಕೆ, ಡಬ್ಬಿಂಗ್ ಮತ್ತು ಆಡಿಯೊ ವಿವರಣೆ. ಉಪಶೀರ್ಷಿಕೆ ಎನ್ನುವುದು ಪರದೆಯ ಮೇಲೆ ಲಿಖಿತ ರೂಪದಲ್ಲಿ ಭಾಷಣದ ಪ್ರತಿಬಿಂಬವಾಗಿದೆ. ಡಬ್ಬಿಂಗ್ ಎಂದರೆ ಉದ್ದೇಶಿತ ಭಾಷೆಯಲ್ಲಿ ಮೂಲ ಧ್ವನಿಯನ್ನು ಮರು-ಡಬ್ಬಿಂಗ್ ಮಾಡುವುದು. ವಾಯ್ಸ್-ಓವರ್ ಎಂದರೆ ಮೂಲ ಧ್ವನಿಯನ್ನು ಮ್ಯೂಟ್ ಮಾಡಿದಾಗ ಮತ್ತು ಅದರ ಮೇಲೆ ಅನುವಾದವನ್ನು ಓದಿದಾಗ (ಸಾಕ್ಷ್ಯಚಿತ್ರಗಳಲ್ಲಿ ಸಾಮಾನ್ಯವಾಗಿದೆ).

ಉಪಶೀರ್ಷಿಕೆಯ ಎರಡು ನಿರ್ಣಾಯಕ ತಾಂತ್ರಿಕ ನಿಯಮಗಳು: CPS (ಪ್ರತಿ ಸೆಕೆಂಡಿಗೆ ಅಕ್ಷರಗಳು) ಉಪಶೀರ್ಷಿಕೆಯ ವೇಗವನ್ನು ಮಿತಿಗೊಳಿಸುತ್ತದೆ ಇದರಿಂದ ವೀಕ್ಷಕರು ಅದನ್ನು ಆರಾಮವಾಗಿ ಓದಬಹುದು; ಸಾಮಾನ್ಯವಾಗಿ ಸ್ವೀಕರಿಸಿದ ಮೇಲಿನ ಮಿತಿಯು ಪ್ರತಿ ಸೆಕೆಂಡಿಗೆ ಸುಮಾರು 17 ಅಕ್ಷರಗಳು (ಮಕ್ಕಳ ವಿಷಯಕ್ಕೆ ಕಡಿಮೆ). ಟೈಮ್‌ಕೋಡ್ ಎಂಬುದು ಪ್ರಾರಂಭ-ಕೊನೆಯ ಸಮಯವಾಗಿದ್ದು, ಉಪಶೀರ್ಷಿಕೆಯು ಪರದೆಯ ಮೇಲೆ ಯಾವಾಗ ಕಾಣಿಸಿಕೊಳ್ಳುತ್ತದೆ ಮತ್ತು ಕಣ್ಮರೆಯಾಗುತ್ತದೆ ಎಂದು ಸೂಚಿಸುತ್ತದೆ (ಉದಾಹರಣೆಗೆ 00:01:23,400).

ಏಕೆ ಕಷ್ಟ? ಏಕೆಂದರೆ ಉಪಶೀರ್ಷಿಕೆಗಳಿಗೆ ಅನುವಾದವನ್ನು ಅಳವಡಿಸುವುದು ಎಂದರ್ಥ. ಎರಡು ಸಾಲುಗಳು, ಪ್ರತಿ ಸಾಲಿಗೆ ~42 ಅಕ್ಷರಗಳು, ಕನಿಷ್ಠ ~1 ಸೆಕೆಂಡ್ ಮತ್ತು ಗರಿಷ್ಠ ~6 ಸೆಕೆಂಡ್‌ಗಳ ಪರದೆಯ ಸಮಯ, ಮತ್ತು CPS ಮಿತಿ - ಅರ್ಥ ಮತ್ತು ಟೋನ್ ಅನ್ನು ಕಾಪಾಡಿಕೊಳ್ಳುವಾಗ ನೀವು ಇವೆಲ್ಲವನ್ನೂ ಅನುಸರಿಸಬೇಕಾಗುತ್ತದೆ. ಅದಕ್ಕಾಗಿಯೇ ಉಪಶೀರ್ಷಿಕೆ ಅನುವಾದವು ಸಾಮಾನ್ಯವಾಗಿ ಸಂಕೋಚನ ಮತ್ತು ಪುನರಾವರ್ತನೆಯ ವಿಷಯವಾಗಿದೆ, ಪದದಿಂದ ಪದದ ಅನುವಾದವಲ್ಲ.

ಸಲಹೆ: ಉಪಶೀರ್ಷಿಕೆಗಳಲ್ಲಿ "ಪ್ರತಿ ಪದವನ್ನು ಅನುವಾದಿಸುವ" ಪ್ರತಿಫಲಿತವನ್ನು ತಪ್ಪಿಸಿ. ವೀಕ್ಷಕರು ಚಿತ್ರವನ್ನು ವೀಕ್ಷಿಸುತ್ತಾರೆ ಮತ್ತು ಓದುತ್ತಾರೆ; ತುಂಬಾ ಉದ್ದವಾದ ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು ಓದಲಾಗುವುದಿಲ್ಲ. ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುವ ಚಿಕ್ಕದಾದ ನೈಸರ್ಗಿಕ ಅಭಿವ್ಯಕ್ತಿಯನ್ನು ಕಂಡುಹಿಡಿಯುವುದು ಶೀರ್ಷಿಕೆದಾರನ ನಿಜವಾದ ಪಾಂಡಿತ್ಯವಾಗಿದೆ.

ಆಡಿಯೋವಿಶುವಲ್ ಅನುವಾದದಲ್ಲಿ AI ನ ಪಾತ್ರ

AI ಈ ಪ್ರದೇಶದಲ್ಲಿ ಹಲವಾರು ಹಂತಗಳನ್ನು ಗಮನಾರ್ಹವಾಗಿ ವೇಗಗೊಳಿಸುತ್ತದೆ:

  1. ಪ್ರತಿಲೇಖನ: ASR (ಸ್ವಯಂಚಾಲಿತ ಭಾಷಣ ಗುರುತಿಸುವಿಕೆ) ಯೊಂದಿಗೆ, ಧ್ವನಿಯು ಸ್ವಯಂಚಾಲಿತವಾಗಿ ಲಿಪ್ಯಂತರಗೊಳ್ಳುತ್ತದೆ. ಇದು ಉಪಶೀರ್ಷಿಕೆಯ ಕಚ್ಚಾ ಮೂಲವನ್ನು ನಿಮಿಷಗಳಲ್ಲಿ ಹೊರತೆಗೆಯುತ್ತದೆ.
  2. ಸ್ವಯಂಚಾಲಿತ ಸಮಯ ಕೋಡಿಂಗ್: ಪರಿಕರಗಳು ಸಂಭಾಷಣೆಯನ್ನು ಭಾಗಗಳಾಗಿ ವಿಭಜಿಸುತ್ತವೆ ಮತ್ತು ಡ್ರಾಫ್ಟ್ ಸಮಯ ಕೋಡ್‌ಗಳನ್ನು ಉತ್ಪಾದಿಸುತ್ತವೆ.
  3. ಅನುವಾದ ಕರಡು: ಪ್ರತಿಲಿಪಿ ಪಠ್ಯವನ್ನು ಅನುವಾದಿಸಲಾಗಿದೆ.
  4. CPS/ಉದ್ದದ ನಿಯಂತ್ರಣ: AI ಯಾವ ಉಪಶೀರ್ಷಿಕೆಯು ಓದುವ ವೇಗವನ್ನು ಮೀರಿದೆ ಎಂಬುದನ್ನು ಗುರುತಿಸಬಹುದು ಮತ್ತು ಕಡಿಮೆ ಮಾಡಲು ಸೂಚಿಸಬಹುದು.

ಆದರೆ ಹುಷಾರಾಗಿರು: ASR ಶಬ್ದ, ಉಚ್ಚಾರಣೆ, ಅತಿಕ್ರಮಿಸುವ ಮಾತು, ಸರಿಯಾದ ಹೆಸರುಗಳು ಮತ್ತು ತಾಂತ್ರಿಕ ಪದಗಳ ಮೇಲೆ ತಪ್ಪುಗಳು; "ಆಡಿಯೋ ವಿವರಣೆ" ಒದಗಿಸಲು ಸಾಧ್ಯವಿಲ್ಲ; ಯಾರು ಮಾತನಾಡುತ್ತಿದ್ದಾರೆ ಎಂಬ ಗೊಂದಲ ಉಂಟಾಗಬಹುದು. AI ಅನುವಾದವು ಚಿತ್ರವನ್ನು ನೋಡುವುದಿಲ್ಲ - ಪರದೆಯ ಮೇಲೆ ತೋರಿಸಲಾದ ವಸ್ತುವನ್ನು "ಅದು" ಎಂದು ಕರೆಯುವಾಗ ಅದು ತಿಳಿಯುವುದಿಲ್ಲ. ಆದ್ದರಿಂದ, ಮಾನವನು ದೃಶ್ಯ ಸಂದರ್ಭವನ್ನು ಮತ್ತು ಡೀಕ್ರಿಪ್ಟಿಂಗ್ ನಿಖರತೆಯನ್ನು ಪರಿಶೀಲಿಸುತ್ತಾನೆ.

ಎಚ್ಚರಿಕೆ: ಎಎಸ್ಆರ್ ಔಟ್ಪುಟ್ ಅನ್ನು "ಡಿಕೋಡ್ ಮಾಡಲಾಗಿದೆ" ಎಂದು ಯೋಚಿಸುವುದು ಸಾಮಾನ್ಯ ತಪ್ಪು. ASR ಆಗಾಗ್ಗೆ ತಪ್ಪುಗಳನ್ನು ಮಾಡುತ್ತದೆ, ವಿಶೇಷವಾಗಿ ಸರಿಯಾದ ಹೆಸರುಗಳು, ಸಂಖ್ಯೆಗಳು, ಬ್ರ್ಯಾಂಡ್ ಹೆಸರುಗಳು ಮತ್ತು ತಾಂತ್ರಿಕ ಪದಗಳಲ್ಲಿ; ತಪ್ಪಾದ ಪ್ರತಿಲೇಖನವು ಅನುವಾದ ಮತ್ತು ಉಪಶೀರ್ಷಿಕೆಗೆ ಒಯ್ಯುತ್ತದೆ. ಆಡಿಯೊವನ್ನು ಆಲಿಸುವ ಮೂಲಕ ನಿರ್ಣಾಯಕ ಪ್ರದೇಶಗಳನ್ನು ಪರಿಶೀಲಿಸಲು ಮರೆಯದಿರಿ.

ಉಪಶೀರ್ಷಿಕೆ ಸ್ವರೂಪದ ನಿಯಮಗಳು

ಸಾಮಾನ್ಯ ನಿಯಮಗಳು (ಪ್ಲಾಟ್‌ಫಾರ್ಮ್‌ನಿಂದ ಬದಲಾಗುತ್ತದೆ):

  • ಪ್ರತಿ ಸಾಲಿಗೆ ~37-42 ಅಕ್ಷರಗಳು, ಗರಿಷ್ಠ 2 ಸಾಲುಗಳು.
  • ಅವಧಿ: ~ 1-6 ಸೆಕೆಂಡುಗಳು; ಅತಿ ಚಿಕ್ಕ "ಫ್ಲಾಶ್" ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು ತಪ್ಪಿಸಿ.
  • CPS ~17 (ವಯಸ್ಕ ವಿಷಯ) ಮೀರಬಾರದು.
  • ವಾಕ್ಯವನ್ನು ಅರ್ಥವಿರುವಲ್ಲಿ ಮುರಿಯಿರಿ (ಸಾಲಿನ ಕೊನೆಯಲ್ಲಿ "ಮತ್ತು" ಅಥವಾ "ಆದರೆ" ಬಿಡಬೇಡಿ).
  • ಸಾಧ್ಯವಾದರೆ, ದೃಶ್ಯ ಕಟ್ ಅನ್ನು ಬಿಟ್ಟುಬಿಡಬೇಡಿ (ಶಾಟ್ ಬದಲಾವಣೆ).
  • ಪ್ರತಿಜ್ಞೆ, ಹಾಡುಗಳು, ಪರದೆಯ ಬರವಣಿಗೆಯಂತಹ ಐಟಂಗಳಿಗೆ ವೇದಿಕೆ ನಿಯಮಗಳನ್ನು ಅನುಸರಿಸಿ.

ಮೂರು ಸಣ್ಣ ಪ್ರಕರಣಗಳು

ಪ್ರಕರಣ 1 - ASR + ನಂತರದ ಸಂಪಾದನೆ 60% ರಷ್ಟು ವೇಗವನ್ನು ಹೆಚ್ಚಿಸಿದೆ. ಒಂದು ತಂಡವು ಮೊದಲು ASR ನೊಂದಿಗೆ 45 ನಿಮಿಷಗಳ ಸಾಕ್ಷ್ಯಚಿತ್ರವನ್ನು ಲಿಪ್ಯಂತರ ಮತ್ತು ಸಮಯ-ಕೋಡೆಡ್ ಮಾಡಿತು, ನಂತರ ಅದನ್ನು ಭಾಷಾಂತರಿಸಿತು ಮತ್ತು ಪೋಸ್ಟ್-ಸಂಪಾದಿಸಿತು. ಮೊದಲಿನಿಂದಲೂ ಲಿಪ್ಯಂತರ + ಸಮಯದ ಕೋಡಿಂಗ್‌ಗೆ ಹೋಲಿಸಿದರೆ ಸಮಯವನ್ನು 60% ಕಡಿಮೆ ಮಾಡಲಾಗಿದೆ. ಆದರೆ ಎಲ್ಲಾ ಸರಿಯಾದ ಹೆಸರುಗಳು ಮತ್ತು ಸಂಖ್ಯೆಗಳನ್ನು ಧ್ವನಿ ಹೋಲಿಕೆಯಿಂದ ಸರಿಪಡಿಸಲಾಗಿದೆ.

ಪ್ರಕರಣ 2 - CPS ಉಳಿಸಿದ ಓದುವಿಕೆಯನ್ನು ಪರಿಶೀಲಿಸಿ. ಉಪಶೀರ್ಷಿಕೆಗಳೊಂದಿಗೆ ಸೂಚನಾ ವೀಡಿಯೊದ ಮೊದಲ ಅನುವಾದವು ನಿಖರವಾಗಿತ್ತು, ಆದರೆ CPS ಸರಾಸರಿ 24 ಆಗಿತ್ತು - ಪ್ರೇಕ್ಷಕರು ಅದನ್ನು ಮುಂದುವರಿಸಲು ಸಾಧ್ಯವಾಗಲಿಲ್ಲ. AI-ಚಾಲಿತ ಸಂಕ್ಷಿಪ್ತಗೊಳಿಸುವಿಕೆಯ ಒಂದು ಸುತ್ತಿನ ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು 30% ರಷ್ಟು ಕಡಿಮೆಗೊಳಿಸಲಾಗಿದೆ, CPS ಅನ್ನು 16 ಕ್ಕೆ ಇಳಿಸುತ್ತದೆ; ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸಲಾಗಿದೆ, ಓದುವಿಕೆ ಬಂದಿತು.

ಪ್ರಕರಣ 3 - ದೃಶ್ಯ ಸಂದರ್ಭ ದೋಷ. ASR-ಆಧಾರಿತ ಭಾಷಾಂತರದಲ್ಲಿ, ಒಂದು ಪಾತ್ರವು ಪರದೆಯ ಮೇಲಿನ ಚಿಹ್ನೆಯನ್ನು ತೋರಿಸಿದೆ ಮತ್ತು "ಅದನ್ನು ಓದಿ" ಎಂದು ಹೇಳಿದೆ; AI ಅದನ್ನು "ಓದಿ" ಎಂದು ಅನುವಾದಿಸಿದೆ, ಆದರೆ ಚಿಹ್ನೆಯ ಮೇಲಿನ ಪಠ್ಯವನ್ನು ಅನುವಾದಿಸಲಾಗಿಲ್ಲ, ಆದ್ದರಿಂದ ವೀಕ್ಷಕರಿಗೆ ಏನು ಓದಬೇಕೆಂದು ನೋಡಲಾಗಲಿಲ್ಲ. ಶೀರ್ಷಿಕೆದಾರರು ಪರದೆಯ ಶೀರ್ಷಿಕೆಗಾಗಿ ಪ್ರತ್ಯೇಕ ಶೀರ್ಷಿಕೆಯನ್ನು ಸೇರಿಸಿದ್ದಾರೆ; ಚಿತ್ರವನ್ನು ನೋಡಿದ ವ್ಯಕ್ತಿಯು ವ್ಯತ್ಯಾಸವನ್ನು ಮಾಡಿದನು.

ನಾಲ್ಕು ನಕಲಿಸಬಹುದಾದ ಟೆಂಪ್ಲೇಟ್‌ಗಳು

1) ಪ್ರತಿಲೇಖನ (ASR) ಪರಿಶೀಲನಾ ಪಟ್ಟಿ:

ಕೆಳಗೆ ವೀಡಿಯೊದ ಸ್ವಯಂಚಾಲಿತ ಪ್ರತಿಲೇಖನವಾಗಿದೆ. ಪ್ರತಿಲೇಖನದಲ್ಲಿ ಸಂಭವನೀಯ ದೋಷಗಳನ್ನು ಗುರುತಿಸಿ: ಸರಿಯಾದ ಹೆಸರುಗಳು, ಬ್ರಾಂಡ್ ಹೆಸರುಗಳು, ಸಂಖ್ಯೆಗಳು, ತಾಂತ್ರಿಕ ಪದಗಳು, ಅಸ್ಪಷ್ಟ/ಅಪೂರ್ಣ ವಾಕ್ಯಗಳು. ಇವುಗಳನ್ನು "ಧ್ವನಿ ಮೂಲಕ ಪರಿಶೀಲಿಸು" ಎಂದು ಪಟ್ಟಿ ಮಾಡಿ. ಅನುವಾದಿಸಬೇಡಿ. ಲಿಪ್ಯಂತರ: [...]

2) ಉಪಶೀರ್ಷಿಕೆ ಅನುವಾದ (CPS/ಉದ್ದ ಸೀಮಿತ):

ಕೆಳಗಿನ ಪ್ರತಿಲೇಖನವನ್ನು [ಉದ್ದೇಶಿತ ಭಾಷೆ] ಉಪಶೀರ್ಷಿಕೆಗಳಿಗೆ ಅನುವಾದಿಸಿ. ನಿರ್ಬಂಧ: ಪ್ರತಿ ಉಪಶೀರ್ಷಿಕೆಯು ಗರಿಷ್ಠ 2 ಸಾಲುಗಳು, ಸಾಲು ~42 ಅಕ್ಷರಗಳು, CPS ~17 ಅನ್ನು ಮೀರಬಾರದು. ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುವಾಗ ಸಂಕ್ಷಿಪ್ತಗೊಳಿಸಿ ಮತ್ತು ನೈಸರ್ಗಿಕಗೊಳಿಸಿ; ಪದದಿಂದ ಪದವನ್ನು ಅನುವಾದಿಸಬೇಡಿ. ಸಮಯದ ಸಂಕೇತಗಳನ್ನು ಸಂರಕ್ಷಿಸಿ. ಪ್ರತಿಲೇಖನ + ಸಮಯ ಸಂಕೇತಗಳು: [...]

3) CPS/ಓದಬಲ್ಲ ಪರಿಶೀಲನೆ:

ಕೆಳಗಿನ ಪ್ರತಿಯೊಂದು ಉಪಶೀರ್ಷಿಕೆಗಳಿಗೆ ಅವಧಿ ಮತ್ತು ಅಕ್ಷರಗಳ ಸಂಖ್ಯೆಯನ್ನು ಆಧರಿಸಿ ಅಂದಾಜು CPS ಅನ್ನು ಲೆಕ್ಕಾಚಾರ ಮಾಡಿ. 17 ಕ್ಕಿಂತ ಹೆಚ್ಚಿರುವ ಯಾವುದನ್ನಾದರೂ ಗುರುತಿಸಿ ಮತ್ತು ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುವ ಚಿಕ್ಕ ಪರ್ಯಾಯವನ್ನು ಸೂಚಿಸಿ. ಉಪಶೀರ್ಷಿಕೆಗಳು (ಪಠ್ಯ | ಅವಧಿ ಸೆಕೆಂಡುಗಳು): [...]

4) ಪರದೆಯ ಪಠ್ಯ / ದೃಶ್ಯ ಸಂದರ್ಭ ಪರಿಶೀಲನೆ:

ಕೆಳಗಿನ ಸಂವಾದದಲ್ಲಿ, ಚಿತ್ರವನ್ನು ಉಲ್ಲೇಖಿಸಬಹುದಾದ ಸ್ಥಳಗಳನ್ನು ಗುರುತಿಸಿ (ಪರದೆಯ ಪಠ್ಯ, ಮೊನಚಾದ ವಸ್ತು, ಚಿಹ್ನೆ). ಇವುಗಳಿಗೆ ಹೆಚ್ಚುವರಿ ಉಪಶೀರ್ಷಿಕೆಗಳು / ವಿವರಣೆಗಳು ಅಗತ್ಯವಿದೆಯೇ ಎಂದು ಹೇಳಿ, ವೀಕ್ಷಕರು ಚಿತ್ರವನ್ನು ನೋಡಲಾಗುವುದಿಲ್ಲ ಎಂದು ಊಹಿಸಿ. ಸಂಭಾಷಣೆ: [...]

ದುರ್ಬಲ ಪ್ರಾಂಪ್ಟ್ / ಬಲವಾದ ಪ್ರಾಂಪ್ಟ್

ದುರ್ಬಲ: "ಈ ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು ಅನುವಾದಿಸಿ." (ಉದ್ದ, CPS, ಸಾಲಿನ ನಿಯಮಗಳಿಲ್ಲ; ಔಟ್‌ಪುಟ್ ಪರದೆಯ ಮೇಲೆ ಹೊಂದಿಕೆಯಾಗುವುದಿಲ್ಲ, ಓದಲಾಗುವುದಿಲ್ಲ.)

Güçlü: "ಈ ಸಂವಾದದ ಪ್ರತಿಲಿಪಿಯನ್ನು ಟರ್ಕಿಶ್ ಉಪಶೀರ್ಷಿಕೆಗಳಿಗೆ ಅನುವಾದಿಸಿ. ಪ್ರತಿ ಉಪಶೀರ್ಷಿಕೆಯು ಗರಿಷ್ಠ 2 ಸಾಲುಗಳು, 42 ಅಕ್ಷರಗಳು ಪ್ರತಿ ಸಾಲಿಗೆ ಇರಬೇಕು; ಓದುವ ವೇಗಕ್ಕೆ ಅಗತ್ಯವಿದ್ದಾಗ ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುವಾಗ ಅದನ್ನು ಸಂಕ್ಷಿಪ್ತಗೊಳಿಸಿ. ನೈಸರ್ಗಿಕ ಟರ್ಕಿಶ್ ಭಾಷೆಯಲ್ಲಿ ಮಾತನಾಡುವ ಭಾಷೆಯನ್ನು ನೀಡಿ, ಆಡುಭಾಷೆಯನ್ನು ಮೃದುಗೊಳಿಸಿ. ಸಮಯದ ಕೋಡ್‌ಗಳನ್ನು ಸ್ಪರ್ಶಿಸಬೇಡಿ."

ವ್ಯತ್ಯಾಸ: ಬಲವಾದ ಪ್ರಾಂಪ್ಟ್ ಉಪಶೀರ್ಷಿಕೆಯ ತಾಂತ್ರಿಕ ನಿರ್ಬಂಧಗಳನ್ನು ನೀಡುತ್ತದೆ (ಸಾಲು, ಪಾತ್ರ, CPS, ಟೋನ್); ಔಟ್ಪುಟ್ ವಾಸ್ತವವಾಗಿ ಬಳಸಬಹುದಾದ ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು ಸಮೀಪಿಸುತ್ತದೆ.

AVT ಸ್ವರೂಪಗಳ ಹೋಲಿಕೆ ಚಾರ್ಟ್

ಸ್ವರೂಪ

ಏನು ಮಾಡುತ್ತದೆ

AI ಕೊಡುಗೆ

ಮಾನವ ನಿರ್ಣಾಯಕ ಬಿಂದು

ಉಪಶೀರ್ಷಿಕೆ

ಭಾಷಣವನ್ನು ಲಿಪ್ಯಂತರ

ASR, ಅನುವಾದ, CPS

ಫಿಟ್, ದೃಶ್ಯ ಸಂದರ್ಭ

ಡಬ್ಬಿಂಗ್

ಗುರಿ ಭಾಷೆಯಲ್ಲಿ ವಾಯ್ಸ್ಓವರ್

ಅನುವಾದ ಕರಡು

ತುಟಿ ಸಿಂಕ್, ನಟನೆ

ಧ್ವನಿ-ಓವರ್

ಮೇಲಿನ ಅನುವಾದವನ್ನು ಓದಿ

ಅನುವಾದ, ಸಮಯ

ನೈಸರ್ಗಿಕ ಹರಿವು, ಟೋನ್

ಆಡಿಯೋ ವಿವರಣೆ

ಧ್ವನಿಯೊಂದಿಗೆ ಚಿತ್ರವನ್ನು ವಿವರಿಸುತ್ತದೆ

ಕರಡು ಪಠ್ಯ

ದೃಶ್ಯ ವ್ಯಾಖ್ಯಾನ (ಮಾನವ)

ಸಾಮಾನ್ಯ ತಪ್ಪುಗಳು

  • ASR ಪ್ರತಿಲೇಖನವನ್ನು ಪರಿಶೀಲಿಸದೆಯೇ ಅನುವಾದಿಸಲಾಗುತ್ತಿದೆ. ಸರಿಯಾದ ಹೆಸರು/ಸಂಖ್ಯೆಯ ದೋಷಗಳನ್ನು ಉಪಶೀರ್ಷಿಕೆಗೆ ಒಯ್ಯಲಾಗುತ್ತದೆ.
  • ಪದದಿಂದ ಪದವನ್ನು ಅನುವಾದಿಸುವುದು ಮತ್ತು CPS ಅನ್ನು ಸುತ್ತುವುದು. ಪ್ರೇಕ್ಷಕರು ಓದಲಾರರು; ಫಿಟ್ ಆಗಬೇಕು.
  • ದೃಶ್ಯ ಸಂದರ್ಭವನ್ನು ನಿರ್ಲಕ್ಷಿಸುವುದು. ಪರದೆಯ ಪಠ್ಯ ಮತ್ತು ಮೊನಚಾದ ವಸ್ತುಗಳು ಅನುವಾದವಾಗದೆ ಉಳಿದಿವೆ.
  • ರೇಖೆಯನ್ನು ವಿಭಜಿಸುವುದು ಅರ್ಥಹೀನವಾಗಿಸುವುದು. ಇದು ಓದುವಿಕೆಯನ್ನು ಹಾಳು ಮಾಡುತ್ತದೆ.
  • ಟೋನ್/ರಿಜಿಸ್ಟರ್ ಅನ್ನು ಚಪ್ಪಟೆಗೊಳಿಸುವುದು. ಪಾತ್ರಗಳ ಉಪಭಾಷೆಗಳು ಮತ್ತು ಗ್ರಾಮ್ಯಗಳು ಕಣ್ಮರೆಯಾಗುತ್ತವೆ.

ಡಬ್ಬಿಂಗ್ ಮತ್ತು ಲಿಪ್ ಸಿಂಕ್

ಉಪಶೀರ್ಷಿಕೆಯ ನಿರ್ಬಂಧವು ಓದುವ ವೇಗವಾಗಿದ್ದರೆ, ಡಬ್ಬಿಂಗ್‌ನ ನಿರ್ಬಂಧವೆಂದರೆ ಸಮಯ ಮತ್ತು ತುಟಿಗಳು. ಧ್ವನಿ-ಓವರ್ ಭಾಷಾಂತರದಲ್ಲಿ ಮೂರು ವಿಭಿನ್ನ ರೀತಿಯ ಸಿಂಕ್‌ಗಳಿವೆ: ಲಿಪ್-ಸಿಂಕ್ - ಅಲ್ಲಿ ಅನುವಾದವು ಪಾತ್ರದ ಬಾಯಿಯ ಚಲನೆಗೆ ಹೊಂದಿಕೆಯಾಗುತ್ತದೆ, ವಿಶೇಷವಾಗಿ ಕ್ಲೋಸ್-ಅಪ್‌ಗಳಲ್ಲಿ ತೆರೆದ ಸ್ವರಗಳು; ಐಸೊಕ್ರೊನಿ - ಅನುವಾದ ರೇಖೆಯು ಮೂಲ ಸಾಲಿನಂತೆಯೇ ಅದೇ ಉದ್ದವಾಗಿದೆ, ತುಂಬಾ ಚಿಕ್ಕದಾಗಿರುವುದಿಲ್ಲ ಅಥವಾ ತುಂಬಾ ಉದ್ದವಾಗಿರುವುದಿಲ್ಲ; ಗೆಸ್ಚರ್ ಸಿಂಕ್ರೊನಿ - ಪಾತ್ರದ ಕೈ ಮತ್ತು ತೋಳಿನ ಚಲನೆಗಳೊಂದಿಗೆ ಏನು ಹೇಳಲಾಗಿದೆ ಎಂಬುದನ್ನು ಹೊಂದಿಸುವುದು. ಅದಕ್ಕಾಗಿಯೇ ಡಬ್ಬಿಂಗ್ ಭಾಷಾಂತರಕಾರರು ಸಾಮಾನ್ಯವಾಗಿ "ಆಕರ್ಷಕ" ರೇಖೆಯನ್ನು ಬರೆಯುತ್ತಾರೆ ಅದು ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುತ್ತದೆ ಆದರೆ ಸಂಪೂರ್ಣವಾಗಿ ವಿಭಿನ್ನ ಪದಗಳೊಂದಿಗೆ; ಪದ ನಿಷ್ಠೆ ಇಲ್ಲಿ ಉಪಶೀರ್ಷಿಕೆಗಿಂತ ಕಡಿಮೆಯಾಗಿದೆ.

AI ಕಚ್ಚಾ ಅನುವಾದದ ಕರಡು ಮತ್ತು ಡಬ್ಬಿಂಗ್‌ಗಾಗಿ ಸಮಯ ಎಚ್ಚರಿಕೆಯನ್ನು ಒದಗಿಸುತ್ತದೆ ("ಈ ಸಾಲು ಮೂಲಕ್ಕಿಂತ 40% ಉದ್ದವಾಗಿದೆ, ಅದನ್ನು ಕಡಿಮೆ ಮಾಡಿ"). ಹೊಸ ತಂತ್ರಜ್ಞಾನಗಳು ಧ್ವನಿಯನ್ನು ಕ್ಲೋನ್ ಮಾಡಬಹುದು ಮತ್ತು ಸ್ವಯಂಚಾಲಿತ ಡಬ್ಬಿಂಗ್ ಅನ್ನು ಉತ್ಪಾದಿಸಬಹುದು; ಆದರೆ ನಟನೆ, ಭಾವೋದ್ರೇಕ, ಪಾತ್ರದ ಉಸಿರಾಟ ಮತ್ತು ತುಟಿ ಸಿಂಕ್ ಮಾಡುವುದು ಇನ್ನೂ ಮಾನವ ಭಾಷಾಂತರಕಾರ ಮತ್ತು ಧ್ವನಿ ನಟನ ಕೆಲಸವಾಗಿದೆ. ಸ್ವಯಂಚಾಲಿತ ಡಬ್ಬಿಂಗ್ ಒಂದು ರೂಪರೇಖೆಯನ್ನು ಒದಗಿಸುತ್ತದೆ; ಕಲಾತ್ಮಕ ಮತ್ತು ಸಿಂಕ್ರೊನಸ್ ನಿರ್ಧಾರವು ಮಾನವನದು. ಹೆಚ್ಚುವರಿಯಾಗಿ, ಧ್ವನಿಯನ್ನು ಕ್ಲೋನ್ ಮಾಡಿದ ವ್ಯಕ್ತಿಯ ಸಮ್ಮತಿಯು ಪ್ರಮುಖ ನೈತಿಕ ಮತ್ತು ಕಾನೂನು ಸಮಸ್ಯೆಯಾಗಿದೆ.

ಸಾರಾಂಶದಲ್ಲಿ

ಆಡಿಯೋವಿಶುವಲ್ ಅನುವಾದವು ವೀಕ್ಷಕರ ಕಣ್ಣು ಮತ್ತು ಕಿವಿಯ ಕಟ್ಟುಪಾಡುಗಳೊಳಗೆ ಪಠ್ಯವನ್ನು ಅಳವಡಿಸುವ ಕಲೆಯಾಗಿದೆ: ಉಪಶೀರ್ಷಿಕೆಯಲ್ಲಿ ಸಾಲು/ಪಾತ್ರ/CPS ಗಡಿಗಳು, ಡಬ್ಬಿಂಗ್‌ನಲ್ಲಿ ತುಟಿ ಸಿಂಕ್ ಮಾಡುವುದು, ದೃಶ್ಯ ಸಂದರ್ಭವು ಎಲ್ಲವನ್ನೂ ನಿರ್ಧರಿಸುವ ಅಂಶವಾಗಿದೆ. AI ಪ್ರತಿಲೇಖನ, ಟೈಮ್‌ಕೋಡಿಂಗ್, ಅನುವಾದ ಡ್ರಾಫ್ಟಿಂಗ್ ಮತ್ತು ASR ನೊಂದಿಗೆ CPS ಪರಿಶೀಲನೆಯನ್ನು ವೇಗಗೊಳಿಸುತ್ತದೆ; ಆದರೆ ಎಎಸ್ಆರ್ ಅನ್ನು ಸರಿಯಾದ ಹೆಸರುಗಳು ಮತ್ತು ಶಬ್ದದಲ್ಲಿ ತಪ್ಪಾಗಿ ಗ್ರಹಿಸಲಾಗಿದೆ, ಅದು ಚಿತ್ರವನ್ನು ನೋಡುವುದಿಲ್ಲ ಮತ್ತು ಫಿಟ್-ಟೋನ್ ನಿರ್ಧಾರಗಳನ್ನು ಮನುಷ್ಯ ತೆಗೆದುಕೊಳ್ಳುತ್ತಾನೆ. ಮಾಸ್ಟರ್ ಉಪಶೀರ್ಷಿಕೆದಾರರು ಪದಕ್ಕೆ ಪದವನ್ನು ಅನುವಾದಿಸುವುದಿಲ್ಲ; ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸುವ ಚಿಕ್ಕದಾದ, ಅತ್ಯಂತ ನೈಸರ್ಗಿಕ ಅಭಿವ್ಯಕ್ತಿಯನ್ನು ಕಂಡುಕೊಳ್ಳುತ್ತದೆ.

ಅಪ್ಲಿಕೇಶನ್ ಕಾರ್ಯ

ಚಿಕ್ಕದಾದ (2-3 ನಿಮಿಷ) ವೀಡಿಯೊ ಕ್ಲಿಪ್ ಆಯ್ಕೆಮಾಡಿ. ASR ಟೂಲ್‌ನೊಂದಿಗೆ ಲಿಪ್ಯಂತರ ಮಾಡಿ ಮತ್ತು "ಪ್ರತಿಲೇಖನ ಪರಿಶೀಲನೆ" ಟೆಂಪ್ಲೇಟ್‌ನೊಂದಿಗೆ ಆಡಿಯೊದೊಂದಿಗೆ ಅಪಾಯಕಾರಿ ಪ್ರದೇಶಗಳನ್ನು ಹೋಲಿಸಿ ಮತ್ತು ಸರಿಪಡಿಸಿ. ನಂತರ "ಉಪಶೀರ್ಷಿಕೆ ಅನುವಾದ" ಟೆಂಪ್ಲೇಟ್‌ನೊಂದಿಗೆ CPS ~17 ನಿರ್ಬಂಧದೊಂದಿಗೆ ಅನುವಾದಿಸಿ ಮತ್ತು "CPS ನಿಯಂತ್ರಣ" ದೊಂದಿಗೆ ಮಿತಿಯನ್ನು ಮೀರಿದ ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು ಕಡಿಮೆ ಮಾಡಿ. ಪರದೆಯ ಪಠ್ಯ ಅಥವಾ ಚಿಹ್ನೆ ಇದ್ದರೆ, "ದೃಶ್ಯ ಸಂದರ್ಭ ಪರಿಶೀಲನೆ" ಅನ್ನು ಅನ್ವಯಿಸಿ.

ಪರಿಶೀಲನಾಪಟ್ಟಿ

  • [ ] ನಾನು ನಿರ್ದಿಷ್ಟ ಹೆಸರು/ಸಂಖ್ಯೆಗಾಗಿ ಧ್ವನಿಯ ಮೂಲಕ ASR ಡೀಕ್ರಿಪ್ಶನ್ ಅನ್ನು ಪರಿಶೀಲಿಸಿದ್ದೇನೆ.
  • [ ] ನಾನು ಉಪಶೀರ್ಷಿಕೆಗಳನ್ನು ಸಾಲು/ಅಕ್ಷರ/CPS ನಿಯಮಗಳಿಗೆ ಹೊಂದುವಂತೆ ಮಾಡಿದ್ದೇನೆ.
  • [ ] ನಾನು ಅದನ್ನು ಸಂಕ್ಷಿಪ್ತಗೊಳಿಸಿದೆ ಮತ್ತು ಸ್ವಾಭಾವಿಕಗೊಳಿಸಿದೆ, ಪದಕ್ಕೆ ಪದವಲ್ಲ, ಅರ್ಥವನ್ನು ಸಂರಕ್ಷಿಸಿದೆ.
  • [ ] ನಾನು ದೃಶ್ಯ ಸಂದರ್ಭವನ್ನು (ಪರದೆಯ ಪಠ್ಯ, ಸೈನ್) ಗಣನೆಗೆ ತೆಗೆದುಕೊಂಡಿದ್ದೇನೆ.
  • [ ] ಸ್ವರ ಮತ್ತು ಪಾತ್ರದಲ್ಲಿನ ವ್ಯತ್ಯಾಸಗಳನ್ನು ಸಂರಕ್ಷಿಸಲು ನಾನು ಅದನ್ನು ಅನುವಾದಿಸಿದೆ.