ਲਾਭ:
- ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਸਪੀਕਰ ਵਿਭਾਜਨ ਦੀਆਂ ਧਾਰਨਾਵਾਂ ਨੂੰ ਸਮਝਣ ਦੀ ਸਮਰੱਥਾ ਅਤੇ ਕੱਚੀ ਰਿਕਾਰਡਿੰਗ ਨੂੰ ਸਮਾਂ-ਕੋਡ ਕੀਤੇ ਟੈਕਸਟ ਵਿੱਚ ਬਦਲਣ ਦੀ ਸਮਰੱਥਾ
- ਉਪਸਿਰਲੇਖ ਫਾਰਮੈਟਾਂ (SRT/VTT), ਪੜ੍ਹਨ ਦੀ ਗਤੀ ਅਤੇ ਲਾਈਨ ਨਿਯਮਾਂ, ਅਤੇ ਬਹੁ-ਭਾਸ਼ਾਈ ਉਪਸਿਰਲੇਖ ਡਰਾਫਟ ਤਿਆਰ ਕਰਨ ਅਤੇ ਸੰਪਾਦਿਤ ਕਰਨ ਦੀ ਸਮਰੱਥਾ
- ਇਹ ਸਮਝਣਾ ਕਿ ਪ੍ਰਕਾਸ਼ਨ ਤੋਂ ਪਹਿਲਾਂ ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਵਿੱਚ ਸ਼ਬਦਾਵਲੀ, ਸਹੀ ਨਾਮ, ਵਿਰਾਮ ਚਿੰਨ੍ਹ ਅਤੇ ਅਨੁਵਾਦ ਦੀਆਂ ਗਲਤੀਆਂ ਦੀ ਪੁਸ਼ਟੀ ਕਰਨਾ ਸੰਪਾਦਕ ਦੀ ਜ਼ਿੰਮੇਵਾਰੀ ਹੈ।
ਪੋਸਟ-ਪ੍ਰੋਡਕਸ਼ਨ ਦਾ ਸਭ ਤੋਂ ਔਖਾ, ਸਮਾਂ ਬਰਬਾਦ ਕਰਨ ਵਾਲਾ ਕੰਮ ਰਵਾਇਤੀ ਤੌਰ 'ਤੇ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਸੀ: ਇੱਕ ਸੰਪਾਦਕ ਹਰ ਵਾਕ ਨੂੰ ਹੱਥ ਨਾਲ ਟਾਈਪ ਕਰਦੇ ਹੋਏ, ਇੰਟਰਵਿਊ ਦੇ ਘੰਟਿਆਂ ਦੀ ਫੁਟੇਜ ਨੂੰ ਬੇਅੰਤ ਸੁਣਦਾ ਸੀ। ਇੱਕ ਘੰਟੇ ਦੀ ਰਿਕਾਰਡਿੰਗ ਨੂੰ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨ ਵਿੱਚ ਆਸਾਨੀ ਨਾਲ ਚਾਰ ਤੋਂ ਪੰਜ ਘੰਟੇ ਲੱਗ ਜਾਂਦੇ ਹਨ। ਨਕਲੀ ਬੁੱਧੀ ਨੇ ਇਸ ਕਾਰੋਬਾਰ ਨੂੰ ਮੂਲ ਰੂਪ ਵਿੱਚ ਬਦਲ ਦਿੱਤਾ ਹੈ: ਅੱਜ ਇੱਕ ਘੰਟੇ ਦੀ ਰਿਕਾਰਡਿੰਗ ਨੂੰ ਮਿੰਟਾਂ ਵਿੱਚ ਟਾਈਮ-ਕੋਡ ਕੀਤੇ ਟੈਕਸਟ ਵਿੱਚ ਬਦਲਿਆ ਜਾ ਸਕਦਾ ਹੈ। ਇਹ ਦੋਵੇਂ ਸੰਪਾਦਨ ਪਾਈਪਲਾਈਨ ਨੂੰ ਤੇਜ਼ ਕਰਦੇ ਹਨ ਅਤੇ ਪਹੁੰਚਯੋਗਤਾ ਨੂੰ ਸਮਰੱਥ ਬਣਾਉਂਦੇ ਹਨ (ਸੁਣਨ ਤੋਂ ਕਮਜ਼ੋਰ ਦਰਸ਼ਕਾਂ ਅਤੇ ਚੁੱਪ ਦੇਖਣ ਲਈ ਉਪਸਿਰਲੇਖ)। ਪਰ ਆਟੋਮੈਟਿਕ ਆਉਟਪੁੱਟ ਕਦੇ ਵੀ ਆਪਣੇ ਕੱਚੇ ਰੂਪ ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਨ ਲਈ ਢੁਕਵਾਂ ਨਹੀਂ ਹੈ; ਇਸ ਯੂਨਿਟ ਵਿੱਚ ਅਸੀਂ ਸ਼ਕਤੀ ਅਤੇ ਨੁਕਸਾਨ ਦੋਵੇਂ ਦੇਖਾਂਗੇ।
ਆਓ ਸ਼ਰਤਾਂ ਨਾਲ ਸ਼ੁਰੂ ਕਰੀਏ। ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਭਾਸ਼ਣ ਨੂੰ ਲਿਖਤ ਵਿੱਚ ਪਾਉਣਾ ਹੈ। ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਰਿਕੋਗਨੀਸ਼ਨ (ਏ.ਐੱਸ.ਆਰ.) ਉਹ ਤਕਨੀਕ ਹੈ ਜੋ ਆਵਾਜ਼ ਨੂੰ ਟੈਕਸਟ ਵਿੱਚ ਅਨੁਵਾਦ ਕਰਦੀ ਹੈ। ਟਾਈਮਕੋਡ ਉਹ ਚਿੰਨ੍ਹ ਹੈ ਜੋ ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਵੀਡੀਓ ਵਿੱਚ ਟੈਕਸਟ ਕਿਸ ਸਕਿੰਟ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ। ਸਪੀਕਰ ਡਾਇਰਾਈਜ਼ੇਸ਼ਨ "ਕੌਣ ਬੋਲਿਆ" ਨੂੰ ਵੱਖਰਾ ਕਰ ਰਿਹਾ ਹੈ ਅਤੇ ਟੈਕਸਟ ਨੂੰ ਸਪੀਕਰਾਂ ਵਿੱਚ ਵੰਡ ਰਿਹਾ ਹੈ। ਉਪਸਿਰਲੇਖ (ਉਪਸਿਰਲੇਖ/ਸਿਰਲੇਖ) ਸਮਾਂ-ਕੋਡ ਕੀਤਾ ਟੈਕਸਟ ਹੈ ਜੋ ਸਕ੍ਰੀਨ 'ਤੇ ਦਿਖਾਈ ਦਿੰਦਾ ਹੈ। SRT ਅਤੇ VTT ਸਭ ਤੋਂ ਆਮ ਉਪਸਿਰਲੇਖ ਫਾਈਲ ਫਾਰਮੈਟ ਹਨ; ਉਹਨਾਂ ਵਿੱਚ ਹਰੇਕ ਲਾਈਨ ਦਾ ਕ੍ਰਮ, ਸ਼ੁਰੂਆਤੀ-ਅੰਤ ਦਾ ਸਮਾਂ ਅਤੇ ਟੈਕਸਟ ਸ਼ਾਮਲ ਹੁੰਦਾ ਹੈ। ਪੜ੍ਹਨ ਦੀ ਗਤੀ (CPS: ਅੱਖਰ ਪ੍ਰਤੀ ਸਕਿੰਟ) ਇਹ ਨਿਰਧਾਰਤ ਕਰਦੀ ਹੈ ਕਿ ਦਰਸ਼ਕ ਲਈ ਉਪਸਿਰਲੇਖ ਨੂੰ ਆਰਾਮ ਨਾਲ ਪੜ੍ਹਣ ਲਈ ਲਾਈਨ ਨੂੰ ਸਕ੍ਰੀਨ 'ਤੇ ਕਿੰਨੀ ਦੇਰ ਤੱਕ ਰਹਿਣਾ ਚਾਹੀਦਾ ਹੈ।
ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਦੀ ਸ਼ਕਤੀ ਅਤੇ ਸੀਮਾ
AI ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਬਹੁਤ ਉੱਚ ਸ਼ੁੱਧਤਾ ਦੇ ਨਾਲ ਸਹੀ ਤੁਰਕੀ ਵਿੱਚ ਰਿਕਾਰਡ ਕੀਤੀ ਇੱਕ ਸਪਸ਼ਟ, ਸਿੰਗਲ-ਸਪੀਕਰ ਅਵਾਜ਼ ਨੂੰ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਕਰਦਾ ਹੈ। ਪਰ ਇਹ ਹੇਠ ਲਿਖੀਆਂ ਸਥਿਤੀਆਂ ਵਿੱਚ ਗਲਤੀਆਂ ਕਰਦਾ ਹੈ, ਅਤੇ ਇਹਨਾਂ ਨੂੰ ਜਾਣਨ ਨਾਲ ਤੁਸੀਂ ਤਸਦੀਕ ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾ ਸਕਦੇ ਹੋ: ਸਹੀ ਨਾਮ (ਲੋਕਾਂ ਦੇ ਨਾਮ, ਬ੍ਰਾਂਡ, ਸਥਾਨ ਅਕਸਰ ਗਲਤ ਸ਼ਬਦ-ਜੋੜ ਹੁੰਦੇ ਹਨ), ਤਕਨੀਕੀ ਸ਼ਬਦ ਅਤੇ ਸੰਖੇਪ, ਸਮਾਨ ਆਵਾਜ਼ ਵਾਲੇ ਸ਼ਬਦ (“ਕਾਰ/ਕਾਰ”, “ਅਜੇ ਵੀ/ਅਜੇ ਵੀ”), ਓਵਰਲੈਪਿੰਗ ਬੋਲੀ (ਇੱਕੋ ਸਮੇਂ ਵਿੱਚ ਦੋ ਲੋਕ), ਬੈਕਗ੍ਰਾਉਂਡ ਸ਼ੋਰ ਅਤੇ ਸੰਗੀਤ, ਉਪਭਾਸ਼ਾ/ਐਕਸੀਐਂਟ ਵਾਕ (ਅੰਤ-ਅੰਕਣ) ਵਿੱਚ ਅੰਤਰ। ਇਸ ਤੋਂ ਇਲਾਵਾ, ਮਾਡਲ ਕਿਸੇ ਅਜਿਹੇ ਸ਼ਬਦ ਨੂੰ "ਸੁਣ ਸਕਦਾ ਹੈ" ਅਤੇ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਕਰ ਸਕਦਾ ਹੈ ਜੋ ਕਦੇ ਵੀ ਰੌਲੇ-ਰੱਪੇ ਵਾਲੇ ਪਲਾਂ ਵਿੱਚ ਨਹੀਂ ਬੋਲਿਆ ਗਿਆ - ਇਹ ਪ੍ਰਤੀਲਿਪੀ ਦਾ ਭੁਲੇਖਾ ਹੈ।
ਹੇਠਾਂ ਦਿੱਤੀ ਸਾਰਣੀ ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਲਈ ਮਜ਼ਬੂਤ ਅਤੇ ਕਮਜ਼ੋਰ ਹਾਲਤਾਂ ਦਾ ਸਾਰ ਦਿੰਦੀ ਹੈ:
ਹਾਲਤ
ਸ਼ੁੱਧਤਾ
ਸੰਪਾਦਕ ਦਾ ਫੋਕਸ
ਸਿੰਗਲ ਸਪੀਕਰ, ਸਾਫ ਆਵਾਜ਼, ਸ਼ਾਂਤ ਵਾਤਾਵਰਨ
ਬਹੁਤ ਉੱਚਾ
ਉਚਿਤ ਨਾਮ, ਵਿਰਾਮ ਚਿੰਨ੍ਹ
ਮਲਟੀ-ਸਪੀਕਰ ਪੈਨਲ
ਮੱਧਮ
ਸਪੀਕਰ ਵੱਖਰਾ, ਓਵਰਲੈਪਿੰਗ ਭਾਸ਼ਣ
ਰੌਲਾ-ਰੱਪਾ/ਆਊਟਡੋਰ ਰਿਕਾਰਡਿੰਗ
ਘੱਟ-ਮੱਧਮ
ਰਚਿਆ ਹੋਇਆ ਸ਼ਬਦ, ਛਾਲ
ਤਕਨੀਕੀ/ਜਾਰਗਨ ਸਮੱਗਰੀ
ਮੱਧਮ
ਮਿਆਦ ਅਤੇ ਸੰਖੇਪ ਲਿਖਤ
ਲਹਿਜ਼ੇ ਵਾਲੀ ਬੋਲੀ
ਵੇਰੀਏਬਲ
ਸ਼ਬਦ ਦੀਆਂ ਗਲਤੀਆਂ, ਅਰਥ
ਉਪਸਿਰਲੇਖ ਫਾਰਮੈਟ ਅਤੇ ਪੜ੍ਹਨਯੋਗਤਾ ਨਿਯਮ
ਇੱਕ ਚੰਗਾ ਉਪਸਿਰਲੇਖ ਸਿਰਫ਼ "ਸਹੀ ਟੈਕਸਟ" ਨਹੀਂ ਹੈ; ਪੜ੍ਹਨਯੋਗ ਹੋਣਾ ਚਾਹੀਦਾ ਹੈ। ਅੰਤਰਰਾਸ਼ਟਰੀ ਅਭਿਆਸ ਵਿੱਚ ਅੰਗੂਠੇ ਦੇ ਕੁਝ ਨਿਯਮ ਹਨ: ਉਪਸਿਰਲੇਖਾਂ ਦੀ ਇੱਕ ਲਾਈਨ ਆਮ ਤੌਰ 'ਤੇ ਦੋ ਲਾਈਨਾਂ ਤੋਂ ਵੱਧ ਨਹੀਂ ਹੋਣੀ ਚਾਹੀਦੀ; ਹਰੇਕ ਲਾਈਨ ਨੂੰ ਇੱਕ ਵਾਜਬ ਲੰਬਾਈ (ਲਗਭਗ 37-42 ਅੱਖਰ) ਤੱਕ ਰੱਖਿਆ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ; ਉਪਸਿਰਲੇਖ ਨੂੰ ਪੜ੍ਹਨ ਲਈ ਕਾਫ਼ੀ ਸਮਾਂ ਸਕ੍ਰੀਨ 'ਤੇ ਰਹਿਣਾ ਚਾਹੀਦਾ ਹੈ (ਆਮ ਤੌਰ 'ਤੇ 1-6 ਸਕਿੰਟ); ਪੜ੍ਹਨ ਦੀ ਗਤੀ ਬਹੁਤ ਜ਼ਿਆਦਾ ਨਹੀਂ ਹੋਣੀ ਚਾਹੀਦੀ (ਜ਼ਿਆਦਾਤਰ ਗਾਈਡ ~15-17 ਅੱਖਰ/ਸੈਕਿੰਡ ਨੂੰ ਸੀਮਾ ਮੰਨਦੇ ਹਨ)। AI ਟੂਲ ਆਪਣੇ ਆਪ ਹੀ ਉਪਸਿਰਲੇਖ ਨੂੰ ਵੰਡਦੇ ਹਨ, ਪਰ ਇਹ ਸਪਲਿਟ ਕਈ ਵਾਰ ਵਾਕ ਨੂੰ ਮਾੜੀਆਂ ਥਾਵਾਂ 'ਤੇ ਕੱਟ ਦਿੰਦੇ ਹਨ ("ਅਤੇ" ਨਾਲ ਖਤਮ ਹੋਣ ਵਾਲੀ ਲਾਈਨ ਜੋ ਅਰਥ ਨੂੰ ਵੰਡਦੀ ਹੈ)। ਸੰਪਾਦਕ ਦਾ ਕੰਮ ਪਾਠ ਨੂੰ ਸਟੀਕ ਅਤੇ ਤਰਕਸ਼ੀਲ ਬਣਾਉਣਾ ਹੈ।
ਤੁਹਾਡੀ ਭੂਮਿਕਾ: ਉਪਸਿਰਲੇਖ ਸੰਪਾਦਕ ਸਹਾਇਕ। ਹੇਠਾਂ ਇੱਕ ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਹੈ। ਕਾਰਜ: 1) SRT ਤਰਕ ਦੇ ਅਨੁਸਾਰ ਟੈਕਸਟ ਨੂੰ ਉਪਸਿਰਲੇਖ ਬਲਾਕਾਂ ਵਿੱਚ ਵੰਡੋ। 2) ਹਰੇਕ ਬਲਾਕ ਵੱਧ ਤੋਂ ਵੱਧ 2 ਲਾਈਨਾਂ ਦਾ ਹੋਣਾ ਚਾਹੀਦਾ ਹੈ, ਹਰੇਕ ਲਾਈਨ ~ 40 ਅੱਖਰਾਂ ਤੋਂ ਵੱਧ ਨਹੀਂ ਹੋਣੀ ਚਾਹੀਦੀ। 3) ਵਾਕ ਨੂੰ ਅਰਥਪੂਰਨ ਸਥਾਨਾਂ 'ਤੇ ਵੰਡੋ; "ਅਤੇ", "ਪਰ", "ਉਹ" ਨਾਲ ਖਤਮ ਹੋਣ ਵਾਲੀ ਲਾਈਨ। 4) ਸਹੀ ਨਾਂਵਾਂ ਅਤੇ ਸ਼ਬਦਾਂ ਨੂੰ [ਚੈੱਕ] ਟੈਗ ਨਾਲ ਚਿੰਨ੍ਹਿਤ ਕਰੋ ਤਾਂ ਜੋ ਮੈਂ ਉਹਨਾਂ ਨੂੰ ਹੱਥੀਂ ਤਸਦੀਕ ਕਰ ਸਕਾਂ। 5) ਟੈਕਸਟ ਨੂੰ ਨਾ ਬਦਲੋ, ਸਿਰਫ਼ ਵੰਡੋ ਅਤੇ ਨਿਸ਼ਾਨ ਲਗਾਓ।
ਇਸ ਪ੍ਰੋਂਪਟ ਵਿੱਚ "[CONTROL] ਟੈਗ" ਵਿਚਾਰ ਕੀਮਤੀ ਹੈ: AI ਮਾਰਕ ਵਾਲੇ ਖੇਤਰਾਂ ਦਾ ਹੋਣਾ ਜਿੱਥੇ ਇਹ ਅਨਿਸ਼ਚਿਤ ਜਾਂ ਜੋਖਮ ਭਰਪੂਰ ਹੈ (ਸਹੀ ਨਾਮ, ਮਿਆਦ) ਸੰਪਾਦਕ ਦੀ ਅੱਖ ਨੂੰ ਸਹੀ ਸਥਾਨਾਂ ਵੱਲ ਸੇਧਿਤ ਕਰਦਾ ਹੈ ਅਤੇ ਅੰਨ੍ਹੇ ਵਿਸ਼ਵਾਸ ਨੂੰ ਰੋਕਦਾ ਹੈ।
ਬਹੁ-ਭਾਸ਼ਾਈ ਉਪਸਿਰਲੇਖ ਅਤੇ ਅਨੁਵਾਦ
ਇੱਕ ਵੀਡੀਓ ਨੂੰ ਕਈ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਖੋਲ੍ਹਣਾ ਦਰਸ਼ਕਾਂ ਨੂੰ ਵਧਾਉਂਦਾ ਹੈ। AI ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਲੈ ਸਕਦਾ ਹੈ, ਇਸਨੂੰ ਟੀਚੇ ਦੀ ਭਾਸ਼ਾ ਵਿੱਚ ਅਨੁਵਾਦ ਕਰ ਸਕਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਉਪਸਿਰਲੇਖ ਫਾਈਲ ਤਿਆਰ ਕਰ ਸਕਦਾ ਹੈ। ਇਹ ਇੱਕ ਸ਼ਕਤੀਸ਼ਾਲੀ ਸਮਰੱਥਾ ਹੈ, ਪਰ ਇਹ ਸਭ ਤੋਂ ਕਮਜ਼ੋਰ ਹੈ: ਮਸ਼ੀਨ ਅਨੁਵਾਦ ਮੁਹਾਵਰੇ, ਸੱਭਿਆਚਾਰਕ ਸੰਦਰਭ, ਹਾਸੇ ਅਤੇ ਸ਼ਬਦ, ਸ਼ਬਦਾਂ ਅਤੇ ਸੰਦਰਭ ਨੂੰ ਗਲਤ ਢੰਗ ਨਾਲ ਪੇਸ਼ ਕਰ ਸਕਦਾ ਹੈ। "ਇਹ ਬਿੱਲੀਆਂ ਅਤੇ ਕੁੱਤਿਆਂ ਦੀ ਬਾਰਿਸ਼ ਹੋ ਰਹੀ ਹੈ" ਸ਼ਬਦ ਦਾ ਅਨੁਵਾਦ ਕਰਨਾ ਇੱਕ ਤਬਾਹੀ ਹੈ। ਉਪਸਿਰਲੇਖ ਅਨੁਵਾਦ ਵਿੱਚ ਇੱਕ ਸਪੇਸ ਸੀਮਾ ਵੀ ਹੈ: ਨਿਸ਼ਾਨਾ ਭਾਸ਼ਾ ਵਿੱਚ ਵਾਕ ਲੰਮਾ ਹੋ ਸਕਦਾ ਹੈ ਅਤੇ ਪੜ੍ਹਨ ਦੀ ਗਤੀ ਤੋਂ ਵੱਧ ਹੋ ਸਕਦਾ ਹੈ। ਇਸ ਲਈ ਬਹੁ-ਭਾਸ਼ਾਈ ਉਪਸਿਰਲੇਖ ਲਈ ਇਹ ਜ਼ਰੂਰੀ ਹੈ ਕਿ ਉਹ ਵਿਅਕਤੀ ਜੋ ਟੀਚਾ ਭਾਸ਼ਾ ਜਾਣਦਾ ਹੋਵੇ ਅਨੁਵਾਦ ਦੀ ਪੁਸ਼ਟੀ ਕਰੇ — ਖਾਸ ਕਰਕੇ ਸੰਵੇਦਨਸ਼ੀਲ ਸਮੱਗਰੀ ਜਿਵੇਂ ਕਿ ਬ੍ਰਾਂਡਿੰਗ, ਕਾਨੂੰਨੀ ਜਾਂ ਸਿਹਤ ਲਈ, ਗਲਤ ਅਨੁਵਾਦ ਦੇ ਗੰਭੀਰ ਨਤੀਜੇ ਹੋ ਸਕਦੇ ਹਨ।
ਹੇਠਾਂ ਦਿੱਤੇ ਤੁਰਕੀ ਉਪਸਿਰਲੇਖ ਬਲਾਕਾਂ ਦਾ ਅੰਗਰੇਜ਼ੀ ਵਿੱਚ ਅਨੁਵਾਦ ਕਰੋ। ਨਿਯਮ:- ਮੁਹਾਵਰੇ ਅਤੇ ਮਜ਼ਾਕ ਨੂੰ ਜ਼ੁਬਾਨੀ ਨਹੀਂ, ਸਗੋਂ ਉਹਨਾਂ ਦੇ ਅਰਥਾਂ ਨੂੰ ਸੁਰੱਖਿਅਤ ਰੱਖਣਾ ਹੈ। - ਬ੍ਰਾਂਡ ਨਾਮ ਅਤੇ ਉਤਪਾਦ ਦਾ ਨਾਮ ਜਿਵੇਂ ਕਿ ਉਹ ਹਨ ਛੱਡੋ, ਅਨੁਵਾਦ ਨਾ ਕਰੋ। - ਹਰੇਕ ਬਲਾਕ ਨੂੰ ਆਪਣੀ ਪੜ੍ਹਨ ਦੀ ਗਤੀ ਨੂੰ ਕਾਇਮ ਰੱਖਣ ਦਿਓ; ਜੇ ਲੋੜ ਹੋਵੇ ਤਾਂ ਛੋਟਾ ਕਰੋ, ਪਰ ਅਰਥ ਵਿਗਾੜੋ ਨਾ। - [TRANSLATOR'S NOTE] ਦੇ ਨਾਲ ਸੱਭਿਆਚਾਰਕ ਸੰਦਰਭ ਜਾਂ ਸ਼ਬਦ ਦਿਓ ਜਿਸ ਬਾਰੇ ਤੁਸੀਂ ਯਕੀਨੀ ਨਹੀਂ ਹੋ।
ਤਿੰਨ ਛੋਟੇ ਕੇਸ
ਕੇਸ 1 — ਐਕਸਲੇਰੇਟਿੰਗ ਲਾਈਨ। ਇੱਕ ਦਸਤਾਵੇਜ਼ੀ ਟੀਮ ਨੇ ਇੰਟਰਵਿਊਆਂ ਦੇ 12-ਘੰਟੇ ਦੇ ਪੁਰਾਲੇਖ ਨੂੰ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨ ਵਿੱਚ ਤਿੰਨ ਹਫ਼ਤੇ ਬਿਤਾਏ। ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਦੇ ਨਾਲ, ਕੱਚਾ ਟੈਕਸਟ ਇੱਕ ਦਿਨ ਵਿੱਚ ਆਉਟਪੁੱਟ ਸੀ; ਟੈਕਸਟ (ਸ਼ਬਦ ਦੁਆਰਾ ਸ਼ਬਦ) ਦੁਆਰਾ ਖੋਜ ਕਰਕੇ, ਟੀਮ ਨੇ ਸਕਿੰਟਾਂ ਵਿੱਚ ਉਹ ਪਲ ਲੱਭ ਲਏ ਜੋ ਉਹ ਚਾਹੁੰਦੇ ਸਨ। ਫਿਰ ਉਹਨਾਂ ਨੇ ਸਾਵਧਾਨੀ ਨਾਲ ਸਿਰਫ 40-ਮਿੰਟ ਦੇ ਐਪੀਸੋਡ ਨੂੰ ਸੰਪਾਦਿਤ ਕੀਤਾ ਅਤੇ ਉਪਸਿਰਲੇਖ ਕੀਤਾ ਜੋ ਉਹ ਵਰਤਣਗੇ। ਤਿੰਨ ਹਫ਼ਤੇ ਚਾਰ ਦਿਨਾਂ ਵਿੱਚ ਬਦਲ ਗਏ; ਵਰਤੇ ਗਏ ਭਾਗ 'ਤੇ ਕੇਂਦ੍ਰਿਤ ਪੁਸ਼ਟੀਕਰਨ ਯਤਨ।
ਕੇਸ 2 - ਬਣਿਆ ਹੋਇਆ ਸ਼ਬਦ। ਇੱਕ ਨਿਊਜ਼ ਚੈਨਲ ਨੇ ਬਿਨਾਂ ਜਾਂਚ ਕੀਤੇ, ਆਟੋਮੈਟਿਕ ਉਪਸਿਰਲੇਖਾਂ ਦੇ ਨਾਲ ਰੌਲੇ-ਰੱਪੇ ਵਾਲੇ ਸਟ੍ਰੀਟ ਇੰਟਰਵਿਊ ਨੂੰ ਪ੍ਰਸਾਰਿਤ ਕੀਤਾ। ਮਾਡਲ ਨੇ ਬੈਕਗ੍ਰਾਉਂਡ ਹਮ ਵਿੱਚ ਇੱਕ ਅਣ-ਬੋਲਾ ਸ਼ਬਦ "ਸੁਣਿਆ", ਅਤੇ ਸੁਰਖੀ ਨੇ ਇੰਟਰਵਿਊ ਲੈਣ ਵਾਲੇ ਨੂੰ ਇੱਕ ਅਣ-ਬੋਲਾ ਸ਼ਬਦ ਲਗਾਇਆ। ਸੋਸ਼ਲ ਮੀਡੀਆ 'ਤੇ ਪ੍ਰਤੀਕਰਮ ਹੋਇਆ ਅਤੇ ਸੁਧਾਰ ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ ਗਿਆ ਸੀ. ਪਾਠ: ਰੌਲੇ-ਰੱਪੇ ਵਾਲੀਆਂ ਰਿਕਾਰਡਿੰਗਾਂ ਵਿੱਚ, ਆਟੋਮੈਟਿਕ ਉਪਸਿਰਲੇਖਾਂ ਦੀ ਅਸਲ ਆਡੀਓ ਨਾਲ ਤੁਲਨਾ ਕੀਤੀ ਜਾਣੀ ਚਾਹੀਦੀ ਹੈ।
ਕੇਸ 3 - ਅਨੁਵਾਦ ਤਬਾਹੀ। ਇੱਕ ਬ੍ਰਾਂਡ ਨੇ ਆਪਣੇ ਪ੍ਰਚਾਰ ਵੀਡੀਓ ਦੇ ਅੰਗਰੇਜ਼ੀ ਉਪਸਿਰਲੇਖਾਂ ਨੂੰ ਮਸ਼ੀਨ ਅਨੁਵਾਦ ਦੇ ਨਾਲ ਅਤੇ ਨਿਯੰਤਰਣ ਤੋਂ ਬਿਨਾਂ ਪ੍ਰਕਾਸ਼ਿਤ ਕੀਤਾ। ਜਦੋਂ ਇੱਕ ਤੁਰਕੀ ਮੁਹਾਵਰੇ ("ਅੱਖ ਬਾਹਰ ਰੱਖੋ") ਦਾ ਅਨੁਵਾਦ ਸ਼ਬਦ ਲਈ ਕੀਤਾ ਗਿਆ ਸੀ, ਤਾਂ ਇਹ ਅੰਗਰੇਜ਼ੀ ਦਰਸ਼ਕਾਂ ਲਈ ਅਰਥਹੀਣ ਅਤੇ ਮਜ਼ਾਕੀਆ ਜਾਪਦਾ ਸੀ, ਅਤੇ ਬ੍ਰਾਂਡ ਦੀ ਗੰਭੀਰਤਾ ਨੂੰ ਨੁਕਸਾਨ ਪਹੁੰਚਿਆ ਸੀ। ਸਹੀ ਤਰੀਕਾ: ਕਿਸੇ ਅਜਿਹੇ ਵਿਅਕਤੀ ਦੁਆਰਾ ਅਨੁਵਾਦ ਦੀ ਤਸਦੀਕ ਕਰਵਾਉਣ ਲਈ ਜੋ ਟੀਚਾ ਭਾਸ਼ਾ ਜਾਣਦਾ ਹੈ।
ਕਮਜ਼ੋਰ ਪ੍ਰੋਂਪਟ / ਮਜ਼ਬੂਤ ਪ੍ਰੋਂਪਟ
ਕਮਜ਼ੋਰ ਪ੍ਰੋਂਪਟ:
ਇਸ ਵੀਡੀਓ ਦਾ ਉਪਸਿਰਲੇਖ ਅਤੇ ਅੰਗਰੇਜ਼ੀ ਵਿੱਚ ਅਨੁਵਾਦ ਕਰੋ।
ਇੱਥੇ ਕੋਈ ਫਾਰਮੈਟਿੰਗ ਨਹੀਂ ਹੈ, ਕੋਈ ਪੜ੍ਹਨਯੋਗਤਾ ਨਿਯਮ ਨਹੀਂ ਹਨ, ਕੋਈ ਪ੍ਰਮਾਣਿਕਤਾ ਚਿੰਨ੍ਹ ਨਹੀਂ ਹਨ। ਆਉਟਪੁੱਟ ਕੱਚਾ ਅਤੇ ਜੋਖਮ ਭਰਪੂਰ ਹੋਵੇਗਾ।
ਸ਼ਕਤੀਸ਼ਾਲੀ ਪ੍ਰਾਉਟ:
ਤੁਹਾਡੀ ਭੂਮਿਕਾ: ਦੋਭਾਸ਼ੀ ਉਪਸਿਰਲੇਖ ਸੰਪਾਦਕ।ਇਨਪੁਟ: ਤੁਰਕੀ ਟਾਈਮਕੋਡਡ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ। ਟਾਸਕ:1) ਤੁਰਕੀ ਉਪਸਿਰਲੇਖ ਨੂੰ 2 ਲਾਈਨਾਂ / ~40 ਅੱਖਰਾਂ / ਚੰਗੇ ਭਾਗ ਨਿਯਮਾਂ ਦੁਆਰਾ ਸੰਪਾਦਿਤ ਕਰੋ। 2) [CONTROL] ਨਾਲ ਸਹੀ ਨਾਮ ਅਤੇ ਸ਼ਬਦਾਂ ਨੂੰ ਚਿੰਨ੍ਹਿਤ ਕਰੋ। ਵਾਕਾਂਸ਼ ਨੂੰ ਸ਼ਾਬਦਿਕ ਰੂਪ ਵਿੱਚ ਟ੍ਰਾਂਸਫਰ ਕਰੋ, ਬ੍ਰਾਂਡ ਨਾਮ ਨੂੰ ਸੁਰੱਖਿਅਤ ਰੱਖੋ। 4) ਉਹਨਾਂ ਬਲਾਕਾਂ ਨੂੰ ਚਿੰਨ੍ਹਿਤ ਕਰੋ ਜੋ [ਲੰਬੇ] ਨਾਲ ਪੜ੍ਹਨ ਦੀ ਗਤੀ ਤੋਂ ਵੱਧ ਹਨ। 5) ਕੋਈ ਵੀ ਸ਼ਬਦ ਨਾ ਬਣਾਓ; ਅਨਿਸ਼ਚਿਤ ਧੁਨੀ [ਅਨਿੰਡੀਕੇਟਡ] ਲਿਖੋ।
ਆਮ ਗਲਤੀਆਂ
- ਕੰਟਰੋਲ ਤੋਂ ਬਿਨਾਂ ਆਟੋਮੈਟਿਕ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟਾਂ ਨੂੰ ਪ੍ਰਕਾਸ਼ਿਤ ਕਰਨਾ। ਸਹੀ ਨਾਵਾਂ, ਸ਼ਬਦਾਂ, ਵਿਰਾਮ ਚਿੰਨ੍ਹਾਂ ਅਤੇ ਬਣਾਏ ਗਏ ਸ਼ਬਦਾਂ ਵਿੱਚ ਤਰੁਟੀਆਂ ਰਹਿੰਦੀਆਂ ਹਨ।
- ਖਰਾਬ ਲਾਈਨ ਵੰਡਣਾ। "ਅਤੇ/ਪਰ/ਕੀ" ਵਿੱਚ ਖਤਮ ਹੋਣ ਵਾਲੀਆਂ ਲਾਈਨਾਂ ਪੜ੍ਹਨ ਨੂੰ ਮੁਸ਼ਕਲ ਬਣਾਉਂਦੀਆਂ ਹਨ।
- ਪੜ੍ਹਨ ਦੀ ਗਤੀ ਵੱਧ ਰਹੀ ਹੈ। ਲੰਬੇ ਉਪਸਿਰਲੇਖ ਜੋ ਸਕ੍ਰੀਨ 'ਤੇ ਬਹੁਤ ਛੋਟੇ ਹਨ, ਨੂੰ ਪੜ੍ਹਿਆ ਨਹੀਂ ਜਾ ਸਕਦਾ ਹੈ।
- ਮਸ਼ੀਨ ਅਨੁਵਾਦ ਦੀ ਪੁਸ਼ਟੀ ਨਹੀਂ ਕੀਤੀ ਜਾ ਰਹੀ। ਜੇਕਰ ਕੋਈ ਮੁਹਾਵਰਾ, ਚੁਟਕਲਾ ਜਾਂ ਸ਼ਬਦ ਗਲਤ ਹੋ ਜਾਂਦਾ ਹੈ, ਤਾਂ ਬ੍ਰਾਂਡ ਨੂੰ ਨੁਕਸਾਨ ਹੁੰਦਾ ਹੈ।
- ਸਪੀਕਰ ਦੇ ਭੇਦ ਨੂੰ ਬਾਈਪਾਸ ਕਰਨਾ। ਜੇਕਰ ਪੈਨਲ ਵਿੱਚ "ਕਿਸ ਨੇ ਕੀ ਕਿਹਾ" ਬਾਰੇ ਭੰਬਲਭੂਸਾ ਹੈ, ਤਾਂ ਉਪਸਿਰਲੇਖ ਗੁੰਮਰਾਹਕੁੰਨ ਹੋਵੇਗਾ।
ਸੰਕੇਤ: ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਨੂੰ ਸੰਪਾਦਿਤ ਕਰਦੇ ਸਮੇਂ, ਵੀਡੀਓ ਨੂੰ 1.25-1.5 ਦੀ ਗਤੀ 'ਤੇ ਦੇਖੋ ਅਤੇ ਜਾਂਚ ਕਰੋ ਕਿ ਇਹ ਉਪਸਿਰਲੇਖਾਂ ਨਾਲ ਸਮਕਾਲੀ ਹੈ। ਇਸ ਤਰ੍ਹਾਂ ਤੁਸੀਂ ਟਾਈਮਕੋਡ ਡ੍ਰੀਫਟ ਅਤੇ ਬਣੇ/ਖੁੰਝੇ ਹੋਏ ਸ਼ਬਦਾਂ ਦੋਵਾਂ ਨੂੰ ਜਲਦੀ ਫੜ ਲੈਂਦੇ ਹੋ।
ਸਾਵਧਾਨ: ਸਿਹਤ ਸੰਭਾਲ, ਕਾਨੂੰਨ, ਵਿੱਤ ਵਰਗੇ ਖੇਤਰਾਂ ਵਿੱਚ, ਇੱਕ ਇੱਕਲੇ ਗਲਤ ਤਰੀਕੇ ਨਾਲ ਲਿਪੀਅੰਤਰਿਤ ਸ਼ਬਦ (ਜਿਵੇਂ ਕਿ ਇੱਕ ਖੁਰਾਕ, ਇੱਕ ਸਮੱਗਰੀ ਸੰਖਿਆ) ਦੇ ਗੰਭੀਰ ਨਤੀਜੇ ਹੋ ਸਕਦੇ ਹਨ। ਇਹਨਾਂ ਸਮੱਗਰੀਆਂ ਵਿੱਚ, ਹਰੇਕ ਨੰਬਰ ਅਤੇ ਸ਼ਬਦ ਦੀ ਵੱਖਰੇ ਤੌਰ 'ਤੇ ਪੁਸ਼ਟੀ ਕੀਤੀ ਜਾਣੀ ਚਾਹੀਦੀ ਹੈ।
ਸੰਖੇਪ ਵਿੱਚ
ਸਵੈਚਲਿਤ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਉਪਸਿਰਲੇਖ ਪੋਸਟ-ਪ੍ਰੋਡਕਸ਼ਨ ਦਾ ਸਭ ਤੋਂ ਵੱਡਾ ਸਮਾਂ ਬਚਾਉਣ ਵਾਲਾ ਹੈ ਅਤੇ ਪਹੁੰਚਯੋਗਤਾ ਨੂੰ ਸਮਰੱਥ ਬਣਾਉਂਦਾ ਹੈ। AI ਪ੍ਰਤੀਲਿਪੀ ਦੇ ਘੰਟਿਆਂ ਨੂੰ ਮਿੰਟਾਂ ਵਿੱਚ ਘਟਾਉਂਦਾ ਹੈ ਅਤੇ ਟੈਕਸਟ ਦੁਆਰਾ ਖੋਜ ਨੂੰ ਸਮਰੱਥ ਬਣਾਉਂਦਾ ਹੈ। ਪਰ ਆਉਟਪੁੱਟ ਇਸਦੇ ਕੱਚੇ ਰੂਪ ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਨ ਲਈ ਢੁਕਵੀਂ ਨਹੀਂ ਹੈ: ਸਹੀ ਨਾਮ, ਸ਼ਬਦ, ਵਿਰਾਮ ਚਿੰਨ੍ਹ, ਬਣਾਏ ਗਏ ਸ਼ਬਦ ਅਤੇ ਖਰਾਬ ਲਾਈਨ ਬਰੇਕਾਂ ਨੂੰ ਠੀਕ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ। ਪੜ੍ਹਨਯੋਗਤਾ ਦੇ ਨਿਯਮ (ਲਾਈਨ ਦੀ ਲੰਬਾਈ, ਅਵਧੀ, ਪੜ੍ਹਨ ਦੀ ਗਤੀ) ਪਾਠ ਨੂੰ ਦਰਸ਼ਕ ਲਈ ਤਰਸਯੋਗ ਬਣਾਉਂਦੇ ਹਨ। ਬਹੁ-ਭਾਸ਼ਾਈ ਉਪਸਿਰਲੇਖਾਂ ਵਿੱਚ, ਮਸ਼ੀਨ ਅਨੁਵਾਦ ਨੂੰ ਇੱਕ ਵਿਅਕਤੀ ਦੁਆਰਾ ਪ੍ਰਮਾਣਿਤ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ ਜੋ ਟੀਚਾ ਭਾਸ਼ਾ ਜਾਣਦਾ ਹੈ। AI ਡੋਲ੍ਹਦਾ ਹੈ ਅਤੇ ਸੁਝਾਅ ਦਿੰਦਾ ਹੈ; ਸ਼ੁੱਧਤਾ, ਪੜ੍ਹਨਯੋਗਤਾ ਅਤੇ ਅਰਥ ਸੰਪਾਦਕ ਦੀ ਜ਼ਿੰਮੇਵਾਰੀ ਹੈ।
ਐਪਲੀਕੇਸ਼ਨ ਦਾ ਕੰਮ
ਇੱਕ ਛੋਟੀ ਗੱਲਬਾਤ ਦੀ ਰਿਕਾਰਡਿੰਗ ਲਓ (ਸ਼ਾਇਦ ਤੁਹਾਡੀ ਆਪਣੀ ਆਵਾਜ਼, 2-3 ਮਿੰਟ) ਅਤੇ ਇਸਨੂੰ ਆਪਣੇ ਆਪ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰੋ। ਆਉਟਪੁੱਟ ਦੀ ਤੁਲਨਾ ਮੂਲ ਆਡੀਓ ਅਤੇ ਫਲੈਗ ਸਹੀ ਨਾਂਵਾਂ, ਸ਼ਰਤਾਂ ਅਤੇ ਵਿਰਾਮ ਚਿੰਨ੍ਹਾਂ ਦੀਆਂ ਗਲਤੀਆਂ ਨਾਲ ਕਰੋ; ਘੱਟੋ-ਘੱਟ ਪੰਜ ਗਲਤੀਆਂ ਲੱਭੋ। ਫਿਰ, ਉਪਰੋਕਤ ਨਿਯਮਾਂ ਦੇ ਅਨੁਸਾਰ ਟੈਕਸਟ ਨੂੰ ਉਪਸਿਰਲੇਖ ਬਲਾਕਾਂ ਵਿੱਚ ਵੰਡੋ, ਇੱਕ ਭਾਸ਼ਾ ਵਿੱਚ ਅਨੁਵਾਦ ਕਰੋ, ਅਤੇ ਅਨੁਵਾਦ ਵਿੱਚ ਘੱਟੋ-ਘੱਟ ਦੋ ਜੋਖਮ ਵਾਲੇ ਬਿੰਦੂਆਂ (ਮੁਹਾਵਰੇ/ਸ਼ਰਤਾਂ) ਨੂੰ ਠੀਕ ਕਰੋ। ਪ੍ਰਕਿਰਿਆ ਅਤੇ ਕਿਸੇ ਵੀ ਤਰੁੱਟੀ ਦੀ ਰਿਪੋਰਟ ਕਰੋ ਜੋ ਤੁਸੀਂ ਲੱਭਦੇ ਹੋ।
ਚੈੱਕਲਿਸਟ
- [ ] ਕੀ ਮੈਂ ਮੂਲ ਆਡੀਓ ਨਾਲ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਦੀ ਤੁਲਨਾ ਕੀਤੀ ਹੈ ਅਤੇ ਕਿਸੇ ਵੀ ਸਹੀ ਨਾਂ/ਸ਼ਬਦ/ਵਿਰਾਮ ਚਿੰਨ੍ਹ ਦੀਆਂ ਗਲਤੀਆਂ ਨੂੰ ਠੀਕ ਕੀਤਾ ਹੈ?
- [ ] ਕੀ ਮੈਂ ਬਣਾਏ ਗਏ ਜਾਂ ਛੱਡੇ ਗਏ ਸ਼ਬਦਾਂ ਦੀ ਜਾਂਚ ਕੀਤੀ ਹੈ?
- ਕੀ ਮੈਂ ਲਾਈਨ ਦੀ ਲੰਬਾਈ, ਮਿਆਦ ਅਤੇ ਰੀਡਿੰਗ ਸਪੀਡ ਨਿਯਮਾਂ ਦੇ ਅਨੁਸਾਰ ਉਪਸਿਰਲੇਖ ਨੂੰ ਸੰਪਾਦਿਤ ਕੀਤਾ ਹੈ?
- [ ] ਬਹੁ-ਭਾਸ਼ਾਈ ਉਪਸਿਰਲੇਖਾਂ ਲਈ, ਕੀ ਮੈਂ ਕਿਸੇ ਅਜਿਹੇ ਵਿਅਕਤੀ ਨਾਲ ਅਨੁਵਾਦ ਦੀ ਧਿਆਨ ਨਾਲ ਪੁਸ਼ਟੀ ਕੀਤੀ ਹੈ ਜੋ ਟੀਚਾ ਭਾਸ਼ਾ ਜਾਣਦਾ ਹੈ?
- ਕੀ ਮੈਂ ਸੰਵੇਦਨਸ਼ੀਲ ਸਮੱਗਰੀ ਵਿੱਚ ਹਰੇਕ ਨੰਬਰ ਅਤੇ ਸ਼ਬਦ ਦੀ ਵੱਖਰੇ ਤੌਰ 'ਤੇ ਪੁਸ਼ਟੀ ਕੀਤੀ ਹੈ?