ਇਕਾਈਆਂ
1. ਫੋਰੈਂਸਿਕਸ ਵਿੱਚ ਆਰਟੀਫੀਸ਼ੀਅਲ ਇੰਟੈਲੀਜੈਂਸ ਦੀ ਜਾਣ-ਪਛਾਣ: ਭੂਮਿਕਾਵਾਂ, ਸੀਮਾਵਾਂ, ਤਸਦੀਕ, ਸਬੂਤ ਇਕਸਾਰਤਾ ਅਤੇ ਨੈਤਿਕਤਾ 2. ਸਬੂਤ ਸੰਗ੍ਰਹਿ ਅਤੇ ਪ੍ਰੀਖਿਆ ਸਹਾਇਤਾ: ਇਮੇਜਿੰਗ, ਛਾਂਟੀ ਅਤੇ ਵਿਸ਼ਲੇਸ਼ਣ ਪ੍ਰਵੇਗ 3. ਲੌਗ ਅਤੇ ਟਾਈਮਲਾਈਨ ਵਿਸ਼ਲੇਸ਼ਣ: ਘਟਨਾਵਾਂ ਨੂੰ ਸਹੀ ਕ੍ਰਮ ਵਿੱਚ ਰੱਖਣਾ 4. ਬਿਗ ਡੇਟਾ ਟ੍ਰਾਈਜ: ਡੇਟਾ ਦੇ ਟੈਰਾਬਾਈਟ ਨੂੰ ਤਰਜੀਹ ਦੇਣਾ 5. ਈ-ਡਿਸਕਵਰੀ: ਕਾਰਪੋਰੇਟ ਡੇਟਾ ਵਿੱਚ ਸੰਬੰਧਿਤ ਸਬੂਤ ਲੱਭਣਾ 6. ਮਾਲਵੇਅਰ ਅਤੇ ਨੈੱਟਵਰਕ ਫੋਰੈਂਸਿਕ ਵਿਸ਼ਲੇਸ਼ਣ: ਰੱਖਿਆ ਲਈ ਰਿਵਰਸ ਇੰਜੀਨੀਅਰਿੰਗ 7. ਮੋਬਾਈਲ, ਕਲਾਉਡ ਅਤੇ ਐਪ ਫੋਰੈਂਸਿਕ ਵਿਸ਼ਲੇਸ਼ਣ: ਚੈਟ, ਸਥਾਨ ਅਤੇ ਐਪ ਡੇਟਾ 8. ਡੀਪਫੇਕ ਅਤੇ ਸਿੰਥੈਟਿਕ ਮੀਡੀਆ ਖੋਜ: ਜਾਅਲੀ ਚਿੱਤਰ, ਆਡੀਓ ਅਤੇ ਵੀਡੀਓ ਪੁਸ਼ਟੀਕਰਨ 9. ਸਬੂਤ ਦੀ ਇਕਸਾਰਤਾ, ਹਿਰਾਸਤ ਦੀ ਲੜੀ ਅਤੇ ਕਾਨੂੰਨੀ ਮਾਨਤਾ 10. ਰਿਪੋਰਟ ਡਰਾਫਟ ਅਤੇ ਮਾਹਰ ਪੇਸ਼ਕਾਰੀ: ਖੋਜਾਂ ਨੂੰ ਸਮਝਣਯੋਗ ਅਤੇ ਰੱਖਿਆਤਮਕ ਢੰਗ ਨਾਲ ਲਿਖਣਾ 11. ਐਂਡ-ਟੂ-ਐਂਡ ਵਰਕਫਲੋ, ਲੈਬਾਰਟਰੀ ਗਵਰਨੈਂਸ, ਪ੍ਰਮਾਣਿਕਤਾ ਅਤੇ ਜ਼ਿੰਮੇਵਾਰ ਵਰਤੋਂ
ਯੂਨਿਟ 4 / 11

ਬਿਗ ਡੇਟਾ ਟ੍ਰਾਈਜ: ਡੇਟਾ ਦੇ ਟੈਰਾਬਾਈਟ ਨੂੰ ਤਰਜੀਹ ਦੇਣਾ

ਲਾਭ:

  • ਸਮਝੋ ਕਿ ਟ੍ਰਾਈਜ ਕਿਸੇ ਵੀ ਚੀਜ਼ ਨੂੰ ਮਿਟਾਏ ਬਿਨਾਂ ਇਮਤਿਹਾਨ ਦੇ ਕ੍ਰਮ ਨੂੰ ਨਿਰਧਾਰਤ ਕਰਨ ਦਾ ਅਨੁਸ਼ਾਸਨ ਹੈ, ਅਤੇ ਨਕਲੀ ਬੁੱਧੀ ਨਾਲ ਅਰਥ ਖੋਜ ਅਤੇ ਸਮੱਗਰੀ ਕਲੱਸਟਰਿੰਗ ਕਰਨ ਦੇ ਯੋਗ ਹੋਵੋ।
  • ਹੈਸ਼-ਅਧਾਰਿਤ ਐਲੀਮੀਨੇਸ਼ਨ (ਐਨਐਸਆਰਐਲ) ਅਤੇ ਡੀ-ਡੁਪਲੀਕੇਸ਼ਨ ਨਾਲ ਰੌਲਾ ਘਟਾਉਣ ਦੀ ਸਮਰੱਥਾ ਅਤੇ ਇਹਨਾਂ ਤਰੀਕਿਆਂ ਦੀਆਂ ਸੀਮਾਵਾਂ (ਸਿੰਗਲ ਬਿੱਟ ਤਬਦੀਲੀ) ਦੀ ਪਾਲਣਾ ਕਰੋ
  • ਉਹਨਾਂ ਨੂੰ ਬਚਾਅ ਯੋਗ ਬਣਾਉਣ ਲਈ ਜਾਇਜ਼ਤਾ ਦੇ ਨਾਲ ਅਰਥ ਖੋਜ ਅਤੇ ਦਸਤਾਵੇਜ਼ ਟ੍ਰਾਈਜ ਫੈਸਲਿਆਂ ਦੇ ਝੂਠੇ ਸਕਾਰਾਤਮਕਾਂ ਦੀ ਦਸਤੀ ਪੁਸ਼ਟੀ ਕਰਨ ਦੀ ਸਮਰੱਥਾ

ਇੱਕ ਆਧੁਨਿਕ ਫੋਰੈਂਸਿਕ ਜਾਂਚ ਹੁਣ ਇੱਕ ਕੰਪਿਊਟਰ ਤੱਕ ਸੀਮਿਤ ਨਹੀਂ ਹੈ। ਇੱਕ ਕਾਰਪੋਰੇਟ ਘਟਨਾ ਵਿੱਚ, ਤੁਹਾਨੂੰ ਦਰਜਨਾਂ ਡਿਸਕਾਂ, ਸੈਂਕੜੇ ਗੀਗਾਬਾਈਟ ਈਮੇਲ ਪੁਰਾਲੇਖ, ਕਲਾਉਡ ਬੈਕਅੱਪ, ਚੈਟ ਐਪਲੀਕੇਸ਼ਨਾਂ ਅਤੇ ਟੈਰਾਬਾਈਟ ਫਾਈਲਾਂ ਦਾ ਸਾਹਮਣਾ ਕਰਨਾ ਪੈ ਸਕਦਾ ਹੈ। ਸਰੀਰਕ ਤੌਰ 'ਤੇ ਸ਼ੁਰੂ ਤੋਂ ਲੈ ਕੇ ਅੰਤ ਤੱਕ, ਉਨ੍ਹਾਂ ਸਾਰਿਆਂ ਦੀ ਇਕ-ਇਕ ਕਰਕੇ ਜਾਂਚ ਕਰਨਾ ਅਸੰਭਵ ਹੈ। ਇਹ ਉਹ ਥਾਂ ਹੈ ਜਿੱਥੇ ਟ੍ਰਾਈਏਜ (ਦਵਾਈ ਤੋਂ ਉਧਾਰ ਲਿਆ ਗਿਆ ਇੱਕ ਸੰਕਲਪ; ਪਹਿਲਾਂ ਸਭ ਤੋਂ ਨਾਜ਼ੁਕ ਕੇਸ ਲਈ ਸੀਮਤ ਸਰੋਤ ਨਿਰਧਾਰਤ ਕਰਨਾ, ਭਾਵ, "ਪਹਿਲਾਂ ਕੀ ਵੇਖਣਾ ਹੈ" ਬਾਰੇ ਜਲਦੀ ਫੈਸਲਾ ਕਰਨਾ) ਖੇਡ ਵਿੱਚ ਆਉਂਦਾ ਹੈ। ਇਸ ਯੂਨਿਟ ਵਿੱਚ, ਅਸੀਂ ਦੇਖਾਂਗੇ ਕਿ ਕਿਵੇਂ AI ਬੁੱਧੀਮਾਨ ਢੰਗ ਨਾਲ ਡੇਟਾ ਦੇ ਵੱਡੇ ਢੇਰਾਂ ਨੂੰ ਤਰਜੀਹ ਦਿੰਦਾ ਹੈ, ਇਸ ਵਿੱਚ ਕਿਹੜੀਆਂ ਗਲਤੀਆਂ ਹੁੰਦੀਆਂ ਹਨ, ਅਤੇ ਟ੍ਰਾਈਏਜ ਫੋਰੈਂਸਿਕ ਅਖੰਡਤਾ ਨਾਲ ਕਿਵੇਂ ਮੇਲ ਖਾਂਦਾ ਹੈ।

ਟ੍ਰਾਈਜ ਕਿਉਂ ਜ਼ਰੂਰੀ ਹੈ?

ਕੰਪਿਊਟਰ ਫੋਰੈਂਸਿਕ ਵਿੱਚ, ਦੋ ਅਸਲੀਅਤਾਂ ਦਾ ਟਕਰਾਅ ਹੈ: (1) ਸਾਰੇ ਸਬੂਤ ਕੀਮਤੀ ਹਨ ਅਤੇ ਕੁਝ ਵੀ ਖੁੰਝਾਇਆ ਨਹੀਂ ਜਾਣਾ ਚਾਹੀਦਾ; (2) ਸਮਾਂ ਅਤੇ ਮਨੁੱਖੀ ਸ਼ਕਤੀ ਸੀਮਤ ਹੈ। ਟ੍ਰਾਈਜ ਇਸ ਟਕਰਾਅ ਨੂੰ ਹੱਲ ਕਰਦਾ ਹੈ - ਕਿਸੇ ਵੀ ਚੀਜ਼ ਨੂੰ ਨਾ ਮਿਟਾਉਣ ਦੁਆਰਾ, ਸਿਰਫ਼ ਪ੍ਰੀਖਿਆ ਦੇ ਕ੍ਰਮ ਨੂੰ ਨਿਰਧਾਰਤ ਕਰਕੇ। ਦੂਜੇ ਸ਼ਬਦਾਂ ਵਿੱਚ, ਤ੍ਰਿਏਜ ਇੱਕ "ਖਤਮ" ਨਹੀਂ ਹੈ ਪਰ ਇੱਕ "ਪਹਿਲ" ਹੈ। ਸਬੂਤ ਦੀ ਸਭ ਤੋਂ ਵੱਧ ਸੰਭਾਵਨਾ ਵਾਲੇ ਡੇਟਾ ਦੀ ਪਹਿਲਾਂ ਜਾਂਚ ਕੀਤੀ ਜਾਂਦੀ ਹੈ; ਘੱਟ ਸੰਭਾਵਨਾ ਡੇਟਾ ਸਟੋਰ ਕੀਤਾ ਜਾਂਦਾ ਹੈ ਪਰ ਬਾਅਦ ਵਿੱਚ ਕਤਾਰ ਵਿੱਚ ਆਉਂਦਾ ਹੈ।

ਟ੍ਰਾਈਏਜ ਦੋ ਪੱਧਰਾਂ 'ਤੇ ਵਾਪਰਦਾ ਹੈ: ਲਾਈਵ ਟ੍ਰਾਈਏਜ (ਸੀਨ 'ਤੇ ਫੈਸਲਾ ਕਰਨਾ ਕਿ ਕਿਸ ਡਿਵਾਈਸ ਨੂੰ ਪਹਿਲਾਂ ਚਿੱਤਰ ਬਣਾਉਣਾ ਹੈ) ਅਤੇ ਡੇਟਾ ਟ੍ਰਾਈਜ (ਇੱਕ ਵਾਰ ਚਿੱਤਰ ਕੈਪਚਰ ਹੋ ਜਾਣ ਤੋਂ ਬਾਅਦ, ਪਹਿਲਾਂ ਕਿਹੜੀ ਫਾਈਲ/ਡੇਟਾਸੈਟ ਦੀ ਜਾਂਚ ਕਰਨੀ ਹੈ)। AI ਖਾਸ ਤੌਰ 'ਤੇ ਬਾਅਦ ਵਿੱਚ ਮਜ਼ਬੂਤ ​​​​ਹੈ, ਅਰਥਾਤ ਵੱਡੇ ਡੇਟਾਸੇਟਾਂ ਦੀ ਸਮੱਗਰੀ-ਅਧਾਰਤ ਤਰਜੀਹ।

ਟ੍ਰਾਈਜ ਦਾ ਫੋਰੈਂਸਿਕ ਤੌਰ 'ਤੇ ਸੰਵੇਦਨਸ਼ੀਲ ਪਹਿਲੂ ਇਹ ਹੈ ਕਿ ਆਦੇਸ਼ ਦੇਣ ਦਾ ਫੈਸਲਾ ਜਾਂਚ ਦੀ ਦਿਸ਼ਾ ਨਿਰਧਾਰਤ ਕਰਦਾ ਹੈ। ਗਲਤ ਢੰਗ ਨਾਲ ਤਰਜੀਹੀ ਕਲੱਸਟਰ ਦੇ ਨਤੀਜੇ ਵਜੋਂ ਅਹਿਮ ਸਬੂਤ ਹਫ਼ਤਿਆਂ ਦੇਰ ਨਾਲ ਲੱਭੇ ਜਾ ਸਕਦੇ ਹਨ, ਜਾਂ ਜਾਂਚ ਵੀ ਨਹੀਂ ਕੀਤੀ ਜਾ ਸਕਦੀ ਕਿਉਂਕਿ ਜਾਂਚ ਦੀ ਮਿਆਦ ਖਤਮ ਹੋ ਗਈ ਹੈ। ਇਸ ਲਈ ਟ੍ਰਾਈਏਜ ਇੱਕ "ਸਪੀਡ ਟ੍ਰਿਕ" ਨਹੀਂ ਹੈ ਪਰ ਇੱਕ ਵਿਧੀਗਤ ਫੈਸਲਾ ਹੈ ਅਤੇ ਕਿਸੇ ਵੀ ਹੋਰ ਫੋਰੈਂਸਿਕ ਕਦਮ ਵਾਂਗ, ਜਾਇਜ਼ਤਾ ਨਾਲ ਦਸਤਾਵੇਜ਼ੀ ਹੋਣਾ ਚਾਹੀਦਾ ਹੈ। ਉੱਚ-ਜੋਖਮ ਵਾਲੇ ਮਾਮਲਿਆਂ ਵਿੱਚ, ਟ੍ਰਾਈਜ ਪੂਰੀ ਜਾਂਚ ਦੀ ਥਾਂ ਨਹੀਂ ਲੈਂਦਾ; ਇਹ ਸਿਰਫ਼ ਇਹ ਨਿਰਧਾਰਤ ਕਰਦਾ ਹੈ ਕਿ ਕਿਹੜੇ ਹਿੱਸੇ ਨੂੰ ਪਹਿਲਾਂ ਮੰਨਿਆ ਜਾਂਦਾ ਹੈ, ਇਸ ਸਿਧਾਂਤ ਨੂੰ ਸੁਰੱਖਿਅਤ ਰੱਖਦੇ ਹੋਏ ਕਿ ਪੂਰੇ ਸੈੱਟ ਦਾ ਅੰਤ ਵਿੱਚ ਮੁਲਾਂਕਣ ਕੀਤਾ ਜਾਵੇਗਾ।

ਸੁਝਾਅ: ਆਪਣੇ ਟ੍ਰਾਈਜ ਦੇ ਫੈਸਲਿਆਂ ਅਤੇ ਉਹਨਾਂ ਦੇ ਕਾਰਨਾਂ ਦਾ ਰਿਕਾਰਡ ਰੱਖੋ। "ਅਸੀਂ ਇਸ ਕਲੱਸਟਰ ਨੂੰ ਪਹਿਲਾਂ ਕਿਉਂ ਦੇਖਿਆ, ਅਸੀਂ ਇਸ ਨੂੰ ਅਖੀਰ ਤੱਕ ਕਿਉਂ ਛੱਡਿਆ?" ਅਦਾਲਤ ਵਿੱਚ ਸਵਾਲ ਪੁੱਛਿਆ ਜਾ ਸਕਦਾ ਹੈ। ਇਸ ਰਿਕਾਰਡ ਵਿੱਚ AI ਦੇ ਤਰਜੀਹੀ ਤਰਕ ਨੂੰ ਸ਼ਾਮਲ ਕਰੋ; ਪਾਰਦਰਸ਼ਤਾ ਸੁਰੱਖਿਆ ਹੈ।

AI ਨਾਲ ਸਮੱਗਰੀ-ਅਧਾਰਿਤ ਤਰਜੀਹ

ਕਲਾਸਿਕ ਟ੍ਰਾਈਜ ਫਾਈਲ ਦੇ ਨਾਮ, ਆਕਾਰ ਅਤੇ ਮਿਤੀ ਨੂੰ ਵੇਖਦਾ ਹੈ। AI ਇਸ ਵਿੱਚ ਸੰਦਰਭ ਸਮਝ ਜੋੜਦਾ ਹੈ: ਇਹ ਸਮਝ ਸਕਦਾ ਹੈ ਕਿ ਇੱਕ ਦਸਤਾਵੇਜ਼ ਕਿਸ ਬਾਰੇ ਹੈ, ਇੱਕ ਚਿੱਤਰ ਵਿੱਚ ਕੀ ਹੈ, ਇੱਕ ਗੱਲਬਾਤ ਦਾ ਟੋਨ। ਇਸ ਰਸਤੇ ਵਿਚ:

  • ਅਰਥ-ਵਿਵਸਥਾ ਦੀ ਖੋਜ - ਅਰਥਾਂ ਵਿੱਚ ਸਮਾਨਤਾ ਵਾਲੀ ਸਮੱਗਰੀ ਲੱਭਣਾ ਭਾਵੇਂ ਸ਼ਬਦ ਬਿਲਕੁਲ ਮੇਲ ਨਹੀਂ ਖਾਂਦਾ: "ਮਨੀ ਟ੍ਰਾਂਸਫਰ" ਦੀ ਖੋਜ "ਪੈਸਾ ਟ੍ਰਾਂਸਫਰ", "ਸ਼ਿਪਮੈਂਟ", "ਭੁਗਤਾਨ ਹਦਾਇਤ" ਵਾਲੇ ਦਸਤਾਵੇਜ਼ ਵੀ ਵਾਪਸ ਕਰਦੀ ਹੈ।
  • ਵਿਸ਼ਾ ਕਲੱਸਟਰਿੰਗ: ਹਜ਼ਾਰਾਂ ਦਸਤਾਵੇਜ਼ਾਂ ਨੂੰ ਥੀਮਾਂ (ਵਿੱਤੀ, HR, ਤਕਨੀਕੀ, ਨਿੱਜੀ) ਵਿੱਚ ਸਵੈਚਲਿਤ ਤੌਰ 'ਤੇ ਛਾਂਟਣਾ।
  • ਭਾਵਨਾ/ਟੋਨ ਮਾਰਕਿੰਗ: ਸੁਨੇਹਿਆਂ ਨੂੰ ਉਜਾਗਰ ਕਰਨਾ ਜੋ ਧਮਕੀ, ਘਬਰਾਹਟ, ਗੋਪਨੀਯਤਾ ਦੀ ਉਲੰਘਣਾ ਵਰਗੀਆਂ ਸੁਰਾਂ ਨੂੰ ਪ੍ਰਗਟ ਕਰਦੇ ਹਨ।
  • ਵਿਜ਼ੂਅਲ ਟ੍ਰਾਈਜ: ਆਬਜੈਕਟ/ਸੀਨ ਟੈਗ ਦੁਆਰਾ ਹਜ਼ਾਰਾਂ ਚਿੱਤਰਾਂ ਦਾ ਸਮੂਹ ਕਰਨਾ (ਕਾਨੂੰਨੀ ਸੀਮਾਵਾਂ ਦੇ ਅੰਦਰ, ਉਦਾਹਰਨ ਲਈ ਕੇਵਲ ਅਧਿਕਾਰਤ ਅਤੇ ਉਚਿਤ ਸਮੱਗਰੀ)।
  • ਡੁਪਲੀਕੇਟ ਅਤੇ ਜੰਕ ਦਾ ਖਾਤਮਾ: ਇੱਕੋ ਫਾਈਲ ਅਤੇ ਸਿਸਟਮ ਫਾਈਲਾਂ (ਜਾਣੀਆਂ ਹੈਸ਼ ਸੂਚੀਆਂ ਦੇ ਨਾਲ) ਦੇ ਡੀ-ਡੁਪਲੀਕੇਸ਼ਨ ਨੂੰ ਵੱਖ ਕਰਨਾ ਅਤੇ ਮਨੁੱਖੀ ਨਿਗਾਹ ਨੂੰ ਸੱਚਮੁੱਚ ਨਵੀਂ ਸਮੱਗਰੀ ਵੱਲ ਸੇਧਿਤ ਕਰਨਾ।

ਜਾਣਿਆ-ਪਛਾਣਿਆ ਫਾਇਲ ਖਾਤਮਾ: NSRL ਅਤੇ ਹੈਸ਼ ਸੈੱਟ

ਵੱਡੇ ਡੇਟਾ ਟ੍ਰਾਈਜ ਲਈ ਸਭ ਤੋਂ ਪ੍ਰੈਕਟੀਕਲ ਐਕਸਲੇਟਰ ਚੰਗੀ/ਬੁਰਾ ਹੈਸ਼ ਸੂਚੀਆਂ ਨੂੰ ਜਾਣਿਆ ਜਾਂਦਾ ਹੈ। NSRL (ਨੈਸ਼ਨਲ ਸੌਫਟਵੇਅਰ ਰੈਫਰੈਂਸ ਲਾਇਬ੍ਰੇਰੀ) ਵਰਗੀਆਂ ਲਾਇਬ੍ਰੇਰੀਆਂ ਵਿੱਚ ਲੱਖਾਂ ਸਟੈਂਡਰਡ ਓਪਰੇਟਿੰਗ ਸਿਸਟਮ ਅਤੇ ਐਪਲੀਕੇਸ਼ਨ ਫਾਈਲਾਂ ਦੇ ਹੈਸ਼ ਹਨ। ਇਹ "ਜਾਣੀਆਂ ਚੰਗੀਆਂ" ਫਾਈਲਾਂ ਨੂੰ ਟ੍ਰਾਈਜ ਵਿੱਚ ਖਤਮ ਕਰ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ, ਜਿਸ ਨਾਲ ਇੱਕ ਉਪਭੋਗਤਾ ਦੁਆਰਾ ਤਿਆਰ ਕੀਤੀਆਂ ਅਤੇ ਸ਼ੱਕੀ ਫਾਈਲਾਂ 'ਤੇ ਧਿਆਨ ਕੇਂਦਰਿਤ ਕਰ ਸਕਦਾ ਹੈ। ਇਸੇ ਤਰ੍ਹਾਂ, "ਜਾਣਿਆ ਬੁਰਾ" ਹੈਸ਼ (ਜਾਣਿਆ ਮਾਲਵੇਅਰ) ਆਪਣੇ ਆਪ ਫਲੈਗ ਕੀਤਾ ਜਾਂਦਾ ਹੈ। AI ਇਸ ਖਾਤਮੇ ਤੋਂ ਬਾਅਦ ਬਾਕੀ ਰਹਿੰਦੇ ਕਲੱਸਟਰ ਵਿੱਚ ਖੇਡ ਵਿੱਚ ਆਉਂਦਾ ਹੈ, ਜਿਸਦਾ ਅਸਲ ਵਿੱਚ ਅਰਥ ਲੋੜੀਂਦਾ ਹੈ।

ਸਾਵਧਾਨ: ਹੈਸ਼-ਅਧਾਰਿਤ ਖਾਤਮਾ ਸ਼ਕਤੀਸ਼ਾਲੀ ਹੈ, ਪਰ ਇੱਕ ਬਿੱਟ ਤਬਦੀਲੀ ਹੈਸ਼ ਨੂੰ ਪੂਰੀ ਤਰ੍ਹਾਂ ਬਦਲ ਦਿੰਦੀ ਹੈ। ਇੱਕ ਮਿਆਰੀ ਫਾਈਲ ਨੂੰ ਥੋੜ੍ਹਾ ਸੋਧ ਕੇ, ਇੱਕ ਹਮਲਾਵਰ ਇਸਨੂੰ "ਜਾਣੀਆਂ ਚੰਗੀਆਂ" ਸੂਚੀ ਵਿੱਚੋਂ ਹਟਾ ਸਕਦਾ ਹੈ ਜਾਂ, ਇਸਦੇ ਉਲਟ, ਮਾੜੀ ਫਾਈਲ ਨੂੰ ਲੁਕਾ ਸਕਦਾ ਹੈ। ਖਾਤਮਾ ਇੱਕ ਸੰਪੂਰਨ ਨਹੀਂ ਹੈ, ਪਰ ਤਰਜੀਹ ਦਾ ਸਾਧਨ ਹੈ।

ਤਿੰਨ ਛੋਟੇ ਕੇਸ

ਕੇਸ 1 - ਅਰਥ ਖੋਜ ਨੇ ਸਮੇਂ ਨੂੰ 20 ਨਾਲ ਵੰਡਿਆ। ਇੱਕ ਅੰਦਰੂਨੀ ਜਾਂਚ ਵਿੱਚ 480GB ਈਮੇਲਾਂ ਮਿਲੀਆਂ। ਕਲਾਸਿਕ ਕੀਵਰਡ ਖੋਜ ਨੇ "ਰਿਸ਼ਵਤਖੋਰੀ" ਲਈ 3 ਨਤੀਜੇ ਵਾਪਸ ਕੀਤੇ. AI-ਸੰਚਾਲਿਤ ਅਰਥ-ਸੰਬੰਧੀ ਖੋਜ ਨੇ "ਕਸਲਟਿੰਗ ਫੀਸ", "ਸਹੂਲਤ", "ਤੁਹਾਡਾ ਧੰਨਵਾਦ ਭੁਗਤਾਨ" ਵਰਗੇ ਸੁਹੱਪਣ ਵੀ ਫੜੇ ਅਤੇ 61 ਸੰਬੰਧਿਤ ਸੁਨੇਹੇ ਕੱਢੇ। ਸਮੀਖਿਆ ਹਫ਼ਤਿਆਂ ਦੀ ਬਜਾਏ 2 ਦਿਨਾਂ ਵਿੱਚ ਪੂਰੀ ਕੀਤੀ ਗਈ ਸੀ; ਹਰੇਕ ਨਤੀਜੇ ਦੀ ਦਸਤੀ ਪੁਸ਼ਟੀ ਕੀਤੀ ਗਈ ਸੀ।

ਕੇਸ 2 - ਡੀ-ਡੁਪਲੀਕੇਸ਼ਨ ਨੇ ਬਚਤ ਮਨੁੱਖੀ ਸ਼ਕਤੀ। 1.7 ਮਿਲੀਅਨ ਫਾਈਲਾਂ ਦੇ ਇੱਕ ਕਲੱਸਟਰ ਵਿੱਚ, ਹੈਸ਼-ਅਧਾਰਤ ਡੁਪਲੀਕੇਟ ਸਫਾਈ ਅਤੇ NSRL ਦੇ ਖਾਤਮੇ ਤੋਂ ਬਾਅਦ, ਜਾਂਚ ਕਰਨ ਲਈ ਵਿਲੱਖਣ ਉਪਭੋਗਤਾ ਫਾਈਲਾਂ ਨੂੰ ਘਟਾ ਕੇ 92,000 ਕਰ ਦਿੱਤਾ ਗਿਆ ਸੀ। ਟੀਮ ਨੇ ਇੱਕ ਢੇਰ ਦੀ ਬਜਾਏ ਅਸਲ ਸਮੱਗਰੀ 'ਤੇ ਧਿਆਨ ਦਿੱਤਾ ਜੋ 95% ਸਿਸਟਮ ਸ਼ੋਰ ਸੀ।

ਕੇਸ 3 - ਜ਼ਿਆਦਾ ਆਤਮਵਿਸ਼ਵਾਸ ਦੀ ਕੀਮਤ। ਇੱਕ ਟੀਮ ਨੇ ਕਦੇ ਨਹੀਂ ਖੋਲ੍ਹਿਆ ਜਿਸਨੂੰ AI "ਗੈਰ-ਵਿੱਤ" ਕਲੱਸਟਰ ਕਹਿੰਦੇ ਹਨ। ਜਿਵੇਂ ਕਿ ਇਹ ਪਤਾ ਚਲਦਾ ਹੈ, ਇੱਕ ਨਿੱਜੀ ਫੋਟੋ ਐਲਬਮ (ਸਟੈਗਨੋਗ੍ਰਾਫੀ ਨਹੀਂ, ਸਿਰਫ ਗਲਤ ਫੋਲਡਰ) ਦੇ ਅੰਦਰ ਇੱਕ ਨਾਜ਼ੁਕ ਇਕਰਾਰਨਾਮਾ ਲੁਕਿਆ ਹੋਇਆ ਸੀ। ਸਬੂਤ ਵਿੱਚ ਦੇਰੀ ਹੋਈ ਕਿਉਂਕਿ ਘੱਟ ਤਰਜੀਹ ਵਾਲੇ ਕਲੱਸਟਰ ਦਾ ਨਮੂਨਾ ਨਹੀਂ ਲਿਆ ਗਿਆ ਸੀ। ਸਬਕ: ਟ੍ਰਾਈਜ ਆਰਡਰ ਨਿਰਧਾਰਤ ਕਰਦਾ ਹੈ, ਪ੍ਰੀਖਿਆ ਨੂੰ ਰੱਦ ਨਹੀਂ ਕਰਦਾ।

ਚਾਰ ਕਾਪੀ ਕਰਨ ਯੋਗ ਟੈਂਪਲੇਟ

1) ਡਰਾਫਟ ਟ੍ਰਾਈਜ ਰਣਨੀਤੀ:

ਤੁਹਾਡੀ ਭੂਮਿਕਾ: ਸੀਨੀਅਰ ਫੋਰੈਂਸਿਕ ਟ੍ਰਾਈਜ ਸਪੈਸ਼ਲਿਸਟ। ਡੇਟਾ: [ਉਦਾ. 480GB ਈਮੇਲ + 1.2TB ਫਾਈਲ ਸ਼ੇਅਰਿੰਗ]। ਪੁੱਛਗਿੱਛ ਦਾ ਵਿਸ਼ਾ: [ਉਦਾ. ਡਾਟਾ ਲੀਕੇਜ + ਰਿਸ਼ਵਤਖੋਰੀ]।ਮੇਰੇ ਲਈ ਇੱਕ ਟ੍ਰਾਈਜ ਰਣਨੀਤੀ ਤਿਆਰ ਕਰੋ: ਕਿਹੜੇ ਕਲੱਸਟਰ ਨੂੰ ਕਿਸ ਕ੍ਰਮ ਵਿੱਚ ਦੇਖਿਆ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ, ਕਿਸ ਮਾਪਦੰਡ ਨਾਲ; ਹੈਸ਼ ਐਲੀਮੀਨੇਸ਼ਨ ਅਤੇ ਸਿਮੈਂਟਿਕ ਖੋਜ ਦੀ ਵਰਤੋਂ ਕਿਵੇਂ ਕਰੀਏ. ਇਸ ਗੱਲ 'ਤੇ ਜ਼ੋਰ ਦਿਓ ਕਿ ਕੋਈ ਵੀ ਕਲੱਸਟਰ "ਰੱਦ ਨਹੀਂ ਕੀਤਾ ਜਾਵੇਗਾ", ਉਹਨਾਂ ਨੂੰ ਸਿਰਫ਼ ਛਾਂਟਿਆ ਜਾਵੇਗਾ।

2) ਅਰਥ ਖੋਜ ਸ਼ਬਦ ਦਾ ਵਿਸਥਾਰ:

ਵਿਸ਼ਾ: [ਰਿਸ਼ਵਤਖੋਰੀ / ਡੇਟਾ ਲੀਕ / ਪਰੇਸ਼ਾਨੀ]। ਇਸ ਵਿਸ਼ੇ ਨਾਲ ਸਬੰਧਤ ਦਸਤਾਵੇਜ਼ਾਂ ਨੂੰ ਲੱਭਣ ਲਈ, ਅਪ੍ਰਤੱਖ/ਸਮਾਨਯੋਗ ਸਮੀਕਰਨਾਂ (ਸਲੈਂਗ, ਕੋਡਵਰਡ, ਅਸਿੱਧੇ ਭਾਸ਼ਣ ਸਮੇਤ) ਦੇ ਨਾਲ-ਨਾਲ ਸ਼ਾਬਦਿਕ ਕੀਵਰਡਸ ਦੀ ਸੂਚੀ ਬਣਾਓ। ਉਦੇਸ਼ ਖੋਜ ਦਾਇਰੇ ਦਾ ਵਿਸਤਾਰ ਕਰਨਾ ਹੈ; ਹਰੇਕ ਸ਼ਬਦ ਨੂੰ ਸ਼੍ਰੇਣੀਬੱਧ ਕਰੋ।

3) ਸਮੱਗਰੀ ਕਲੱਸਟਰਿੰਗ:

ਮੈਂ ਤੁਹਾਨੂੰ ਦਸਤਾਵੇਜ਼ ਦੇ ਸਿਰਲੇਖ/ਸਾਰਾਂਸ਼ ਦੇਵਾਂਗਾ। ਉਹਨਾਂ ਨੂੰ ਅਰਥਪੂਰਨ ਥੀਮਾਂ (ਵਿੱਤੀ, ਐਚਆਰ, ਤਕਨੀਕੀ, ਕਾਨੂੰਨੀ, ਨਿੱਜੀ) ਵਿੱਚ ਸਮੂਹ ਕਰੋ ਅਤੇ ਹਰੇਕ ਦਸਤਾਵੇਜ਼ ਲਈ ਥੀਮ + ਸੰਖੇਪ ਤਰਕ ਦਿਓ। "ਅਸਪਸ਼ਟ" ਕਲੱਸਟਰ ਨੂੰ ਵੱਖਰੇ ਤੌਰ 'ਤੇ ਚਿੰਨ੍ਹਿਤ ਕਰੋ ਜੋ ਤੁਸੀਂ ਥੀਮ ਵਿੱਚ ਫਿੱਟ ਨਹੀਂ ਹੋ ਸਕਦੇ; ਇਸ ਕਲੱਸਟਰ ਨੂੰ ਛੱਡਿਆ ਨਹੀਂ ਜਾਵੇਗਾ, ਇਸਦੀ ਦਸਤੀ ਜਾਂਚ ਕੀਤੀ ਜਾਵੇਗੀ।

4) ਖਾਤਮੇ ਤੋਂ ਬਾਅਦ ਦੀ ਤਰਜੀਹ ਰਿਪੋਰਟ:

ਜਾਣੀਆਂ ਚੰਗੀਆਂ (NSRL) ਅਤੇ ਡੁਪਲੀਕੇਟ ਫਾਈਲਾਂ ਨੂੰ ਖਤਮ ਕੀਤਾ ਜਾਂਦਾ ਹੈ. ਬਾਕੀ ਬਚੀਆਂ ਵਿਲੱਖਣ ਉਪਭੋਗਤਾ ਫਾਈਲਾਂ ਲਈ: ਜਾਂਚ ਦੇ ਵਿਸ਼ੇ ਦੇ ਅਨੁਸਾਰ ਉੱਚ/ਮੱਧਮ/ਘੱਟ ਤਰਜੀਹ ਨਿਰਧਾਰਤ ਕਰੋ ਅਤੇ ਜਾਇਜ਼ਤਾ ਲਿਖੋ। ਐਕਸਟੈਂਸ਼ਨ-ਸਮੱਗਰੀ ਬੇਮੇਲ, ਏਨਕ੍ਰਿਪਟਡ/ਪਾਸਵਰਡ ਫਾਈਲਾਂ ਅਤੇ ਫਾਈਲਾਂ ਜੋ ਪਿਛਲੇ 30 ਦਿਨਾਂ ਵਿੱਚ ਬਦਲੀਆਂ ਹਨ ਨੂੰ ਵੀ ਉਜਾਗਰ ਕੀਤਾ ਗਿਆ ਹੈ।

ਕਮਜ਼ੋਰ ਪ੍ਰੋਂਪਟ / ਮਜ਼ਬੂਤ ਪ੍ਰੋਂਪਟ

ਕਮਜ਼ੋਰ ਪ੍ਰੋਂਪਟ:

ਇਸ ਡੇਟਾ ਵਿੱਚ ਮਹੱਤਵਪੂਰਨ ਫਾਈਲਾਂ ਲੱਭੋ.

ਵਿਸ਼ੇ, ਦਾਇਰੇ ਅਤੇ ਤਰਜੀਹ ਦਾ ਕੋਈ ਤਰਕ ਨਹੀਂ ਹੈ; AI "ਮਹੱਤਵਪੂਰਨ" ਦੀ ਆਪਣੀ ਪਰਿਭਾਸ਼ਾ ਦੁਆਰਾ ਮਹੱਤਵਪੂਰਣ ਸਮੱਗਰੀ ਨੂੰ ਗੁਆ ਸਕਦਾ ਹੈ।

ਸ਼ਕਤੀਸ਼ਾਲੀ ਪ੍ਰਾਉਟ:

ਤੁਹਾਡੀ ਭੂਮਿਕਾ: ਫੋਰੈਂਸਿਕ ਟ੍ਰਾਈਜ ਐਨਾਲਿਸਟ। ਜਾਂਚ: ਇੱਕ ਕਰਮਚਾਰੀ ਨੇ ਜਾਣ ਤੋਂ ਪਹਿਲਾਂ ਕਥਿਤ ਤੌਰ 'ਤੇ ਗਾਹਕਾਂ ਦੀ ਸੂਚੀ ਲੀਕ ਕੀਤੀ। ਮੈਂ ਤੁਹਾਨੂੰ ਫਾਈਲ ਮੈਟਾਡੇਟਾ (ਨਾਮ, ਆਕਾਰ, ਮਿਤੀ, ਐਕਸਟੈਂਸ਼ਨ, ਮਾਰਗ) ਅਤੇ ਸੰਖੇਪ ਸਮੱਗਰੀ ਦੇ ਸਾਰ ਪ੍ਰਦਾਨ ਕਰਾਂਗਾ। ਕਾਰਜ: ਗਾਹਕ ਡੇਟਾ, ਨਿਰਯਾਤ/ਪੁਰਾਲੇਖ, ਕਲਾਉਡ ਅਪਲੋਡ ਟਰੇਸ, USB/ਬਾਹਰੀ ਡਿਸਕ, ਅਤੇ ਪਿਛਲੇ 60 ਦਿਨਾਂ ਵਿੱਚ ਬਦਲੀਆਂ ਗਈਆਂ ਫਾਈਲਾਂ ਨੂੰ ਉੱਚ ਤਰਜੀਹ ਵਜੋਂ ਚਿੰਨ੍ਹਿਤ ਕਰੋ; ਹਰੇਕ ਫੈਸਲੇ ਦੇ ਕਾਰਨ ਲਿਖੋ। ਇਹ ਨਾ ਕਹੋ ਕਿ ਕਿਸੇ ਵੀ ਕਲੱਸਟਰ ਦੀ ਜਾਂਚ ਨਹੀਂ ਕੀਤੀ ਜਾ ਸਕਦੀ; ਬਸ ਕ੍ਰਮਬੱਧ. ਅਨਿਸ਼ਚਿਤਤਾਵਾਂ ਨੂੰ ਵੱਖਰੇ ਤੌਰ 'ਤੇ ਸੂਚੀਬੱਧ ਕਰੋ।

ਠੋਸ ਵਿਸ਼ਾ, ਨਿਸ਼ਾਨਾ ਮਾਪਦੰਡ, ਅਤੇ "ਨੋ-ਸਮੀਖਿਆ" ਰੁਕਾਵਟ ਆਉਟਪੁੱਟ ਨੂੰ ਕੁਸ਼ਲ ਅਤੇ ਸੁਰੱਖਿਅਤ ਬਣਾਉਂਦੀ ਹੈ।

ਤ੍ਰਿਏਜ ਵਿਧੀਆਂ ਦੀ ਤੁਲਨਾ ਸਾਰਣੀ

ਵਿਧੀ

ਕੀ ਕਰਦਾ ਹੈ

ਮਜ਼ਬੂਤ ਬਿੰਦੂ

ਖਤਰਾ

ਹੈਸ਼ ਐਲੀਮੀਨੇਸ਼ਨ (NSRL)

ਜਾਣੀ-ਪਛਾਣੀ ਫਾਈਲ ਅਲਾਟ ਕਰਦਾ ਹੈ

ਬਹੁਤ ਤੇਜ਼, ਸਟੀਕ

ਸੋਧੀ ਹੋਈ ਫ਼ਾਈਲ ਬਚ ਜਾਂਦੀ ਹੈ

ਡੀ-ਡੁਪਲੀਕੇਸ਼ਨ

ਇਕ-ਇਕ ਕਰਕੇ ਨਕਲ ਕਰਦਾ ਹੈ

ਮਨੁੱਖੀ ਸ਼ਕਤੀ ਦੀ ਬਚਤ

ਨਜ਼ਦੀਕੀ ਕਾਪੀ ਨੂੰ ਛੱਡ ਸਕਦਾ ਹੈ

ਕੀਵਰਡ

ਸਹੀ ਸ਼ਬਦਾਂ ਦੀ ਖੋਜ ਕਰਦਾ ਹੈ

ਸਰਲ, ਆਡਿਟ ਕਰਨ ਯੋਗ

ਅਪ੍ਰਤੱਖ ਬਿਆਨ ਤੋਂ ਖੁੰਝ ਜਾਂਦਾ ਹੈ

ਅਰਥ ਖੋਜ (AI)

ਅਰਥ ਵਿਚ ਸਭ ਤੋਂ ਨੇੜੇ ਲੱਭਦਾ ਹੈ

ਅਪ੍ਰਤੱਖ ਸਮੱਗਰੀ ਨੂੰ ਕੈਪਚਰ ਕਰਦਾ ਹੈ

ਝੂਠੇ ਸਕਾਰਾਤਮਕ ਪੈਦਾ ਕਰਦਾ ਹੈ

ਸਮੱਗਰੀ ਕਲੱਸਟਰਿੰਗ (AI)

ਥੀਮਾਂ ਵਿੱਚ ਵੰਡਦਾ ਹੈ

ਸੰਖੇਪ ਜਾਣਕਾਰੀ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ

ਗਲਤ ਥੀਮ ਦਾ ਖਤਰਾ

ਆਮ ਗਲਤੀਆਂ

  • ਖਾਤਮੇ ਲਈ ਗਲਤੀ ਨਾਲ ਟ੍ਰਾਈਜ. ਘੱਟ ਤਰਜੀਹ "ਸਮੀਖਿਆ ਲਈ ਨਹੀਂ" ਨਹੀਂ ਹੈ; ਨਮੂਨਾ ਜ਼ਰੂਰੀ ਹੈ।
  • ਹੈਸ਼ ਦੇ ਖਾਤਮੇ ਵਿੱਚ ਪੂਰਾ ਭਰੋਸਾ। ਇੱਕ ਸਿੰਗਲ ਬਿੱਟ ਬਦਲਾਅ ਹੈਸ਼ ਨੂੰ ਬਦਲਦਾ ਹੈ; ਨਾਜ਼ੁਕ ਕੇਸ ਲਈ ਪੂਰੇ ਸਕੈਨ ਦੀ ਲੋੜ ਹੋ ਸਕਦੀ ਹੈ।
  • ਸਿਰਫ਼ ਕੀਵਰਡ 'ਤੇ ਭਰੋਸਾ ਕਰਨਾ. ਅਪ੍ਰਤੱਖ ਅਤੇ ਕੋਡਿਡ ਸਟੇਟਮੈਂਟਾਂ ਤੋਂ ਬਚਣਾ; ਅਰਥ ਖੋਜ ਨਾਲ ਪੂਰਾ ਕਰੋ।
  • ਅਰਥ ਖੋਜ ਦੇ ਝੂਠੇ ਸਕਾਰਾਤਮਕ ਦੀ ਪੁਸ਼ਟੀ ਨਹੀਂ ਕਰਨਾ. AI ਅਪ੍ਰਸੰਗਿਕ ਦਸਤਾਵੇਜ਼ ਨੂੰ "ਸੰਬੰਧਿਤ" ਵਜੋਂ ਦਿਖਾ ਸਕਦਾ ਹੈ; ਪੜ੍ਹੋ ਅਤੇ ਪੁਸ਼ਟੀ ਕਰੋ।
  • ਟ੍ਰਾਈਏਜ ਤਰਕ ਨੂੰ ਦਸਤਾਵੇਜ਼ ਬਣਾਉਣ ਵਿੱਚ ਅਸਫਲਤਾ। ਅਦਾਲਤ ਵਿੱਚ "ਤੁਸੀਂ ਇਸ ਨੂੰ ਪਹਿਲਾਂ ਕਿਉਂ ਦੇਖਿਆ?" ਤੁਹਾਡੇ ਕੋਲ ਸਵਾਲ ਦਾ ਜਵਾਬ ਹੋਣਾ ਚਾਹੀਦਾ ਹੈ।

ਸੰਖੇਪ ਵਿੱਚ

ਬਿਗ ਡੇਟਾ ਟ੍ਰਾਈਜ ਸਬੂਤ ਦੀ ਸਭ ਤੋਂ ਵੱਧ ਸੰਭਾਵਨਾ ਲਈ ਸੀਮਤ ਸਮੇਂ ਨੂੰ ਨਿਰਦੇਸ਼ਿਤ ਕਰਨ ਦਾ ਅਨੁਸ਼ਾਸਨ ਹੈ - ਕਿਸੇ ਵੀ ਚੀਜ਼ ਨੂੰ ਨਾ ਮਿਟਾਉਣ ਦੁਆਰਾ, ਸਿਰਫ਼ ਆਰਡਰ ਨੂੰ ਨਿਰਧਾਰਤ ਕਰਕੇ। AI; ਇਹ ਸਿਮੈਂਟਿਕ ਖੋਜ, ਸਮਗਰੀ ਕਲੱਸਟਰਿੰਗ, ਟੋਨ ਮਾਰਕਿੰਗ ਅਤੇ ਖਾਤਮੇ ਤੋਂ ਬਾਅਦ ਤਰਜੀਹ ਵਿੱਚ ਬਹੁਤ ਵਧੀਆ ਗਤੀ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਪਰ ਮਾਹਰ ਹੈਸ਼ ਦੇ ਖਾਤਮੇ ਦੀਆਂ ਸੀਮਾਵਾਂ, ਝੂਠੇ ਸਕਾਰਾਤਮਕ/ਨਕਾਰਾਤਮਕ ਦੇ ਜੋਖਮ, ਅਤੇ "ਘੱਟ ਤਰਜੀਹ ਬੇਲੋੜੀ ਨਹੀਂ ਹੈ" ਦੇ ਸਿਧਾਂਤ ਦੀ ਪਾਲਣਾ ਕਰਦਾ ਹੈ। ਤਰਕਸੰਗਤ ਫੈਸਲਿਆਂ ਦਾ ਦਸਤਾਵੇਜ਼ੀਕਰਨ ਕਰਨਾ ਅਦਾਲਤ ਵਿੱਚ ਨਤੀਜੇ ਨੂੰ ਬਚਾਅ ਯੋਗ ਬਣਾਉਂਦਾ ਹੈ।

ਐਪਲੀਕੇਸ਼ਨ ਦਾ ਕੰਮ

30-40 ਲਾਈਨਾਂ ਦੀ ਇੱਕ ਨਮੂਨਾ ਫਾਈਲ ਮੈਟਾਡੇਟਾ ਸੂਚੀ (ਨਾਮ, ਆਕਾਰ, ਮਿਤੀ, ਐਕਸਟੈਂਸ਼ਨ, ਸੰਖੇਪ ਸਾਰ) ਤਿਆਰ ਕਰੋ; ਇਸ ਵਿੱਚ ਕੁਝ "ਗੁੰਮਰਾਹਕੁੰਨ" ਫਾਈਲਾਂ ਪਾਓ (ਗਲਤ ਫੋਲਡਰ ਵਿੱਚ ਨਾਜ਼ੁਕ ਦਸਤਾਵੇਜ਼, ਬਦਲੀ ਹੋਈ ਐਕਸਟੈਂਸ਼ਨ ਵਾਲੀ ਫਾਈਲ)। "ਪੋਸਟ-ਐਲੀਮੀਨੇਸ਼ਨ ਪ੍ਰਾਥਮਿਕਤਾ ਰਿਪੋਰਟ" ਟੈਮਪਲੇਟ ਨਾਲ ਤਰਜੀਹ ਦਿਓ, ਫਿਰ ਘੱਟ-ਪ੍ਰਾਥਮਿਕਤਾ ਵਾਲੇ ਕਲੱਸਟਰ ਤੋਂ ਘੱਟੋ-ਘੱਟ 15% ਦਾ ਨਮੂਨਾ ਇਹ ਦੇਖਣ ਲਈ ਕਿ ਕੀ AI ਨੇ ਕੁਝ ਖੁੰਝਾਇਆ ਹੈ।

ਚੈੱਕਲਿਸਟ

  • [ ] ਮੈਂ ਪਹਿਲ ਦੇ ਤੌਰ 'ਤੇ ਟ੍ਰਾਈਜ ਸਥਾਪਤ ਕੀਤਾ; ਮੈਂ ਕਿਸੇ ਕਲੱਸਟਰ ਨੂੰ ਰੱਦ ਨਹੀਂ ਕੀਤਾ।
  • [ ] ਮੈਂ ਇਸ ਦੀਆਂ ਸੀਮਾਵਾਂ ਨੂੰ ਧਿਆਨ ਵਿੱਚ ਰੱਖਦੇ ਹੋਏ, ਹੈਸ਼ ਇਲੀਮੀਨੇਸ਼ਨ ਅਤੇ ਡੀ-ਡੁਪਲੀਕੇਸ਼ਨ ਨਾਲ ਸ਼ੋਰ ਨੂੰ ਘਟਾ ਦਿੱਤਾ ਹੈ।
  • [ ] ਮੈਂ ਅਰਥ ਖੋਜ ਦੇ ਨਾਲ ਕੀਵਰਡ ਨੂੰ ਪੂਰਾ ਕੀਤਾ ਹੈ।
  • [ ] ਮੈਂ ਸਿਮੈਂਟਿਕ/ਕਲੱਸਟਰਿੰਗ ਆਉਟਪੁੱਟ ਦੇ ਝੂਠੇ ਸਕਾਰਾਤਮਕ ਦੀ ਦਸਤੀ ਪੁਸ਼ਟੀ ਕੀਤੀ ਹੈ।
  • [ ] ਮੈਂ ਟ੍ਰਾਈਏਜ ਦੇ ਫੈਸਲਿਆਂ ਅਤੇ ਉਹਨਾਂ ਦੇ ਉਚਿਤ ਹੋਣ ਦਾ ਦਸਤਾਵੇਜ਼ੀਕਰਨ ਕੀਤਾ ਹੈ।