ಘಟಕ 10 / 12

ಸುರಕ್ಷಿತ ಬಳಕೆ: ಸೋರಿಕೆ-ಮುಕ್ತ ಮತ್ತು ಗೌಪ್ಯತೆ

ಲಾಭಗಳು:

  • ರಹಸ್ಯಗಳು, ವೈಯಕ್ತಿಕ ಡೇಟಾ ಮತ್ತು ಗೌಪ್ಯ ವ್ಯಾಪಾರ ಸ್ವತ್ತುಗಳನ್ನು ಹೊಂದಿರುವ ಡೇಟಾವನ್ನು ವರ್ಗೀಕರಿಸುವ ಸಾಮರ್ಥ್ಯ ಮತ್ತು ಕೆಂಪು ರೇಖೆಗಳನ್ನು ಗುರುತಿಸುವುದು
  • ಡೇಟಾವನ್ನು ನಮೂದಿಸುವ ಮೊದಲು ಸಿಂಥೆಟಿಕ್ ಡೇಟಾದೊಂದಿಗೆ ಮರೆಮಾಚುವಿಕೆ, ಅನಾಮಧೇಯಗೊಳಿಸುವಿಕೆ ಮತ್ತು ಸುರಕ್ಷಿತಗೊಳಿಸುವಿಕೆ
  • ಅನುಮೋದಿತ ಉಪಕರಣದ ಆಯ್ಕೆ, ಸಂದರ್ಭ ಕಡಿಮೆಗೊಳಿಸುವಿಕೆ ಮತ್ತು ಸೋರಿಕೆಯ ಸಂದರ್ಭದಲ್ಲಿ ಕೀ ತಿರುಗುವಿಕೆ ಪ್ರತಿಫಲಿತವನ್ನು ಅನ್ವಯಿಸುವ ಸಾಮರ್ಥ್ಯ

ಕೋಡಿಂಗ್ ಅಸಿಸ್ಟೆಂಟ್‌ನಲ್ಲಿ ನೀವು ಅಂಟಿಸಿರುವ ಯಾವುದೇ ವಿಷಯವು ನಿಮ್ಮ ನಿಯಂತ್ರಣದಿಂದ ಹೊರಗಿರುತ್ತದೆ. API ಕೀ, ಗ್ರಾಹಕರ ಡೇಟಾಬೇಸ್ ಡಂಪ್, ಇನ್ನೂ ಘೋಷಿಸಬೇಕಾದ ಸ್ವಾಮ್ಯದ ಮೂಲ ಕೋಡ್ ಅಥವಾ ರೋಗಿಯ ದಾಖಲೆ - ಇವುಗಳು ಅನುಮೋದಿತವಲ್ಲದ ಸಾಧನಕ್ಕೆ ಪ್ರವೇಶಿಸಿದಾಗ ಬದಲಾಯಿಸಲಾಗದ ಸೋರಿಕೆಯಾಗಬಹುದು. ಸಾಫ್ಟ್‌ವೇರ್ ತಂಡಗಳಿಗೆ AI ಯ ದೊಡ್ಡ ಅಪಾಯವು ಲೈನ್ ದೋಷದಿಂದಲ್ಲ, ಆದರೆ ಅಸಡ್ಡೆ ಕಾಪಿ-ಪೇಸ್ಟ್‌ನಿಂದ ಬರುತ್ತದೆ. ಈ ಘಟಕವು ಆ ಕಾಪಿ-ಪೇಸ್ಟ್ ಅನ್ನು ಸುರಕ್ಷಿತವಾಗಿರಿಸುತ್ತದೆ.

ಇಲ್ಲಿ ನಾವು ಮೂರು ವಿಷಯಗಳನ್ನು ಪ್ರತ್ಯೇಕಿಸುತ್ತೇವೆ: ಯಾವ ಡೇಟಾವನ್ನು ಎಂದಿಗೂ ನಮೂದಿಸಬಾರದು, ಯಾವ ಸಾಧನಗಳನ್ನು ಯಾವ ಸುರಕ್ಷತೆಗಳೊಂದಿಗೆ ಬಳಸಬಹುದು ಮತ್ತು ಅದನ್ನು ನಮೂದಿಸುವ ಮೊದಲು ಡೇಟಾವನ್ನು ಹೇಗೆ ಸುರಕ್ಷಿತಗೊಳಿಸುವುದು (ಮರೆಮಾಚುವಿಕೆ, ಸಿಂಥೆಟಿಕ್ ಡೇಟಾ, ಸ್ಥಳೀಯವಾಗಿ ಕೆಲಸ ಮಾಡುವುದು). ಇದು ಐಚ್ಛಿಕ "ಇದು ಚೆನ್ನಾಗಿರುತ್ತದೆ" ಅಲ್ಲ; ಹೆಚ್ಚಿನ ಸಂಸ್ಥೆಗಳಲ್ಲಿ ಇದು ಒಪ್ಪಂದದ ಮತ್ತು ಕಾನೂನು ಬಾಧ್ಯತೆಯಾಗಿದೆ.

ಏಕೆ ಇದು ತುಂಬಾ ವಿಮರ್ಶಾತ್ಮಕವಾಗಿದೆ?

ನೀವು AI ಉಪಕರಣಕ್ಕೆ ಕಳುಹಿಸುವ ಡೇಟಾ; ಒದಗಿಸುವವರ ಸರ್ವರ್‌ಗಳಲ್ಲಿ ಸಂಸ್ಕರಿಸಲಾಗುತ್ತದೆ, ಕೆಲವೊಮ್ಮೆ ಸಮಯದವರೆಗೆ ಸಂಗ್ರಹಿಸಲಾಗುತ್ತದೆ, ಕೆಲವು ಉತ್ಪನ್ನ ಸೆಟ್ಟಿಂಗ್‌ಗಳಲ್ಲಿ ಮಾದರಿಯನ್ನು ಸುಧಾರಿಸಲು ಬಳಸಬಹುದು. "ನಾನು ಚಾಟ್ ಅನ್ನು ಅಳಿಸಿದ್ದೇನೆ" ಎಂದು ಹೇಳುವುದು ಸಾಮಾನ್ಯವಾಗಿ ಸಾಕಾಗುವುದಿಲ್ಲ; ಡೇಟಾ ನೆಟ್‌ವರ್ಕ್‌ನಿಂದ ಹೊರಬಂದ ಕ್ಷಣ, ಅಪಾಯವು ಉದ್ಭವಿಸುತ್ತದೆ. ಇದಲ್ಲದೆ, ಸೋರಿಕೆಯ ವೆಚ್ಚವು ಹೆಚ್ಚು: ಸೋರಿಕೆಯಾದ ಕ್ಲೌಡ್ ಕೀಯನ್ನು ನಿಮಿಷಗಳಲ್ಲಿ ದುರುಪಯೋಗಪಡಿಸಿಕೊಳ್ಳಬಹುದು, ಸೋರಿಕೆಯಾದ ಗ್ರಾಹಕರ ಡೇಟಾವು KVKK/GDPR ನಂತಹ ನಿಯಮಗಳ ಅಡಿಯಲ್ಲಿ ಅಧಿಸೂಚನೆ ಮತ್ತು ದಂಡಗಳಿಗೆ ಕಾರಣವಾಗಬಹುದು ಮತ್ತು ಸೋರಿಕೆಯಾದ ಖಾಸಗಿ ಮೂಲ ಕೋಡ್ ಸ್ಪರ್ಧಾತ್ಮಕ ಪ್ರಯೋಜನವನ್ನು ನಾಶಪಡಿಸುತ್ತದೆ.

ಆದ್ದರಿಂದ ಹೆಬ್ಬೆರಳಿನ ನಿಯಮವು ಸರಳವಾಗಿದೆ: ನೀವು ಕಳೆದುಕೊಳ್ಳಲು ಸಾಧ್ಯವಾಗದ ಯಾವುದನ್ನೂ ಅನುಮೋದಿಸದ ವಾಹನಕ್ಕೆ ನಮೂದಿಸಬೇಡಿ. ಸಂದೇಹವಿದ್ದರೆ, ನಮೂದಿಸಬೇಡಿ.

ಎಚ್ಚರಿಕೆ: "ಕೇವಲ ಒಮ್ಮೆ, ತ್ವರಿತವಾಗಿ" ಮನಸ್ಥಿತಿಯು ಸೋರಿಕೆಗೆ ಸಾಮಾನ್ಯ ಕಾರಣವಾಗಿದೆ. ತುರ್ತು ದೋಷವನ್ನು ಪರಿಹರಿಸುವಾಗ ಉತ್ಪಾದನಾ ಲಾಗ್ ಅಥವಾ ಕಾನ್ಫಿಗರೇಶನ್ ಫೈಲ್ ಅನ್ನು ಅಂಟಿಸುವುದು ಒತ್ತಡದಲ್ಲಿ ಮಾಡಿದ ಅಂತಹ ನಿರ್ಧಾರಗಳೊಂದಿಗೆ ನಿಖರವಾಗಿ ಏನಾಗುತ್ತದೆ. ತುರ್ತು ಗೌಪ್ಯತೆಯ ನಿಯಮವನ್ನು ಅಮಾನತುಗೊಳಿಸುವುದಿಲ್ಲ.

ಯಾವುದನ್ನು ಎಂದಿಗೂ ನಮೂದಿಸಬಾರದು (ಕೆಂಪು ಗೆರೆ)

  • ರಹಸ್ಯಗಳು: API ಕೀಗಳು, ಪಾಸ್‌ವರ್ಡ್‌ಗಳು, ಕ್ಲೌಡ್ ಪ್ರವೇಶ ಕೀಗಳು, ಖಾಸಗಿ ಪ್ರಮಾಣಪತ್ರಗಳು, ಟೋಕನ್‌ಗಳು, ಸಂಪರ್ಕ ತಂತಿಗಳು.
  • ವೈಯಕ್ತಿಕ ಡೇಟಾ (PII): ಹೆಸರು-ಉಪನಾಮ, TR ID ಸಂಖ್ಯೆ, ಇ-ಮೇಲ್, ದೂರವಾಣಿ, ವಿಳಾಸ, ಆರೋಗ್ಯ/ಹಣಕಾಸಿನ ದಾಖಲೆಗಳು, ಗ್ರಾಹಕರ ಡೇಟಾ.
  • ಗೌಪ್ಯ ವ್ಯಾಪಾರ ಸ್ವತ್ತುಗಳು: ಬಹಿರಂಗಪಡಿಸದ ಮೂಲ ಕೋಡ್, ಸ್ವಾಮ್ಯದ ಅಲ್ಗಾರಿದಮ್‌ಗಳು, ಆಂತರಿಕ ವಾಸ್ತುಶಿಲ್ಪದ ರಹಸ್ಯಗಳು, ಒಪ್ಪಂದದ ವಿವರಗಳು.
  • ನಿಯಂತ್ರಿತ ಡೇಟಾ: ಆರೋಗ್ಯ ರಕ್ಷಣೆ, ಪಾವತಿ ಕಾರ್ಡ್ (PCI), ವೈಯಕ್ತಿಕ ಹಣಕಾಸು ಮುಂತಾದ ವಿಶೇಷ ಸಂರಕ್ಷಿತ ವಿಭಾಗಗಳು.

ಹಂತ ಹಂತವಾಗಿ: ಸುರಕ್ಷಿತ ಬಳಕೆಯ ಹರಿವು

  1. ಡೇಟಾವನ್ನು ವರ್ಗೀಕರಿಸಿ. ನೀವು ಯಾವ ವರ್ಗವನ್ನು ಹೊಂದಿದ್ದೀರಿ - ಸಾರ್ವಜನಿಕ, ಆಂತರಿಕ, ಗೌಪ್ಯ, ನಿಯಂತ್ರಿತ?
  2. ವರ್ಗದ ಪ್ರಕಾರ ವಾಹನವನ್ನು ಆಯ್ಕೆಮಾಡಿ. ಗೌಪ್ಯ/ನಿಯಂತ್ರಿತ ಡೇಟಾವನ್ನು ಸಾಂಸ್ಥಿಕವಾಗಿ ಅನುಮೋದಿಸಿದ ಪರಿಕರಗಳಲ್ಲಿ ಮಾತ್ರ ಪ್ರಕ್ರಿಯೆಗೊಳಿಸಲಾಗುತ್ತದೆ ಅದು ಡೇಟಾ ಭರವಸೆಯನ್ನು ಒದಗಿಸುತ್ತದೆ (ಶಿಕ್ಷಣದಲ್ಲಿ ಬಳಕೆಯಾಗದಿರುವುದು, ಧಾರಣ ಮಿತಿ, ಪ್ರಾದೇಶಿಕ ಪ್ರಕ್ರಿಯೆ).
  3. ಪ್ರವೇಶಿಸುವ ಮೊದಲು ಸುರಕ್ಷಿತಗೊಳಿಸಿ. ಸ್ಟ್ರಿಪ್ ಸೀಕ್ರೆಟ್ಸ್, ಮಾಸ್ಕ್/ಅನಾಮಧೇಯ PII, ಸಾಧ್ಯವಾದರೆ ನೈಜ ಬದಲಿಗೆ ಸಿಂಥೆಟಿಕ್ (ತಯಾರಿಸಿದ ಆದರೆ ವಾಸ್ತವಿಕ) ಡೇಟಾವನ್ನು ಬಳಸಿ.
  4. ಸಂದರ್ಭವನ್ನು ಕಡಿಮೆ ಮಾಡಿ. ಸೂಕ್ಷ್ಮ ಭಾಗಗಳನ್ನು ಒಳಗೊಂಡಿರದ ಚಿಕ್ಕ ಪುನರುತ್ಪಾದಕ ಉದಾಹರಣೆಗೆ ನಿಮ್ಮ ಸಮಸ್ಯೆಯನ್ನು ಕಡಿಮೆ ಮಾಡಿ.
  5. ಔಟ್ಪುಟ್ ಅನ್ನು ಸಹ ಪರಿಶೀಲಿಸಿ. AI ನಿಂದ ರಚಿಸಲಾದ ಕೋಡ್‌ನಲ್ಲಿ ಯಾವುದೇ ಹಾರ್ಡ್‌ಕೋಡ್ ರಹಸ್ಯ ಅಥವಾ ನಿಮ್ಮ ಡೇಟಾದ ಅವಶೇಷವಿಲ್ಲ ಎಂಬುದನ್ನು ಪರಿಶೀಲಿಸಿ.

ಮೂರು ಮಿನಿ ಪ್ರಕರಣಗಳು

ಪ್ರಕರಣ 1 - ಅಂಟಿಸಿದ ಕೀಯನ್ನು ರದ್ದುಗೊಳಿಸಲಾಗಿದೆ. ದೋಷವನ್ನು ಸರಿಪಡಿಸುವಾಗ ಡೆವಲಪರ್ ಸಂಪೂರ್ಣ ಕಾನ್ಫಿಗರೇಶನ್ ಫೈಲ್ ಅನ್ನು AI ಗೆ ಅಂಟಿಸಿದ್ದಾರೆ; ಫೈಲ್ ಲೈವ್ ಥರ್ಡ್-ಪಾರ್ಟಿ API ಕೀಯನ್ನು ಒಳಗೊಂಡಿದೆ. ತಂಡವು ಗಮನಿಸಿದಾಗ, ಅವರು ತಕ್ಷಣವೇ ಕೀಲಿಯನ್ನು ರದ್ದುಗೊಳಿಸಿದರು (ತಿರುಗಿಸಿದರು) ಮತ್ತು ಹೊಸದನ್ನು ಉತ್ಪಾದಿಸಿದರು; ಯಾವುದೇ ನಿಂದನೆ ಇಲ್ಲ, ಆದರೆ ಇದು 'ಅಗ್ಗದ' ಘಟನೆಯಾಗಿದೆ. ಪಾಠ: ಅಂಟಿಸುವ ಮೊದಲು ಮೆರುಗು ತೆಗೆದುಹಾಕಿ - ಮತ್ತು ಅದು ಸೋರಿಕೆಯಾಗಿದ್ದರೆ ತಕ್ಷಣ ಅದನ್ನು ತಿರುಗಿಸಿ.

ಪ್ರಕರಣ 2 - ಸಿಂಥೆಟಿಕ್ ಡೇಟಾ ವ್ಯಾಪಾರವನ್ನು ಉಳಿಸಿದೆ. ಒಂದು ತಂಡವು ನಿಜವಾದ ಗ್ರಾಹಕರ ದಾಖಲೆಗಳೊಂದಿಗೆ ಪಾರ್ಸಿಂಗ್ ದೋಷವನ್ನು ಎದುರಿಸುತ್ತಿದೆ. ನೈಜ ಡೇಟಾವನ್ನು ನಮೂದಿಸುವ ಬದಲು, ಅವರು ಅದೇ ರಚನೆಯೊಂದಿಗೆ 20 ಸಾಲುಗಳ ಸಿಂಥೆಟಿಕ್ ಡೇಟಾವನ್ನು ಉತ್ಪಾದಿಸಿದರು ಆದರೆ ಸಂಪೂರ್ಣವಾಗಿ ನಕಲಿ, ಅದರೊಂದಿಗೆ ದೋಷವನ್ನು ಪುನರುತ್ಪಾದಿಸಿದರು ಮತ್ತು ಅದನ್ನು AI ಯೊಂದಿಗೆ ಪರಿಹರಿಸಿದರು. PII ಸೋರಿಕೆಯಾಗಲಿಲ್ಲ ಅಥವಾ ರೋಗನಿರ್ಣಯವು ನಿಧಾನವಾಗಲಿಲ್ಲ; ಸಂಶ್ಲೇಷಿತ ಡೇಟಾವು ಸುರಕ್ಷಿತ ಮತ್ತು ಸಾಕಷ್ಟು ಆಗಿತ್ತು.

ಪ್ರಕರಣ 3 - ಪ್ರಿಂಟ್‌ಔಟ್‌ನಲ್ಲಿ ಗುಪ್ತ ರಹಸ್ಯ. ಮಾದರಿ ಸಂರಚನೆಯನ್ನು ರಚಿಸುವಾಗ, AI ಅದರೊಳಗೆ ವಾಸ್ತವಿಕವಾಗಿ ಕಾಣುವ "ಮಾದರಿ" ಕೀಲಿಯನ್ನು ಎಂಬೆಡ್ ಮಾಡಿತು ಮತ್ತು ಡೆವಲಪರ್ ಗಮನಿಸದೆ ಅದನ್ನು ಕೋಡ್‌ಗೆ ಪಡೆಯಿತು; ಕೋಡ್ ಬೇಸ್ ಸ್ಕ್ಯಾನರ್ (ರಹಸ್ಯ ಸ್ಕ್ಯಾನರ್) ಇದನ್ನು ಹಿಡಿದು ಎಚ್ಚರಿಸಿದೆ. ಬದಲಾಗದ ರಹಸ್ಯವನ್ನು ಎಂದಿಗೂ ಕೋಡ್ ಆಗಿ ಮಾಡಬಾರದು; ಪರಿಸರ ವೇರಿಯಬಲ್ ಅಥವಾ ರಹಸ್ಯ ವ್ಯವಸ್ಥಾಪಕವನ್ನು ಬಳಸುವುದು ಸರಿಯಾದ ಮಾರ್ಗವಾಗಿದೆ. ಪಾಠ: ರಹಸ್ಯಗಳಿಗಾಗಿ ಔಟ್ಪುಟ್ ಅನ್ನು ಸ್ಕ್ಯಾನ್ ಮಾಡಿ.

ನಾಲ್ಕು ನಕಲು ಮಾಡಬಹುದಾದ ಟೆಂಪ್ಲೇಟ್‌ಗಳು

ನಮೂದಿಸುವ ಮೊದಲು ಮರೆಮಾಚುವ ಪರಿಶೀಲನಾಪಟ್ಟಿ (ಸ್ವಯಂ):

AI ಗೆ ಈ ಪಠ್ಯವನ್ನು ನೀಡುವ ಮೊದಲು, ನಾನು ಈ ಕೆಳಗಿನವುಗಳನ್ನು ತೆಗೆದುಹಾಕಿದ್ದೇನೆ ಮತ್ತು ನೀವು ಕಂಡುಕೊಂಡದ್ದನ್ನು [ಮಾಸ್ಕ್ಡ್] ನೊಂದಿಗೆ ಬದಲಾಯಿಸಿದ್ದೇನೆ ಎಂದು ಖಚಿತಪಡಿಸಿಕೊಳ್ಳಿ: API ಕೀ, ಪಾಸ್‌ವರ್ಡ್, ಟೋಕನ್, ಸಂಪರ್ಕ ಸ್ಟ್ರಿಂಗ್, ಹೆಸರು-ಉಪನಾಮ, ಇಮೇಲ್, ಫೋನ್, ID ಸಂಖ್ಯೆ, ಗ್ರಾಹಕ ಡೇಟಾ. ಪಠ್ಯ:{{text}}

ಸಂಶ್ಲೇಷಿತ ಪರೀಕ್ಷಾ ಡೇಟಾ ಉತ್ಪಾದನೆ:

ಕೆಳಗಿನ ಸ್ಕೀಮ್‌ಗೆ ಅನುಗುಣವಾಗಿ ಸಂಪೂರ್ಣವಾಗಿ ಫ್ಯಾಬ್ರಿಕೇಟೆಡ್ (ನೈಜ ವ್ಯಕ್ತಿ/ಸಂಸ್ಥೆಗೆ ಸಂಬಂಧವಿಲ್ಲ) {{N}}ಸಾಲಿನ ಪರೀಕ್ಷಾ ಡೇಟಾವನ್ನು ರಚಿಸಿ. ಇದು ವಾಸ್ತವಿಕವಾಗಿ ಕಾಣುವಂತೆ ಮಾಡಿ, ಆದರೆ ಯಾವುದೇ ನೈಜ PII ಅನ್ನು ಬಳಸಬೇಡಿ. ಸ್ಕೀಮಾ: {{ಕ್ಷೇತ್ರಗಳು ಮತ್ತು ಪ್ರಕಾರಗಳು}}ಅಂಚಿನ ಪ್ರಕರಣಗಳನ್ನು ಒಳಗೊಂಡಿದೆ (ಖಾಲಿ, ಗಡಿ, ಕೆಟ್ಟ ಸ್ವರೂಪ).

ಸ್ಥಿರ ರಹಸ್ಯ ಬೇಟೆ (ಕೋಡ್‌ನಲ್ಲಿ):

ಈ ಕೋಡ್/ಕಾನ್ಫಿಗರೇಶನ್‌ನಲ್ಲಿ ಹಾರ್ಡ್‌ಕೋಡ್ ಮಾಡಿದ ರಹಸ್ಯವನ್ನು ನೋಡಿ: ಕೀ, ಪಾಸ್‌ವರ್ಡ್, ಟೋಕನ್, ಕಸ್ಟಮ್ URL. ನೀವು ಅದನ್ನು ಕಂಡುಕೊಂಡರೆ, ಅದರ ಸ್ಥಳವನ್ನು ಸೂಚಿಸಿ ಮತ್ತು ಸರಿಯಾದ ವಿಧಾನವನ್ನು ಸೂಚಿಸಿ (ಪರಿಸರ ವೇರಿಯಬಲ್ / ರಹಸ್ಯ ವ್ಯವಸ್ಥಾಪಕ). ಕೋಡ್:{{code}}

ವಾಹನದ ಅನುಸರಣೆ ಮೌಲ್ಯಮಾಪನ (ಡೇಟಾ ವರ್ಗದಿಂದ):

ನಾನು ಈ ಕೆಳಗಿನ ಪ್ರಕಾರದ ಡೇಟಾವನ್ನು ಹೊಂದಿದ್ದೇನೆ: {{ವರ್ಗ: ಸಾರ್ವಜನಿಕ / ಆಂತರಿಕ / ಗೌಪ್ಯ / ನಿಯಂತ್ರಿತ}}. ನಾನು ಬಳಸಲು ಉದ್ದೇಶಿಸಿರುವ ಸಾಧನ: {{tool}}. ಈ ಉಪಕರಣದಲ್ಲಿ ಈ ಡೇಟಾವನ್ನು ಪ್ರಕ್ರಿಯೆಗೊಳಿಸುವ ಮೊದಲು ನಾನು ಯಾವ ಸುರಕ್ಷತೆಗಳನ್ನು (ಸಂಗ್ರಹಣೆ, ಶಿಕ್ಷಣದಲ್ಲಿ ಬಳಸದಿರುವುದು, ಪ್ರದೇಶ, ಪ್ರವೇಶ) ದೃಢೀಕರಿಸಬೇಕು? ಪರಿಶೀಲನಾಪಟ್ಟಿ ನೀಡಿ. ನಿರ್ಧಾರ ನನ್ನದು; ನೀವು ಮಾನದಂಡವನ್ನು ಸ್ಪಷ್ಟಪಡಿಸುತ್ತೀರಿ.

ದುರ್ಬಲ ಪ್ರಾಂಪ್ಟ್ / ಬಲವಾದ ಪ್ರಾಂಪ್ಟ್

ದುರ್ಬಲ: (ಉತ್ಪಾದನಾ ಡೇಟಾಬೇಸ್‌ನಿಂದ ಎಳೆಯಲಾದ 200 ನೈಜ ಬಳಕೆದಾರರ ಸಾಲುಗಳನ್ನು ಅಂಟಿಸುವುದು) "ಈ ಡೇಟಾದಲ್ಲಿ ಪಾರ್ಸಿಂಗ್ ದೋಷ ಏಕೆ?"
ಪ್ರಬಲ: "ಕೆಳಗೆ 15 ಸಾಲುಗಳು ನೈಜ ಡೇಟಾದಂತೆಯೇ ಅದೇ ರಚನೆಯನ್ನು ಹೊಂದಿವೆ ಆದರೆ ಸಂಪೂರ್ಣವಾಗಿ ಸಿಂಥೆಟಿಕ್ (ಪಿಐಐ ಇಲ್ಲ). ಪಾರ್ಸ್_ಯೂಸರ್() ಈ ಸಾಲುಗಳ 3, 8 ಮತ್ತು 12 ರಲ್ಲಿ ವ್ಯಾಲ್ಯೂಎರರ್ ಅನ್ನು ಎಸೆಯುತ್ತದೆ. ಸಾಮಾನ್ಯ ಮಾದರಿ ಏನಾಗಿರಬಹುದು, ನಾನು ಅದನ್ನು ಹೇಗೆ ಸರಿಪಡಿಸಬಹುದು?"

ದೋಷವನ್ನು ಪುನರುತ್ಪಾದಿಸಲು ಅಗತ್ಯವಾದ ರಚನೆಯನ್ನು ಸಂರಕ್ಷಿಸುವಾಗ ಬಲವಾದ ಆವೃತ್ತಿಯು ಯಾವುದೇ ನೈಜ ವೈಯಕ್ತಿಕ ಡೇಟಾವನ್ನು ಹೊಂದಿಲ್ಲ. ರೋಗನಿರ್ಣಯವು ಒಂದೇ ಆಗಿರುತ್ತದೆ, ಅಪಾಯವನ್ನು ಮರುಹೊಂದಿಸಲಾಗಿದೆ.

ಡೇಟಾ ವರ್ಗ

ಇದನ್ನು AI ನಲ್ಲಿ ಪ್ರಕ್ರಿಯೆಗೊಳಿಸಬಹುದೇ?

ಪೂರ್ವಾಪೇಕ್ಷಿತ

ಸಾರ್ವಜನಿಕ

ಹೌದು

-

ಆಂತರಿಕ ಬಳಕೆ (ನಿಖರವಲ್ಲದ)

ಸಾಮಾನ್ಯವಾಗಿ

ಕಾರ್ಪೊರೇಟ್ ನೀತಿಯನ್ನು ಅನುಸರಿಸಿ

ಗೌಪ್ಯ (ಮೂಲ ಕೋಡ್, ವ್ಯವಹಾರ ರಹಸ್ಯ)

ಅನುಮೋದಿತ ವಾಹನ ಮಾತ್ರ

ಕಾರ್ಪೊರೇಟ್ ಭರವಸೆ + ಕಡಿಮೆಗೊಳಿಸುವಿಕೆ

PII / ನಿಯಂತ್ರಿತ

ನಿಯಮದಂತೆ ನಂ

ಮುಖವಾಡ/ಅನಾಮಧೇಯಗೊಳಿಸಿ ಅಥವಾ ಸಿಂಥೆಟಿಕ್ ಬಳಸಿ

ನೀತಿ ಅನುಸರಣೆ ಮತ್ತು ಜಾಡು

ಸುರಕ್ಷಿತ ಬಳಕೆ ಕೇವಲ ವೈಯಕ್ತಿಕ ಅಭ್ಯಾಸಕ್ಕಿಂತ ಹೆಚ್ಚಾಗಿರುತ್ತದೆ, ಇದು ಕಾರ್ಪೊರೇಟ್ ವ್ಯವಸ್ಥೆಯಾಗಿದೆ: ಯಾವ ಪರಿಕರಗಳನ್ನು ಅನುಮೋದಿಸಲಾಗಿದೆ, ಯಾವ ಡೇಟಾ ವರ್ಗ ಎಲ್ಲಿಗೆ ಹೋಗಬಹುದು ಮತ್ತು ಉಲ್ಲಂಘನೆಯ ಸಂದರ್ಭದಲ್ಲಿ ಏನು ಮಾಡಬೇಕು ಎಂಬುದನ್ನು ಲಿಖಿತ ನೀತಿಯಲ್ಲಿ ವ್ಯಾಖ್ಯಾನಿಸಬೇಕು. ಒಂದು ರಹಸ್ಯವು ಸೋರಿಕೆಯಾದರೆ, ಅತ್ಯಂತ ಪ್ರಮುಖವಾದ ಮೊದಲ ಹಂತವು ಗಾಬರಿಯಾಗುವುದು ಅಲ್ಲ, ಆದರೆ ಸೋರಿಕೆಯಾದ ರುಜುವಾತುಗಳನ್ನು ತಕ್ಷಣವೇ ಹಿಂತಿರುಗಿಸುವುದು (ರದ್ದು ಮಾಡಿ ಮತ್ತು ಹೊಸದನ್ನು ರಚಿಸುವುದು) ಮತ್ತು ಘಟನೆಯನ್ನು ವರದಿ ಮಾಡುವುದು. ನಿಮ್ಮ ಸಂಸ್ಥೆಯ ಅನುಮೋದಿತ ಪರಿಕರಗಳ ಪಟ್ಟಿ ಮತ್ತು ಡೇಟಾ ವರ್ಗೀಕರಣದ ನಿಯಮಗಳು ನಿಮಗೆ ತಿಳಿದಿಲ್ಲದಿದ್ದರೆ, ಅವುಗಳನ್ನು ಕಲಿಯುವುದು ನಿಮ್ಮ ಮೊದಲ ಕಾರ್ಯವಾಗಿದೆ.

ಸಲಹೆ: ನಿಮ್ಮ ಎಡಿಟರ್/ಸಿಎಲ್‌ಐ ಪರಿಕರದಲ್ಲಿ ಪ್ರಾಜೆಕ್ಟ್-ನಿರ್ದಿಷ್ಟ "ನಿರ್ಲಕ್ಷಿಸು" ಪಟ್ಟಿಯನ್ನು (ಉದಾ. .env, ಮರೆಮಾಡಿದ ಫೋಲ್ಡರ್‌ಗಳು, ಗುರುತಿನ ಫೈಲ್‌ಗಳು) ವಿವರಿಸಿ ಇದರಿಂದ ಈ ಫೈಲ್‌ಗಳು ಆಕಸ್ಮಿಕವಾಗಿ ಸಹಾಯಕರ ಸಂದರ್ಭದಲ್ಲಿ ಸೇರಿಕೊಳ್ಳುವುದಿಲ್ಲ. ತಡೆಗಟ್ಟುವಿಕೆ ಯಾವಾಗಲೂ ಸ್ವಚ್ಛಗೊಳಿಸುವುದಕ್ಕಿಂತ ಅಗ್ಗವಾಗಿದೆ.

ಸಾಮಾನ್ಯ ತಪ್ಪುಗಳು

  • ಸೂಕ್ಷ್ಮ ಡೇಟಾವನ್ನು "ಕೇವಲ ಒಮ್ಮೆ" ಅಂಟಿಸಲಾಗುತ್ತಿದೆ. ತುರ್ತು ಕೆಂಪು ರೇಖೆಯನ್ನು ಅಮಾನತುಗೊಳಿಸುವುದಿಲ್ಲ; ಅತ್ಯಂತ ಸಾಮಾನ್ಯವಾದ ಸೋರಿಕೆ ಇಲ್ಲಿ ಸಂಭವಿಸುತ್ತದೆ.
  • "ನಾನು ಸಂಭಾಷಣೆಯನ್ನು ಅಳಿಸುತ್ತೇನೆ" ಎಂದು ಯೋಚಿಸುತ್ತಿದ್ದೇನೆ. ಡೇಟಾ ನೆಟ್‌ವರ್ಕ್‌ನಿಂದ ನಿರ್ಗಮಿಸಿದ ಕ್ಷಣ, ಅಪಾಯ ಉಂಟಾಗುತ್ತದೆ; ಅಳಿಸುವುದರಿಂದ ಅದನ್ನು ರದ್ದುಗೊಳಿಸುವುದಿಲ್ಲ.
  • ಅದರ ವರ್ಗವನ್ನು ನೋಡದೆ ವಾಹನವನ್ನು ಆಯ್ಕೆ ಮಾಡುವುದು. ವೈಯಕ್ತಿಕ ಖಾತೆಯೊಂದಿಗೆ ಗೌಪ್ಯ ಕಾರ್ಪೊರೇಟ್ ಡೇಟಾವನ್ನು ಪ್ರಕ್ರಿಯೆಗೊಳಿಸುವುದು ಗಂಭೀರ ಉಲ್ಲಂಘನೆಯಾಗಿದೆ.
  • ಔಟ್ಪುಟ್ ಅನ್ನು ಸ್ಕ್ಯಾನ್ ಮಾಡುತ್ತಿಲ್ಲ. AI ಬದಲಾಗದ ರಹಸ್ಯವನ್ನು ಕೋಡ್‌ನಲ್ಲಿ ಎಂಬೆಡ್ ಮಾಡಬಹುದು; ರಹಸ್ಯ ಸ್ಕ್ಯಾನರ್‌ನೊಂದಿಗೆ ಉತ್ಪಾದನೆಯನ್ನು ಸಹ ಪರೀಕ್ಷಿಸಿ.
  • ರಹಸ್ಯ ಸೋರಿಕೆಯಾದಾಗ ಅದನ್ನು ತಿರುಗಿಸುವುದಿಲ್ಲ. ಸೋರಿಕೆಯಾದ ಕೀಯನ್ನು ಹಿಂತೆಗೆದುಕೊಳ್ಳದಿರುವುದು ಸೋರಿಕೆಯನ್ನು ಲೈವ್ ಶೋಷಣೆಯಾಗಿ ಪರಿವರ್ತಿಸುತ್ತದೆ.

ಸಾರಾಂಶದಲ್ಲಿ

ಸಾಫ್ಟ್‌ವೇರ್‌ನಲ್ಲಿ AI ಯ ದೊಡ್ಡ ಅಪಾಯವೆಂದರೆ ಗೌಪ್ಯತೆ ಸೋರಿಕೆ, ಮತ್ತು ಹೆಚ್ಚಿನವುಗಳು ಒತ್ತಾಯದ ಅಡಿಯಲ್ಲಿ ಮಾಡಿದ ಕಾಪಿ-ಪೇಸ್ಟ್ ನಿರ್ಧಾರದಿಂದ ಉದ್ಭವಿಸುತ್ತವೆ. ನಿಯಮವು ಸ್ಪಷ್ಟವಾಗಿದೆ: ರಹಸ್ಯಗಳು, ವೈಯಕ್ತಿಕ ಡೇಟಾ, ಗೌಪ್ಯ ವ್ಯಾಪಾರ ಸ್ವತ್ತುಗಳು ಮತ್ತು ನಿಯಂತ್ರಿತ ಡೇಟಾವನ್ನು ಅನುಮೋದಿಸದ ಸಾಧನಗಳಲ್ಲಿ ನಮೂದಿಸಲಾಗಿಲ್ಲ. ಇನ್‌ಪುಟ್‌ಗೆ ಮೊದಲು ಡೇಟಾವನ್ನು ವರ್ಗೀಕರಿಸಿ, ವರ್ಗದ ಪ್ರಕಾರ ಏಜೆಂಟ್ ಅನ್ನು ಆಯ್ಕೆ ಮಾಡಿ, ರಹಸ್ಯಗಳನ್ನು ಹೊರತೆಗೆಯಿರಿ, ಮಾಸ್ಕ್ PII ಅಥವಾ ಸಿಂಥೆಟಿಕ್ ಡೇಟಾವನ್ನು ಬಳಸಿ, ಸಂದರ್ಭವನ್ನು ಕಡಿಮೆ ಮಾಡಿ ಮತ್ತು ರಹಸ್ಯಗಳಿಗಾಗಿ ಔಟ್‌ಪುಟ್ ಅನ್ನು ಸ್ಕ್ಯಾನ್ ಮಾಡಿ. ಸೋರಿಕೆ ಇದ್ದರೆ, ಮೊದಲನೆಯದು: ರುಜುವಾತುಗಳನ್ನು ಹಿಂತಿರುಗಿಸಿ ಮತ್ತು ಅದನ್ನು ವರದಿ ಮಾಡಿ.

ಅಪ್ಲಿಕೇಶನ್ ಕಾರ್ಯ

AI ಗೆ ನೀವು ಇತ್ತೀಚೆಗೆ ನೀಡಿದ (ಅಥವಾ ನೀಡಲು ಪರಿಗಣಿಸುತ್ತಿರುವ) ಕೋಡ್/ಲಾಗ್/ಡೇಟಾದ ತುಣುಕನ್ನು ತೆಗೆದುಕೊಳ್ಳಿ. ಮೊದಲಿಗೆ, "ಮರೆಮಾಚುವ ಪರಿಶೀಲನಾಪಟ್ಟಿ" ಟೆಂಪ್ಲೇಟ್ನೊಂದಿಗೆ ರಹಸ್ಯ ಮತ್ತು PII ಅಭ್ಯರ್ಥಿಗಳನ್ನು ಗುರುತಿಸಿ. ನಂತರ, ಇದು ನೈಜ ಡೇಟಾವನ್ನು ಹೊಂದಿದ್ದರೆ, "ಸಿಂಥೆಟಿಕ್ ಟೆಸ್ಟ್ ಡೇಟಾ ಉತ್ಪಾದನೆ" ಟೆಂಪ್ಲೇಟ್‌ಗೆ ಹೋಲುವ ಆವೃತ್ತಿಯನ್ನು ಉತ್ಪಾದಿಸಿ ಆದರೆ ಸಂಪೂರ್ಣವಾಗಿ ರಚಿಸಲಾಗಿದೆ ಮತ್ತು ಅದರೊಂದಿಗೆ ನಿಮ್ಮ ಸಮಸ್ಯೆಯನ್ನು ಪುನರುತ್ಪಾದಿಸುವಂತೆ ಮಾಡಿ. ಅಂತಿಮವಾಗಿ, ನಿಮ್ಮ ಸಂಸ್ಥೆಯ ಅನುಮೋದಿತ ಪರಿಕರ ಪಟ್ಟಿ ಮತ್ತು ಡೇಟಾ ವರ್ಗೀಕರಣ ನೀತಿಯನ್ನು ಹುಡುಕಿ ಮತ್ತು ಓದಿ; ಇಲ್ಲದಿದ್ದರೆ, ಈ ಲೋಪವನ್ನು ಗಮನಿಸಿ.

ಪರಿಶೀಲನಾಪಟ್ಟಿ

  • [ ] ನಾನು ಡೇಟಾವನ್ನು ನಮೂದಿಸುವ ಮೊದಲು ಅದನ್ನು ವರ್ಗೀಕರಿಸುತ್ತೇನೆ (ತೆರೆದ/ಆಂತರಿಕ/ಗೌಪ್ಯ/ನಿಯಂತ್ರಣಕ್ಕೆ ಒಳಪಟ್ಟಿರುತ್ತದೆ).
  • [ ] ನಾನು ಎಂದಿಗೂ ರಹಸ್ಯಗಳು, PII ಮತ್ತು ಗೌಪ್ಯ ವ್ಯಾಪಾರ ಸ್ವತ್ತುಗಳನ್ನು ಅನುಮೋದಿಸದ ಸಾಧನಗಳಲ್ಲಿ ನಮೂದಿಸುವುದಿಲ್ಲ.
  • [ ] ನಾನು ನೈಜ ಡೇಟಾದ ಬದಲಿಗೆ ಸಾಧ್ಯವಾದಾಗಲೆಲ್ಲಾ ಮರೆಮಾಚುವಿಕೆ ಅಥವಾ ಸಂಶ್ಲೇಷಿತ ಡೇಟಾವನ್ನು ಬಳಸುತ್ತೇನೆ.
  • [ ] ನಾನು ಸಂದರ್ಭವನ್ನು ಸೂಕ್ಷ್ಮ ಭಾಗಗಳನ್ನು ಒಳಗೊಂಡಿರದ ಚಿಕ್ಕ ಉದಾಹರಣೆಗೆ ಕಡಿಮೆ ಮಾಡುತ್ತೇನೆ.
  • [ ] ನಾನು AI ಔಟ್‌ಪುಟ್ ಅನ್ನು ಹಾರ್ಡ್ ಸಮಾಧಿ ರಹಸ್ಯಕ್ಕಾಗಿ ಸ್ಕ್ಯಾನ್ ಮಾಡುತ್ತೇನೆ.
  • [ ] ರಹಸ್ಯವು ಸೋರಿಕೆಯಾದಲ್ಲಿ, ನಾನು ತಕ್ಷಣ ಗುರುತಿನ ಮಾಹಿತಿಯನ್ನು ಹಿಂತಿರುಗಿಸುತ್ತೇನೆ ಮತ್ತು ಘಟನೆಯನ್ನು ವರದಿ ಮಾಡುತ್ತೇನೆ ಎಂದು ನನಗೆ ತಿಳಿದಿದೆ.