লাভ:
- পরবর্তী শব্দের ভবিষ্যদ্বাণী করে বড় ভাষার মডেল কীভাবে কাজ করে এবং তাৎক্ষণিক লেখার জন্য এর অর্থ কী তা ব্যাখ্যা করুন
- তিনি দেখাতে পারেন কেন প্রম্পট তার নিজের কাজ থেকে একটি উদাহরণ দিয়ে আউটপুট গুণমান নির্ধারণ করে।
- মডেলটির শক্তি এবং দুর্বলতাগুলিকে আলাদা করে, কেউ এটিকে নিরাপদে ব্যবহার করার জন্য কোন কাজগুলি নির্ধারণ করতে পারে৷
কৃত্রিম বুদ্ধিমত্তা এবং প্রম্পটের ভূমিকা: কীভাবে মডেল "চিন্তা করে"
কিভাবে প্রম্পট লিখতে হয় তা সত্যিকারভাবে শেখার সর্বোত্তম উপায় হল টুলটি কিভাবে কাজ করে তা প্রথমে বোঝা। এই ইউনিটে, আমরা বৃহৎ ভাষার মডেলের মৌলিক যুক্তি (সংক্ষেপে এলএলএম; অর্থাৎ, কৃত্রিম বুদ্ধিমত্তা সিস্টেম যা পাঠ্য তৈরি করে), কেন এটি আপনার দৈনন্দিন কাজে এত দরকারী এবং এর সীমা কোথায় তা দেখতে পাব। এই ফাউন্ডেশন ব্যতীত লেখা প্রম্পটগুলি প্রায়শই প্রশ্নের দিকে নিয়ে যায় "কেন তারা কখনও কখনও দুর্দান্ত ফলাফল দেয় এবং কখনও কখনও ভয়ানক ফলাফল দেয়?" প্রশ্ন দিয়ে আপনাকে একা ছেড়ে দেয়। এই ইউনিটটি সম্পন্ন হলে এই অনিশ্চয়তা অনেকাংশে অদৃশ্য হয়ে যাবে।
একটি বড় ভাষার মডেল আসলে কী করে?
এর সহজ সংজ্ঞায়, বড় ভাষা মডেল হল এমন একটি সিস্টেম যা আপনার দেওয়া পাঠ্য অনুসরণ করবে এমন সম্ভাব্য শব্দের ভবিষ্যদ্বাণী করে। কোটি কোটি বাক্য পরীক্ষা করে, মডেলটি "কোন শব্দের পরে কোন শব্দ আসে" প্যাটার্ন শিখেছে। আপনি যখন একটি বাক্য শুরু করেন, তখন মডেলটি এখন পর্যন্ত যা লেখা হয়েছে তা দেখে এবং সর্বাধিক সম্ভাব্য ধারাবাহিকতা তৈরি করে, তারপরে জেনারেট করা শব্দটিকে ইনপুটে যোগ করে এবং পরবর্তীটির পূর্বাভাস দেয়। প্রতিক্রিয়া সম্পূর্ণ না হওয়া পর্যন্ত এই চক্র চলতে থাকে।
এখানে ব্যবহৃত টোকেন শব্দটি স্পষ্ট করা যাক: টোকেন হল ক্ষুদ্রতম একক যার মধ্যে মডেলটি পাঠ্যকে ভেঙে দেয়; এটি মোটামুটি একটি শব্দের আকার বা একটি শব্দের অংশ। মডেলটি কথায় কথায় নয়, টোকেন দ্বারা টোকেন করে। আপনার জন্য ব্যবহারিক পরিণতি হল মডেলটি এমন একজন মানুষ নয় যে আপনার উদ্দেশ্য "বুঝে" কিন্তু একটি অত্যন্ত শক্তিশালী ভবিষ্যদ্বাণীমূলক মেশিন যা পরিসংখ্যানগতভাবে আপনার দেওয়া পাঠ্যের জন্য সবচেয়ে উপযুক্ত ধারাবাহিকতা নির্বাচন করে।
এই সংজ্ঞার সবচেয়ে গুরুত্বপূর্ণ অন্তর্নিহিততা হল আউটপুটের দিকনির্দেশের সবচেয়ে শক্তিশালী নির্ধারক হল আপনার ইনপুট হিসাবে দেওয়া পাঠ্য। তাই আপনার প্রম্পট. মডেলটি একটি ডাটাবেস থেকে একটি রেডিমেড উত্তর আঁকে না, ইন্টারনেটে একটি লাইভ অনুসন্ধান করে না এবং পৃষ্ঠাগুলি অনুলিপি করে না (বিশেষভাবে অন্যথায় বলা না থাকলে)। এটি শুধুমাত্র এমন টেক্সট তৈরি করে যা আপনার দেওয়া প্রেক্ষাপটের সাথে সবচেয়ে উপযুক্ত। একটি ভাল ইনপুট একটি ভাল আউটপুট জন্য সবচেয়ে সিদ্ধান্তমূলক শর্ত.
কেন "একই মডেল, ভিন্ন ফলাফল"?
মডেলটি প্রতিবার সবচেয়ে সম্ভাব্য শব্দ চয়ন করার ক্ষেত্রে এলোমেলোতার একটি ছোট মার্জিন ব্যবহার করে; অতএব, আপনি যখন একই প্রম্পটকে দুইবার জিজ্ঞাসা করেন, আপনি ঠিক একই বাক্য নাও পেতে পারেন। এটি একটি বাগ নয়, এটি ডিজাইনের অংশ। আপনার কাজ হল একটি ফ্রেমওয়ার্ককে যথেষ্ট পরিস্কার করা যাতে ফলাফলটি সুযোগের কাছে না যায়। ফ্রেমওয়ার্ক যত পরিষ্কার হবে, দুটি ভিন্ন পরীক্ষার ফলাফল তত কাছাকাছি এবং আরও কার্যকর হবে।
ধাপে ধাপে: মডেলের মাধ্যমে একটি অনুরোধ কীভাবে অগ্রসর হয়?
- ইনপুট পড়ে। আপনার লেখা প্রতিটি শব্দ একটি ক্লু যা ভবিষ্যদ্বাণী নির্দেশ করে। আপনি যখন "একজন সিনিয়র আইনজীবীর মতো" বলেন, মডেলটি পাঠ্যগুলিকে সেই স্বরের কাছাকাছি করে তোলে।
- প্রসঙ্গ ওজন করে। পটভূমি, সীমাবদ্ধতা, এবং উদাহরণগুলি আপনি অনুমানকে সংকুচিত করেছেন। প্রসঙ্গ খালি থাকলে, মডেলটি তার নিজস্ব অনুমান দিয়ে শূন্যস্থান পূরণ করে।
- এটি শব্দ দ্বারা শব্দ উত্পাদন করে। প্রতিটি টোকেন এটি তৈরি করে পরেরটির জন্য ইনপুট হয়ে যায়; সুতরাং আপনি শুরুতে যে দিকনির্দেশ দিয়েছেন তা পুরো উত্তর বহন করে।
- সে থামে। কাজটি সম্পন্ন হলে বা আপনার নির্দিষ্ট করা দৈর্ঘ্যে পৌঁছালে এটি উৎপাদনে বাধা দেয়।
তিনটি মিনি কেস: সংখ্যার মধ্যে দ্রুত পার্থক্য
কেস 1 — মার্কেটিং পেশাদার, ইমেল বিষয়। যখন একজন বিপণন বিশেষজ্ঞ বলেছিলেন "প্রচারণার জন্য একটি বিষয় প্রস্তাব করুন", তিনি 5টি সাধারণ শিরোনাম পেয়েছেন এবং সেগুলির একটিও পছন্দ করেননি; তিনি 20 মিনিট হাত দিয়ে এটি সংশোধন করেছেন। পরের দিন, যখন তিনি বললেন, "লক্ষ্য শ্রোতা হল 30-45 বছর বয়সী SME মালিকরা, পণ্যটি হল ক্লাউড অ্যাকাউন্টিং সফ্টওয়্যার, 6 ইউনিট, প্রতিটিতে সর্বোচ্চ 45টি অক্ষর, কৌতূহলজনক কিন্তু ছোটখাটো," তিনি সরাসরি 6টি শিরোনামের মধ্যে 4টি ব্যবহার করেছেন৷ সময়কাল 20 মিনিট থেকে 4 মিনিটে কমেছে।
কেস 2 — মানব সম্পদ, বিজ্ঞাপনের পাঠ্য। একজন এইচআর বিশেষজ্ঞ "একটি সফ্টওয়্যার বিকাশকারী কাজ লিখুন" প্রম্পট সহ একটি বয়লারপ্লেট পাঠ্য পেয়েছেন। যখন আমরা কোম্পানির প্রকৃত ভাষা (3-বাক্য সংস্কৃতি বিবরণ), 4টি বাধ্যতামূলক যোগ্যতা এবং প্রম্পটে "বেতনের পরিসীমা স্পষ্টভাবে লিখুন" এর সীমাবদ্ধতা যুক্ত করি, তখন পরবর্তী বিজ্ঞাপনে বিজ্ঞাপনে অযোগ্য আবেদনকারীদের হার লক্ষণীয়ভাবে হ্রাস পেয়েছে কারণ পাঠ্যটি স্পষ্টভাবে প্রত্যাশাকে প্রতিষ্ঠিত করেছে।
কেস 3 — অ্যাকাউন্টিং, রিপোর্ট সারাংশ। যখন একজন অ্যাকাউন্টিং এক্সিকিউটিভ বলেছিলেন যে তিনি 12-পৃষ্ঠার ব্যয়ের প্রতিবেদন "সংক্ষিপ্ত" করেছেন, মডেলটি গুরুত্বপূর্ণ আইটেমগুলি বাদ দিয়েছে। যখন তিনি বলেন, "এই প্রতিবেদন থেকে, 5টি সর্বোচ্চ ব্যয়ের আইটেম গত মাসের তুলনায় শতাংশ পরিবর্তনের সাথে সারণী করা হয়েছে," তিনি ঠিক সেই কাঠামোটি পেয়েছিলেন যা তিনি পরিচালনার সভায় নেবেন৷ বিষয়বস্তু একই ছিল, নির্দেশাবলী ভিন্ন ছিল।
দুর্বল প্রম্পট / শক্তিশালী প্রম্পট
একই কাজ, দুটি ভিন্ন নির্দেশ সহ:
দুর্বল প্রম্পট:
এই টেক্সট সংক্ষিপ্ত [পাঠ্য]
শক্তিশালী প্রম্পট:
পরিচালনা পর্ষদের কাছে উপস্থাপন করার জন্য নীচের সভার নোটের সংক্ষিপ্ত বিবরণ দিন। - সর্বোচ্চ 5টি আইটেম। - প্রতিটি আইটেমে একটি সিদ্ধান্ত বা কর্ম থাকা উচিত; চ্যাটের বিবরণ এড়িয়ে যান। - যে কাজের জন্য দায়ী ব্যক্তি পরিচিত তার নাম বন্ধনীতে লিখুন। - সরল, আনুষ্ঠানিক ভাষা ব্যবহার করুন। পাঠ্য: [পাঠ্য]
দ্বিতীয় প্রম্পট মডেলকে বলে যে কী তৈরি করতে হবে, কার জন্য, কী বিন্যাসে এবং কী এড়িয়ে যেতে হবে। মডেলটি "চিন্তা" করে না বরং সঠিক ধারাবাহিকতার উত্পাদন করে; আপনি সেই ধারাবাহিকতার কাঠামো আঁকুন।
চারটি অনুলিপিযোগ্য টেমপ্লেট
চারটি সহজ স্টার্টার টেমপ্লেট এই ইউনিটের যুক্তিকে দ্রুত অনুশীলনে আনতে। আপনার নিজের তথ্য দিয়ে বন্ধনী পূরণ করুন.
1) একটি অনুরোধ শক্তিশালী করার জন্য কাঠামো:
আমি চাই আপনি এই কাজটি করুন: [কাজ]কার জন্য: [ক্রেতা/শ্রোতা] কোন বিন্যাসে: [দৈর্ঘ্য, কাঠামো] কী এড়িয়ে যেতে হবে: [আপনি কী চান না]
2) মডেলের সীমানা পরীক্ষা করা হচ্ছে (যাচাই রিফ্লেক্স):
নীচে আপনার উত্তরে যদি বাস্তবিক দাবি (সংখ্যা, তারিখ, নাম, উত্স) থাকে, তবে প্রতিটিকে একটি পৃথক তালিকা হিসাবে বের করুন এবং এটিকে "যাচাই করা আবশ্যক" হিসাবে চিহ্নিত করুন। উত্তর: [মডেলের আউটপুট]
3) একই কাজ দুটি স্তরে চেষ্টা করুন:
নিম্নলিখিত বিষয়টি দুবার ব্যাখ্যা করুন: ক) একজন সম্পূর্ণ অপরিচিত ব্যক্তির কাছে, প্রতিদিনের ভাষায়। খ) প্রযুক্তিগত দিক থেকে ক্ষেত্রের একজন বিশেষজ্ঞের কাছে। বিষয়: [বিষয়]
4) মডেলটিকে অনিশ্চয়তা উপলব্ধি করা:
আমি আপনাকে যে অনুরোধটি দিচ্ছি তা করার আগে, আপনি অনুপস্থিত বা অস্পষ্ট বিষয়গুলি সম্পর্কে আমাকে 3টি প্রশ্ন জিজ্ঞাসা করুন; তারপর আমার উত্তর অনুযায়ী উত্পাদন করুন। অনুরোধ: [অনুরোধ]
মডেলের শক্তি এবং দুর্বলতা
বিষয়
মডেল শক্তিশালী
মডেল দুর্বল/সাবধান
ভাষা বিষয়ক
লেখা, সংক্ষিপ্তকরণ, অনুবাদ, স্বর পরিবর্তন করা
খুব প্রযুক্তিগত/কুলুঙ্গি শব্দ ভুল
গঠন
পাঠ্যকে টেবিল, তালিকা, স্কেচে রূপান্তর করুন
দীর্ঘ পাঠে ধারাবাহিকতা বজায় রাখা
ধারণা
বুদ্ধিমত্তা, বিকল্প তৈরি করা
"সঠিক" কি তা নিশ্চিত করা
মামলা
সাধারণ তথ্য, সংজ্ঞা, ব্যাখ্যা
বর্তমান/সঠিক তথ্য, সংখ্যা, তারিখ, উৎস
যুক্তি
ধাপে ধাপে নির্দেশিত হলে ভালো
নীরবে জটিল গণনা ভুল করবেন না
পরামর্শ: মডেলটিকে একজন "সব-জানেন-বিশেষজ্ঞ" হিসেবে নয় বরং একজন "সহকারী যিনি খুব দ্রুত লেখেন, অনেক পড়েন, কিন্তু তিনি যা বলেন তার সবকিছু যাচাই করা দরকার" হিসেবে দেখুন৷ এই দৃশ্যটি আপনার প্রত্যাশা এবং আপনার নিয়ন্ত্রণের অভ্যাস উভয়ই সঠিকভাবে সামঞ্জস্য করে।
মনোযোগ: মডেলটি খুব আত্মবিশ্বাসী ভাষায় তথ্য লিখতে পারে, তবে এর অর্থ এই নয় যে তথ্যটি সঠিক। সর্বদা স্বাধীনভাবে প্রকৃত বিবরণ যাচাই করুন, বিশেষ করে সংখ্যা, নাম, তারিখ, আইন এবং উৎস। আমরা ইউনিট 11 এ বিস্তারিতভাবে এই বিষয়ে ফিরে আসব।
সাধারণ ভুল
- একটি মানুষের জন্য মডেল ভুল. "তারা যেভাবেই হোক বুঝবে" বলে অসম্পূর্ণ নির্দেশ দেওয়া। মডেল আপনার অভিপ্রায় পড়া না; এটি শুধুমাত্র আপনি যা টাইপ করেন তা প্রক্রিয়া করে।
- এক চেষ্টায় হাল ছেড়ে দেওয়া। যদি প্রাথমিক আউটপুট খারাপ হয়, তাহলে টুলটিকে দোষারোপ করুন। যাইহোক, বেশিরভাগ সময় সমস্যাটি নির্দেশাবলীতে থাকে এবং একটি ছোট সংশোধন ফলাফল পরিবর্তন করতে পারে।
- তথ্য যাচাই না করেই ব্যবহার করা। প্রশ্ন ছাড়াই মডেল দ্বারা উত্পাদিত একটি পরিসংখ্যান বা উত্স গ্রহণ করা সবচেয়ে ঝুঁকিপূর্ণ অভ্যাস।
- চিন্তা না করে গোপনীয় তথ্য প্রবেশ করান। টুল কিভাবে কাজ করে তা না জেনেই সংবেদনশীল তথ্য আটকানো। এটির নিয়ম রয়েছে, যেমনটি আমরা গোপনীয়তা ইউনিটে দেখব।
- ভুলের জন্য এলোমেলোতা ভুল করা। দুটি ভিন্ন ফলাফলকে "বাহনটি ভেঙে গেছে" হিসাবে ব্যাখ্যা করা; যাইহোক, যখন আপনি স্পষ্টতা বাড়ান, ফলাফলগুলি একত্রিত হয়।
সংক্ষেপে
- বড় ভাষা মডেল শব্দটি (টোকেন) ভবিষ্যদ্বাণী করে কাজ করে যেটি আপনার দেওয়া পাঠ্যের পরে উপস্থিত হওয়ার সম্ভাবনা বেশি; তিনি রেডিমেড উত্তর নির্বাচন করেন না।
- সবচেয়ে শক্তিশালী ফ্যাক্টর যা আউটপুটের দিকনির্দেশ নির্ধারণ করে তা হল আপনি ইনপুট হিসাবে যে প্রম্পট দেন।
- মডেল ভাষা, গঠন এবং ভাবনায় শক্তিশালী; সুনির্দিষ্ট তথ্য, বর্তমান ডেটা এবং জটিল গণনার সাথে সতর্ক।
- ছোট এলোমেলোতার কারণে একই প্রম্পট বিভিন্ন ফলাফল দিতে পারে; স্বচ্ছতা বৃদ্ধির সাথে সাথে ফলাফলগুলি আরও সামঞ্জস্যপূর্ণ হয়।
- মডেলটি "একজন বিশেষজ্ঞ যিনি তিনি যা বলেন তার প্রতি সত্য" নন, তবে "একজন সহকারী যিনি দ্রুত কিন্তু যাচাই করা প্রয়োজন"।
আবেদন টাস্ক
আপনার প্রতিদিনের কাজ থেকে একটি লেখার কাজ চয়ন করুন যা আপনি নিয়মিত করেন (একটি ইমেল, একটি সারসংক্ষেপ, বা একটি তালিকা, উদাহরণস্বরূপ)। প্রথমে, সহজতম এক-বাক্য সংস্করণ লিখুন, এটি একটি AI টুলে দিন এবং আউটপুট সংরক্ষণ করুন। তারপর একই কাজে; "কার জন্য, কোন বিন্যাসে, কোন দৈর্ঘ্যে এবং কি এড়িয়ে যেতে হবে" প্রশ্নগুলির উত্তর যোগ করুন এবং তাদের আবার জিজ্ঞাসা করুন। দুটি আউটপুট পাশাপাশি রাখুন এবং একটি বাক্যে নোট করুন যা যোগ করলে ফলাফলটি সবচেয়ে বেশি উন্নত হয়।
চেকলিস্ট
- [ ] আমি বুঝতে পেরেছিলাম যে মডেলটি "পরবর্তী শব্দের ভবিষ্যদ্বাণী করছে" এবং আমার উদ্দেশ্যটি পড়ছে না।
- [ ] আমি বুঝতে পেরেছি যে আউটপুটের গুণমান মূলত প্রম্পটের মানের উপর নির্ভর করে।
- [ ] আমি টাস্ক প্রকারের মধ্যে পার্থক্য করতে পারি যেখানে মডেলটি শক্তিশালী এবং দুর্বল।
- [ ] আমি বুঝতে পারি যে আমাকে প্রকৃত বিবরণ (নম্বর, তারিখ, নাম, উৎস) যাচাই করতে হবে।
- [ ] আমি ব্যাখ্যা করতে পারি কেন একই প্রম্পট বিভিন্ন ফলাফল দিতে পারে।