zisky:
- Rozpoznáva najčastejšie promptné chyby zo skutočných príkladov
- Dokáže použiť praktickú a opakovateľnú opravu každej chyby
- Uvedomuje si, že zlý výstup je často spôsobený zlou výzvou
V tomto module sme sa naučili techniky písania dobrých výziev jeden po druhom. Teraz ich posilnime z iného uhla pohľadu: pohľadom na najčastejšie chyby a ich riešenia. Prevažná väčšina zlého výstupu AI je spôsobená zlým podnetom, nie nedostatočným modelom. Ak rozpoznáte chyby v tejto jednotke, môžete rýchlo diagnostikovať a opraviť problémy vo vlastných výzvach; Namiesto toho, aby ste povedali „AI to nedokáže“, môžete povedať „dovoľte mi opraviť výzvu takto“.
Prečo je dôležité rozpoznať chyby?
Keď výstup nespĺňa vaše očakávania, môžete reagovať dvoma spôsobmi: obviňovať nástroj alebo spochybniť výzvu. Skúsený používateľ robí to druhé. Pretože väčšinou je zdroj problému zrejmý a s malou korekciou sa výsledok zmení. Nižšie uvidíme osem najčastejších chýb, ich príznaky a riešenia.
Osem najčastejších chýb
Chyba
symptóm
Riešenie
nejednoznačnosť
Všeobecná odpoveď „jedna veľkosť pre všetkých“.
Poskytnite merateľné pokyny
Nulový kontext
Výstup, ktorý nezodpovedá situácii
Pridajte kto/prečo/históriu
Bez špecifikácie formátu
Výstup v nesprávnom formáte
Vynútiť formát
absencia obmedzení
Nadmerný, deviantný obsah
Pridajte zoznam „nie“.
preťaženie
Model preskočí niektoré požiadavky
Rozdeľte si prácu, uprednostnite
nepotvrdenie
Používanie falošných informácií
Overte si fakty so zdrojom
Očakávanie na jeden výstrel
Nevzdávajte sa pri prvom východe
Iterovať
protichodný pokyn
nekonzistentný výstup
Zarovnajte obmedzenia
Postup diagnostiky krok za krokom
Keď príde poškodený výstup, postupujte takto:
- Je misia jasná? Je sloveso konkrétne, znamená to jediné, čo chcete?
- Stačí kontext? Pozná modelka situáciu?
- Bol spomenutý formát? Je formát taký, aký chcete?
- Existujú nejaké obmedzenia? Je napísané, čo sa nechce?
- Naložil som príliš veľa? Požiadal som o 5 rôznych úloh naraz?
- Overil som? Bolo skontrolované číslo, meno, dátum?
Týchto šesť otázok zachytáva takmer všetky chyby.
Štyri kopírovateľné korektúrne šablóny
1) Odstránenie nejednoznačnosti:
Urobte tento pokyn merateľný: [nejasný pokyn]Preložte každý neurčitý bod do konkrétneho čísla, množstva alebo kritéria.
2) Rozdelenie preťaženia:
Nerobte túto úlohu naraz. Pokračujte v tomto poradí a po dokončení každého kroku zastavte, počkajte na moje potvrdenie:1) [podúloha 1]2) [podúloha 2]3) [podúloha 3]
3) Obmedzujúca montáž:
Stačí sa spoľahnúť na informácie, ktoré som uviedol nižšie. Ak neexistujú žiadne informácie, napíšte „žiadne údaje“; nehádajte ani nepridávajte. Uveďte, z ktorej línie pochádza každé dôležité tvrdenie, ktoré používate. Zdroj: [text]
4) Vyriešenie rozporu:
Skontrolujte, či nie sú nejaké rozpory v pokynoch, ktoré som vám dal. Ak áno, uveďte zoznam konfliktných bodov a opýtajte sa ma, ktorý z nich uprednostniť; potom podľa toho vyrábať.
Slabá výzva / silná výzva
Slabé (spolu veľa chýb):
Napíšte komplexný plán pre našu spoločnosť o marketingu, rozpočte a nábore a môžete začať.
Výkonný (opravené chyby):
Úloha: Ste špecialista na rozvoj podnikania, ktorý poskytuje poradenstvo pre MSP. Kontext: Softvérová spoločnosť s 12 ľuďmi; cieľom je 20 nových zákazníkov v tomto štvrťroku. Úloha: Napíšte LEN marketingový plán (nezahŕňajte rozpočet a nábor). Formát: 5-bodový zoznam akcií; každá položka: akcia + zodpovednosť + kritériá. Obmedzenie: Rozpočet na platenú reklamu 0; Odporúčame iba organické kanály. Neuvádzajte falošné metriky; Zdôvodnite návrh.
Výkonná verzia rozdeľuje preťaženie (napchávanie troch tém do jednej výzvy), nahrádza nejednoznačnosť („veľa šťastia“) kritériami a pridáva formátovanie a obmedzenie.
Tri mini puzdrá
Prípad 1 – Preťaženie. Manažér si vyžiadal súhrn správy, plán prezentácie a e-mail v jednej výzve; Model vyrobil všetky tri na polovicu. Rozdelením úlohy na tri samostatné výzvy bol každý výstup úplný a použiteľný. Celkový čas bol kratší ako boj s jedinou komplexnou výzvou.
Prípad 2 – Nepotvrdenie. Obsahový tím zverejnil „štatistiku odvetvia“ danú modelom bez toho, aby ju overil; Číslo sa ukázalo ako nesprávne a museli vydať opravu. Následne prijali pravidlo „každému číslu daj zdroj, skontrolujem zdroj“ a toto riziko eliminovali.
Prípad 3 – Konfliktné poučenie. Keď obchodník povedal „je to veľmi krátke, ale povedz všetky funkcie“, model niektoré funkcie preskočil. Keď som urobil inštrukciu tak, aby nebola protichodná ako „popíšte 3 najdôležitejšie vlastnosti 60 slovami“, výstup bol krátky aj úplný.
Tip: Pred zverejnením si vykonajte výzvu cez „šesť diagnostických otázok“. Táto 30-sekundová kontrola robí väčšinu kôl iterácií od začiatku zbytočnou.
Pozor: Najnebezpečnejšou chybou je „nevalidácia“, pretože sa prehliada, pretože výstup vyzerá hladko a presvedčivo. Model sa môže s veľkou istotou zhodovať s číslom, menom alebo zdrojom. Nezávisle overiť každú skutočnosť, ktorá sa má zverejniť alebo použiť ako základ pre rozhodnutie. Túto tému si prehĺbime v ďalšom bloku.
Neviditeľná chyba: Výstup „takmer správny“.
Niektoré chyby sa dajú ľahko zachytiť: výstup prichádza v nesprávnom formáte, ide mimo tému alebo je prázdny. Ale najzákernejšia chyba je, že výstup je takmer správny. Text je plynulý, štruktúra je hladká, tón je na mieste; Je tam len jedno nesprávne číslo, prehliadnuté obmedzenie alebo malá logická chyba. Tieto typy výstupov sú nebezpečné, pretože unikajú kontrole, pretože „vyzerajú dobre“.
Proti tomu chránia dva zvyky. Po prvé, nepoužívajte výstup bez jeho prečítania: bez ohľadu na to, ako sa ponáhľate, pred odoslaním si ho prečítajte. Po druhé, ak necháte model skontrolovať svoj výstup: „skontrolujte, či ste dodržali všetky obmedzenia, ktoré som vám dal“ alebo „uveďte všetky čísla v tomto texte“, vynesú na povrch skryté chyby. Tieto dva kroky trvajú niekoľko sekúnd, ale náklady na nesprávne rozhodnutia spôsobené „takmer správnym“ výstupom sú oveľa vyššie.
Vyhýbanie sa chybám: dizajn nad kontrolou
Namiesto honby za chybami vo výstupe sa im skúsený používateľ snaží od začiatku na výzvu predchádzať. Toto je rozdiel v mentalite. Premeňte každú opakujúcu sa chybu na „trvalé pravidlo“: ak model stále pridáva komentáre do súhrnnej úlohy, teraz nastavte obmedzenie „nepridávať komentáre“ pre každú súhrnnú výzvu. Ak model vždy produkuje príliš veľa položiek v úlohe zoznamu, umiestnite do šablóny obmedzenie „presne X položiek“. Týmto spôsobom, namiesto toho, aby ste znova a znova zachytávali tú istú chybu, v prvom rade zabránite jej výskytu. Dobre navrhnutá výzva nahrádza desiatky následných opráv; Diagnostika chýb sa tak zmení zo záťaže na nástroj učenia a zlepšovania.
Časté chyby
- Obviňovanie sprostredkovateľa. Povedať „AI to nedokáže“ namiesto hľadania problému vo výzve.
- Príliš veľa práce s jedinou výzvou. Kompresia piatich samostatných úloh do jednej inštrukcie a ich vykonanie napoly.
- Preskočenie overenia. Za predpokladu, že plynulý výstup je správny.
- Poskytovanie protichodných obmedzení. Sebakonfliktné požiadavky, ako napríklad „krátke, ale komplexné“.
- Skúste to znova bez diagnostiky. Opakovanie tej istej chyby bez toho, aby ste zistili, čo je pokazené.
V súhrne
- Väčšina zlých výstupov je problém s výzvou, nie s modelom; možno diagnostikovať a korigovať.
- Najčastejšie chyby: nejednoznačnosť, nulový kontext, nedostatok formátu, nedostatok obmedzení, preťaženie, nedostatok overenia, jednorazové očakávania a rozpor.
- Šesť diagnostických otázok (úloha, kontext, formát, obmedzenie, zaťaženie, overenie) zachytáva väčšinu chýb.
- Rozdelenie zložitých úloh poskytuje rýchlejšie a kvalitnejšie výsledky ako ich načítanie do jednej výzvy.
- Najzákernejšou chybou je neoverenie; Hladký výstup neznamená presný.
Aplikačná úloha
Nájdite starý výtlačok, ktorý sa vám nepáči, a spustite jeho výzvu cez „šesť diagnostických otázok“. Označte, ktoré chyby sa vyskytli, pre každú použite opravu v tejto jednotke a znova spustite výzvu. Všimnite si, ktorá jediná korekcia priniesla najväčšie zlepšenie, nie koľko kôl.
kontrolný zoznam
- [ ] V prípade zlého výstupu sa najprv pýtam na výzvu, nie na agenta.
- [ ] Môžem vykonať šesť diagnostických otázok.
- [ ] Komplexné úlohy rozdeľujem do viacerých výziev.
- [ ] Všímam si protichodné a nejednoznačné pokyny a opravujem ich.
- [ ] Vecný výstup pred zverejnením overujem.