ユニット 8 / 12

反復と迅速な改善

利益:

  • 初期出力が完璧であることはほとんどなく、反復は通常のプロセスであることを理解しています。
  • 的を絞った単変量フィードバックにより体系的に結果を改善できる
  • 成功したプロンプトを再利用可能なテンプレートに変換するロジックを理解している

初心者の最大の間違いは、最初のプロンプトで完璧な出力が得られると期待することです。最初の出力が期待に応えられなかった場合、「AIにはこの仕事はできない」と諦めてしまうのです。ただし、経験豊富なユーザーにとって、最初の出力は終わりではなく始まりです。この単元では、即時執筆を一度限りのものではなく、対話と改善のプロセスとして捉えることを学びます。反復は迅速なエンジニアリングの核心です。

反復とは何ですか?またそれが正常であるのはなぜですか?

反復とは、出力を取得し、気に入らない点を指摘し、プロンプトまたはリクエストを修正し、それを再現することです。最初の出力が不完全な場合、それは失敗ではなく、プロセスの自然な部分です。ほとんどの場合、最初の出力を見たときに初めて何が必要かが明確になるからです。優れたユーザーは、最初の出力を「草案」として扱い、目標に向かって少しずつ進めていきます。

反復には 2 つのタイプがあります。

  • 会話中の修正:「もっと短くして」「3つ目の項目を削除して」などのフィードバックをしながら同じ会話を進めます。それは速いです。モデルは前の出力を記憶しています。
  • プロンプトを書き直す: 学んだことを最初のプロンプトに適用し、より適切な指示を最初から作成します。再利用される作品としては貴重です。

的を絞ったフィードバックを与える

反復の秘訣は、フィードバックが的を絞ったものであることです。 「気に入らないので、もう一度書きます」と言っても、モデルを指示するものではありません。おそらく同様の出力が得られるでしょう。代わりに、何をどのように変更するかを正確に述べてください。

  • 弱者:「これはダメだよ」
  • ストロング: 「前置きが長すぎます。最初の段落を 1 つの文に減らしてください。口調が形式的すぎるので、もう少し親しみやすくしてください。検証できないため、2 番目の箇条書きから主張を削除してください。」

単変量最適化

科学的な習慣を身につけましょう。一度に一つずつ変えていきましょう。音色、長さ、構造をすべて同時に変更すると、どの変更が効果を発揮したか、出力が向上したか低下したかがわかりません。 1 つの変数を使用すると、何が機能するかを学び、それを定着させることができます。

反復ループ

ステップ

あなたは何をしますか

1.プロデュース

最初のプロンプトで出力を取得します

2. 評価する

良かった点、悪かった点を具体的に書きましょう

3. 1 つの変更

1 つの問題を対象とした単一の修正を行う

4.再生

変更の影響を確認する

5. 比較する

彼は回復しましたか? 「はい」の場合は保管し、「いいえ」の場合は返却してください

6.固定する

良好な結果が得られたプロンプトをテンプレートに保存します

4 つのコピー可能なテンプレート

1) 対象となる修正:

前の出力は問題ありませんでしたが、次のように変更します。- [単一の具体的な変更 1]- [単一の具体的な変更 2] 他はすべて同じにしておきます。

2) 出力を批判します。

編集者の目で作成したばかりのテキストを批評します。 3 つの弱点を見つけて、それぞれについて具体的な修正を提案します。次に修正版を書きます。

3) バリアント生成 (A/B):

このテキストの 2 つの異なるバージョンを作成します。 A) よりフォーマルで短い。 B) よりわかりやすく、例を示します。両方を与えてください。どの状況でどちらがより適切かを一文で教えてください。

4) プロンプトに自分自身を回復させます:

次のプロンプトを使用しますが、結果は十分です [問題]。このプロンプトをより明確かつ効果的に書く方法を提案してください。改善されたプロンプトを作成し、変更内容とその理由を説明します。プロンプト: [現在のプロンプト]

弱いプロンプト / 強いプロンプト (フィードバックとして)

悪いフィードバック:

うまくいきませんでした。もう一度試してください。

強力なフィードバック:

内容は正しいですが、次の 3 つの問題があります。1) 単語が 210 語。 120 に減らします。2) 2 番目の段落は技術的なものです。専門用語を単純化する。3) 結びが弱い。次のステップへの明確な文で終わります。それ以外はすべて保管してください。

2 番目のフィードバックは、モデルにどこに触れるべきかを正確に伝えます。結果は1ターンで目標に近づきます。

ミニケース3個

ケース 1 — コンテンツ制作。あるマーケティング担当者は、「気に入らないのでもう一度書いてください」と宣伝コピーを 6 回試しましたが、それ以上の結果は得られませんでした。彼がアプローチを変え、各ラウンドで具体的な変更を 1 つ (最初に長さ、次に調子、最後に) 要求したところ、3 ラウンドで出版可能な文章を完成させました。合計時間は半分以下に短縮されました。

ケース 2 — レポート。あるアナリストは、最初の要約が専門的すぎると見て、「マネージャーはこれを理解できないだろう。専門用語を日常用語に翻訳して、長さはそのままにしておこう」と述べた。単変量補正のおかげで、レポートは簡素化され、その範囲を失うことはありませんでした。 2 回目の完全な書き直しは必要ありませんでした。

ケース 3 — テンプレート化。サポート チームは、同じ種類の応答を何度も繰り返し修正していました。最後に、理想的なプロンプトをテンプレートに記録しました。彼らは現在、新しいケースごとに最初から繰り返すのではなく、小さな変更を加えたテンプレートを使用しています。これは、反復の要点を示しています。つまり、一度良いものにしてから、再度使用します。

ヒント: モデルに自分の出力を批評してもらいます (「このテキストの 3 つの弱点を見つけてください」)。多くの場合、モデルはそれ自体のエラーに気づき、それを修正します。これにより、ユーザーに代わって事前編集が行われます。
注意: 反復には制限があります。 5 ~ 6 ラウンド経ってもまだ目標に近づけない場合、問題は小さな修正ではなく、基本的なアプローチにあります。役割、コンテキスト、タスクの設定が最初から間違っている可能性があります。その時点で、パッチ適用を停止し、プロンプトを最初から再設計します。

反復の 2 つの道: 会話か書き換えか?

反復中にどちらの方法がより効率的かを知ることで時間を節約できます。ルールは次のとおりです。1 回限りの仕事の場合は、チャットで解決するのが最も早いです。なぜなら、モデルは前の出力を記憶しており、ユーザーはその違いを区別するだけだからです。しかし、繰り返す仕事の場合は、学んだことを最初のプロンプトに書き込んで、きれいなテンプレートを作成することの方が価値があります。次回は反復を必要とせずに良好な出力が得られるからです。

実際には、この 2 つを組み合わせるのが最も効率的です。まずチャットですばやく試して正しい命令を見つけ、次に見つけた命令をクリーンなプロンプトに注ぎ込んでライブラリに保存します。このようにして、迅速に進歩し、労働力を永続的な資産に変えることができます。

反復を学習記録として表示する

反復の各ラウンドで、どの追加によって出力が改善されたのか、どの制約が不必要だったのか、モデルの何が間違っていたのかなど、何かがわかります。これらの学習を書き留めることで、時間の経過とともに個人的な「何が機能するか」のガイドが作成されます。たとえば、「このタイプの要約では『コメントの追加』制約が必須である」、「タイトル作成には 3 つの例で十分で、5 つは不要」などの推論により、次の同様のジョブで最初の試行で正しいプロンプトを作成できるようになります。この知識こそが、経験豊富なユーザーと初心者を区別するものです。彼らは各ビジネスをゼロから始めるのではなく、以前の繰り返しの教訓を武器に始めます。

モデルを反復パートナーにする

反復を単独で実行する必要はありません。モデルに「どうすればこの出力を目標に近づけることができますか。具体的な提案を 3 つ教えてください。」と尋ねることができます。多くの場合、モデルは出力の弱点を正確に診断し、それらを修正する方法を提案します。これにより、反復が「試行錯誤」から目標を絞ったコラボレーションに変わります。あなたが望むものを私たちに伝えると、モデルがそこに到達する方法を教えてくれます。

よくある間違い

  • 同じプロンプトを再度送信します。変更せずに再試行します。結果は変わりません。
  • 曖昧なフィードバック。 「気に入らない」と言って、何を直すかは言わない。
  • 多くのことを一度に変えること。何が機能するのかを学んでいません。
  • 適切なプロンプトが記録されていません。毎回同じ繰り返しを繰り返します。
  • 無限の反復。根本的に間違ったプロンプトにパッチを当てて修正しようとしています。

要約すると

  • 初期出力が完璧であることはほとんどありません。反復は失敗ではなく、プロセスの自然な部分です。
  • 効果的な反復は、漠然としたものではなく、的を絞ったフィードバックによって進められます。
  • ラウンドごとに 1 つ変更します。それで何が機能するかを学びます。
  • モデルに自分の出力を批評してもらうことで、事前編集することができます。
  • 適切に機能するプロンプトをテンプレートに保存します。反復の目標は、再利用可能な資産を生成することです。

アプリケーションタスク

プリントアウトを取り、意識的に 3 ラウンドの繰り返しを行います。各ラウンドで 1 つのことだけを変更し (最初に長さ、次にトーン、最後にクロージング)、各ラウンドを記録します。 3 回目のラウンドの後、どの変更が最も大きな違いをもたらしたかを判断し、最終的なプロンプトを再利用可能なテンプレートとして保存します。

チェックリスト

  • [ ] 私は最初の出力を完成作品としてではなく、草稿として見ています。
  • [ ] 私はフィードバックを具体的かつ的を絞ったものにします。
  • [ ] ラウンドごとに 1 つの変更を行います。
  • [ ] モデルに自分自身の出力を批評するように依頼できます。
  • [ ] 良い結果をもたらしたプロンプトをテンプレートに保存します。