TL;DR

Auditorプロンプトは、AIを著者から敵対者へ反転させます:納品後、自分の出力を攻撃するよう命じます —— 論理的欠陥、根拠のない主張、見落とした角度を狩り、硬化した最終版を生成する前に。フォローアップ1通のコストで、困難な方法で見つけるはずだった失敗を日常的に捕まえます。

例え話

すべての真剣な新聞は、決して同じ机に座らない2人の人間で回っています:ライターとエディター。

ライターの仕事は生産です —— 読者を惹き込み、主張を歌わせる。エディターの仕事は解体です。エディターは出典のない主張を丸で囲み、余白に*「誰が言ってる?」と書き、論証が静かに自己矛盾する段落を見つけ、ライターが誰にも気づかれないことを祈った質問を投げます。決定的に重要なのは、エディターの評価基準が親切さではなく見つけた欠陥数*だということです —— 優しいエディターは壊れたエディターです。新聞が信頼できるのは、正確に、チェックする人が書いた人ではないからです。

AIの問題がこちら:**あなたはエディターのいないライターと話してきた。*草案を作ったモデルは、流れるテキストを作るよう最適化されています —— そしてその同じモデルに「これは良い?」*と尋ねるとき、著者に自分の原稿を査読させることになります。小説家が自分の本は無欠だと言ったら何と言いますか?即座に割り引くでしょう。それなのに人々は毎日AIから「良さそうですね!」を受け入れ —— そして上司の前で、導入が結論と矛盾していたことを発見します。

Auditorプロンプトは、あなたが意図的にエディターを雇うことです。同じモデル、新しい契約:仕事はもう「これを書く」ではなく —— 「これを壊す」です。サイバーセキュリティ界のレッドチームの動きです:一方のチームがシステムを構築し、敵対チームが本物の敵の前に攻撃する報酬を得る。敵対的火力の前に、あえての同士討ちです。

そして人間のエディターと違って、この人は数秒で働き、3稿目に疲れず、怒って軟化することもありません —— 厳しさを指示に書き込んだのですから。

仕組みとツール(推論モデル)

技法は2ステップのリズムです:**草案、次に監査。**決して同時にではありません。

**ステップ1 —— 草案。**通常どおり仕事を生産します。適する手法は何でも:ワンショットプロンプトインタビュー、制約付き形式。起草する脳と監査する脳は別々のターンを取る必要があります —— 1つのメッセージで「書いて確認して」と求めると、モデルは自信満々に書き、そして自分に承認印を押します。

**ステップ2 —— 監査。**荷重を支える3つの部分を持つ命令でフォローします:

部分機能
役割割り当て著者の礼儀を殺す「冷酷な悪魔の代弁者として振る舞え」
個数指定の所見感想ではなく実際の欠陥を強制「致命的欠陥をちょうど3つ見つけよ」
評決の留保慰めの結論を禁止「まだ書き直すな —— 所見のみ、重大度順に」

冷酷な悪魔の代弁者として振る舞い、前の回答を批判せよ。致命的欠陥をちょうど3つ見つけよ:論理エラー、根拠のない主張、または懐疑的な専門家が攻撃するであろう見落とし。重大度順に並べよ。まだ何も書き直すな —— 所見のみ。

なぜ「ちょうど3つ」?上限のない「何か問題ある?」は、モデルに安全の演技をさせるからです —— 「全体としてよく構成されています!」* —— そして称賛で始まる監査は、すでに失敗した監査です。個数指定は発掘を強制します:良い仕事であっても、番号付きスロットを何かが埋めなければならず、浮上するのはたいてい、誰も検証していなかった前提です。それから、所見を読んだ後でのみ、ステップ3を解放します:「では元を書き直せ —— 3つの欠陥すべてを修正して」

ここには微妙なハイブリッドのタッチもあります:どのモデルでも監査できますが、監査は思考の仕事であり —— それこそ推論モデルのために作られたものです。推論モデル(Uzuで利用可能なプレミアム版など)は、答える前にゆっくり段階的に問題を進めるよう訓練されており、速いモデルが滑り過ぎる欠陥を捕まえるのが得意です。プロのパイプラインはこうなります:**速いモデルで草案、推論モデルで監査。**安く速いモデルが原材料を生成し、高く慎重なモデルは、重要なパス —— 仕事が現実との接触で生き残るかを決めるパス —— にだけ火力を注ぎます。

変更前後(プロンプト)

例1 —— ビジネスケース

このビジネスプランは良い?フィードバックは?

著者が原稿を査読します。返ってくるのは:まず強み、優しい「追加を検討しては」、そして「堅実」の評決。プランは致命的仮定に手つかずのまま出荷されます。

1,000件のピッチを見てきた懐疑的な投資家として振る舞え。このビジネスプランの致命的欠陥をちょうど3つ特定せよ —— ファームが見送る理由。重大度順、該当セクションを引用、所見のみ、書き直しなし。

今、同じプランがエディターに直面します。所見は番号付きで不愉快に返ってきます:収益モデルが根拠ゼロで40%の転換率を仮定;「競合分析」が最大のプレイヤーを省略;キャッシュフロー予測が7ヶ月目のギャップを隠す。どれもスタイルの注釈ではありません。すべてが、資金調達と沈黙の分かれ目です。

例2 —— 論証

私のエッセイの誤りを確認して。

「誤り」は誤字探しなので、それが得られます —— 文法は磨かれ、論理は無傷。

あなたは私の最も厳しい批判者。私の論証を読み、推論が最も弱い場所をちょうど3つ見つけよ —— 飛躍、根拠のない前提、対処できなかった反論。それぞれについて、私に対する最強の反論を述べよ。和らげるな。所見のみ。

監査は、敵があなたを引用するであろう2つの文 —— そして、見えなかったがゆえに反論できなかった1つの異議 —— を返します。その3つを直せば、論証は、失敗を望む聴衆に向けた準備ができます。

例3 —— 送信前のメール

このメールのトーンが合ってるか確認して。

トーンチェック。結構。しかしメールの危険はトーンではなく —— 果たせない締め切りへのコミットメントにうっかり同意する文でした。

送信前に:契約弁護士として監査せよ。意図していないコミットメントや責任と読める文をちょうど3つ見つけよ。各々を引用し、リスクのある読み方を説明、所見のみ。

3つの所見の後、1つの文にフラグ:「まもなく解決します」—— 圧力下でこれは約束になります。書き直されます。メールはより上手く書けたわけではありません。送信がより安全になったのです。

よくある落とし穴

  1. **最初の「良さそうですね!」を受け入れる。**礼儀正しく尋ねれば、モデルは自分の宿題を甘く採点します —— 礼儀は厳密さより深く訓練されています。所見ゼロの監査は監査ではなく、お世辞でした。個数指定で再実行を:「ちょうど3つ見つけよ」
  2. 起草と同じ息で監査する。「書いて、良いことを確認して」はエディターをライターに崩壊させます。モデルは自信満々に草案を書き、その自信を査読者として継承します。常に2ターン:草案、それから攻撃。
  3. 曖昧な監査要求。「これを批判して」は、トーンと構造についてのエッセイ長の泥沼を誘います。あらゆる出力を制約するのと同じように監査を制約しましょう:役割、個数、重大度順、書き直し禁止ルール。監査も成果物です。
  4. **「完成した気分」の仕事の監査を省く。**流暢さは まさに間違った完了信号です —— 確信の錯覚を思い出してください:完璧に聞こえる草案と欠陥のある草案は、同じ穏やかな声で届きます。よく読めるほど、敵対的な第二パスがより必要であって、より不要ではありません。
  5. **所見ではなく症状を直す。**監査は3つの欠陥を指名します;あなたはそれぞれ1文をパッチして完了と呼びます。所見はたいてい前提を指しています —— それを運んだ文だけでなく、前提そのものを再検討しましょう。それから改訂版を再監査します:「v2を同じ方法で監査せよ」

FAQ

AIに自分の仕事を批判させる方法は?

明示的に命令します:敵対的役割を割り当て(「冷酷な悪魔の代弁者/懐疑的投資家/レッドチームとして振る舞え」)、個数指定の欠陥リストを要求し(「致命的欠陥ちょうど3つ」)、重大度順を要求し、所見を読むまで書き直しを禁止します。3部構造 —— 役割、個数、評決の留保 —— が、本物の監査とお世辞を分けます。

AIは悪くないのに良いと言うのはなぜ?

礼儀正しい答えが一つしかない質問をしたからです。モデルは愛想のよい会話で訓練されているため、「これは良い?」は「はい、微調整をいくつか」を引っ張ります。修正はより良い質問ではなく、異なる契約です:モデルはもう友人の仕事を評価しておらず、見つけた欠陥で採点されます。インセンティブを変えれば正直さが現れます。

AI出力のチェックに推論モデルを使うべき?

結果に影響するものなら、はい。推論モデル —— Uzuのプレミアム版など —— は答える前に段階的に熟慮し、それこそが欠陥狩りに必要なスキルです。効率的なパターンは分業です:速いモデルが安く草案を作り、推論モデルは監査パスにだけ計算を注ぎます。重いモデルは重い思考のために取っておきましょう。

次のレッスン

Auditorは強力な1パスを走らせます:草案、攻撃、修正。しかし完璧な単一の答えでも大きすぎる仕事があります —— 調査して変換して磨く、各ステップが次を養う仕事。プロンプトを書くのをやめ、組み立てラインを作り始めたら何が起きますか?

次のレッスンへ:プロンプトチェイニング

帰る前の練習:実際に使った最後のAI出力を取り、上の監査プロンプトをそのまま実行してください —— 冷酷な役割、欠陥ちょうど3つ、所見のみ。何が浮上しても、それが最初からずっとそこに座って、見つける報酬を得る人を待っていたという事実を、じっと受け止めてください。