TL;DR

Auditor 프롬프트는 AI를 저자에서 적대자로 뒤집습니다:전달이 끝나면 자신의 출력을 공격하라고 명령합니다 —— 논리적 결함, 근거 없는 주장, 놓친 각도를 사냥하게 하고, 강화된 최종본을 만들기 전에 멈춥니다.후속 메시지 하나의 비용으로, 어려운 방식으로 발견했을 실패를 일상적으로 잡아냅니다.

비유

모든 진지한 신문은 결코 같은 책상에 앉지 않는 두 사람으로 돌아갑니다:라이터와 에디터.

라이터의 일은 생산입니다 —— 독자를 끌고, 주장을 노래하게 만드는 것.에디터의 일은 해체입니다.에디터는 출처 없는 주장에 동그라미를 치고, 여백에 *"누가 말하지?"*라고 쓰고, 논증이 조용히 자기모순되는 문단을 찾아내고, 라이터가 아무도 눈치채지 않길 바랐던 질문을 던집니다.결정적으로, 에디터는 친절함이 아니라 발견한 결함 수로 평가받습니다 —— 다정한 에디터는 고장 난 에디터입니다.신문이 신뢰할 수 있는 이유는, 점검하는 사람이 쓴 사람이 아니기 때문입니다.

AI의 문제가 여기 있습니다:**당신은 에디터 없는 라이터와 대화해 왔습니다.**초안을 만든 모델은 흐르는 텍스트를 만들도록 최적화되어 있고 —— 같은 모델에게 *"이거 좋아?"*라고 물을 때, 저자에게 자기 원고를 검토시키는 것입니다.소설가가 자기 책은 완벽하다고 하면 뭐라고 하겠습니까?즉시 할인할 것입니다.그런데도 사람들은 매일 AI에게서 "좋아 보이네요!"를 받아들이고 —— 그리고 상사 앞에서, 서론이 결론과 모순되었다는 걸 발견합니다.

Auditor 프롬프트는 당신이 의도적으로 에디터를 고용하는 것입니다.같은 모델, 새 계약:일은 더 이상 "이걸 써라"가 아니라 "이걸 부숴라"입니다.사이버보안 세계의 레드팀 수법입니다:한 팀이 시스템을 만들고, 경쟁 팀이 진짜 적이 들이치기 전에 공격하는 보수를 받습니다.적의 포화 전에, 일부러 받아들이는 아군 포화입니다.

그리고 인간 에디터와 달리, 이 사람은 몇 초 안에 일하고, 세 번째 초안에 지치지 않고, 화내서 부드러워지지도 않습니다 —— 혹독함을 지시문에 적었으니까.

작동 원리와 도구(추론 모델)

기법은 2단계 리듬입니다:**초안, 그다음 감사.**결코 동시에 하지 않습니다.

**1단계 —— 초안.**평소처럼 작업을 생산합니다.어떤 기법이든 맞으면 됩니다:원샷 프롬프트, 인터뷰, 제약된 형식.초안을 쓰는 뇌와 감사하는 뇌는 별도의 턴을 가져야 합니다 —— 하나의 메시지에서 "쓰고 확인해"라고 하면 모델은 자신 있게 쓴 다음 자기 자신에게 도장을 찍습니다.

**2단계 —— 감사.**하중을 지탱하는 세 부분을 가진 명령으로 따라갑니다:

부분하는 일예시
역할 할당저자의 정중함을 죽임"냉혹한 악마의 대변자로 행동해"
개수 지정 소견느낌이 아니라 실제 결함을 강제"치명적 결함을 정확히 3개 찾아"
평결 유보위로하는 결론을 금지"아직 다시 쓰지 마 —— 소견만, 심각도 순으로"

냉혹한 악마의 대변자로 행동해, 이전 답변을 비판해줘. 치명적 결함을 정확히 3개 찾아줘:논리 오류, 근거 없는 주장, 회의적인 전문가가 공격할 놓친 각도. 심각도 순으로 배열해줘. 아직 아무것도 다시 쓰지 마 —— 소견만.

왜 "정확히 3개"일까요?제한 없는 "문제 있어?"는 모델에게 안전을 연기하게 만들기 때문입니다 —— "전반적으로 잘 구성되어 있네요!" —— 그리고 칭찬으로 시작하는 감사는 이미 실패한 감사입니다.개수는 발굴을 강제합니다:좋은 작업에서도 번호가 붙은 슬롯은 무언가로 채워져야 하고, 떠오르는 것은 보통 아무도 검증하지 않았던 가정입니다.그다음, 소견을 읽은 후에만 3단계를 풉니다:"이제 원본을 다시 써줘 —— 세 결함을 모두 고쳐서."

여기에 미묘한 하이브리드 터치도 있습니다:어떤 모델이든 감사할 수 있지만, 감사는 생각하는 작업이며 —— 그것이 바로 추론 모델을 위해 만들어진 것입니다.추론 모델(Uzu에서 이용 가능한 프리미엄 모델 등)은 답하기 전에 느리게 단계별로 문제를 진행하도록 훈련되어, 빠른 모델이 스쳐 지나가는 결함을 잡는 데 비례 없이 뛰어납니다.프로의 파이프라인은 이렇습니다:**빠른 모델로 초안, 추론 모델로 감사.**싸고 빠른 모델이 원자재를 생성하고, 비싸고 신중한 모델은 중요한 패스 —— 작업이 현실과의 접촉에서 살아남는지 결정하는 패스 —— 에만 화력을 씁니다.

변경 전후(프롬프트)

예시 1 —— 비즈니스 케이스

이 사업 계획 좋아? 피드백 있어?

저자가 원고를 검토합니다.돌아오는 것:장점 먼저, 부드러운 "추가를 고려해 보면", 그리고 "견고함"의 총평.계획은 치명적 가정에 손대지 않은 채 출하됩니다.

1,000개의 피치를 본 회의적인 투자자로 행동해줘. 이 사업 계획에서 치명적 결함을 정확히 3개 식별해줘 —— 펀드가 통과할 이유들. 심각도 순으로, 구체적 섹션을 인용, 소견만, 다시 쓰기 없이.

이제 같은 계획이 에디터와 마주합니다.소견은 번호가 붙고 불편하게 돌아옵니다:수익 모델이 근거 없이 40% 전환율을 가정;"경쟁 분석"이 최대 플레이어를 누락;현금 흐름 예측이 7개월 차 갭을 숨김.어느 것도 스타일 메모가 아닙니다.모두가 자금 조달과 침묵의 차이입니다.

예시 2 —— 논증

내 에세이 오류 확인해줘.

"오류"는 오타 사냥이라서, 그것이 돌아옵니다 —— 문법은 광이 나고, 논리는 무사합니다.

너는 내 가장 혹독한 비평가야. 내 논증을 읽고 추론이 가장 약한 지점을 정확히 3개 찾아줘 —— 도약, 근거 없는 전제, 대응하지 못한 반론. 각각에 대해 나에 대한 가장 강력한 반론을 제시해줘. 부드럽게 하지 마. 소견만.

감사는 상대가 당신을 인용할 두 문장 —— 그리고 보지 못해 반론하지 못했던 하나의 이의 —— 를 돌려줍니다.그 세 가지를 고치면, 논증은 실패를 바라는 청중을 향해 준비됩니다.

예시 3 —— 전송 전 이메일

이 이메일 어조 맞는지 확인해줘.

어조 점검.좋습니다.하지만 이메일의 위험은 어조가 아니었습니다 —— 지킬 수 없는 마감에 무심코 동의해 버린 그 문장이었습니다.

보내기 전에:계약 변호사로 감사해줘. 의도하지 않은 약속이나 책임으로 읽힐 수 있는 문장을 정확히 3개 찾아줘. 각각을 인용하고, 위험한 해석을 설명, 소견만.

세 가지 소견 뒤, 한 문장에 플래그가 붙습니다:"곧 해결하겠습니다" —— 압박 속에서 이것은 약속이 됩니다.수정됩니다.이메일은 더 잘 쓰인 게 아닙니다.보내기 더 안전해진 것입니다.

흔한 함정

  1. **첫 번째 "좋아 보이네요!" 수용하기.**정중하게 물으면 모델은 자기 숙제를 후하게 채점합니다 —— 정중함이 엄격함보다 깊이 훈련되어 있기 때문입니다.소견 0개의 감사는 감사가 아니라 칭찬이었습니다.개수를 붙여 재실행하세요:"정확히 3개 찾아줘."
  2. 초안과 같은 호흡으로 감사하기."쓰고 잘 됐는지 확인해"는 에디터를 라이터로 붕괴시킵니다.모델은 자신 있게 초안을 쓴 다음, 그 자신감을 검토자로 상속합니다.항상 두 턴:초안, 그다음 공격.
  3. 모호한 감사 요청."이거 비판해줘"는 어조와 구조에 대한 에세이 길이의 진창을 부릅니다.모든 출력을 제약하듯 감사를 제약하세요:역할, 개수, 심각도 순위, 재작성 금지 규칙.감사도 결과물입니다.
  4. **"끝난 기분"인 작업의 감사 건너뛰기.**유창함은 정확히 잘못된 완료 신호입니다 —— 확신의 착각을 기억하세요:완벽하게 들리는 초안과 결함 있는 초안은 같은 평온한 목소리로 도착합니다.잘 읽힐수록 적대적인 2차 패스가 필요합니다, 덜이 아니라.
  5. **소견이 아니라 증상 고치기.**감사는 세 결함을 지목합니다;당신은 각각 한 문장을 덧대고 끝냅니다.소견은 보통 가정을 가리킵니다 —— 그것을 실은 문장이 아니라 가정 자체를 재검토하세요.그리고 수정본을 재감사합니다:"v2를 같은 방식으로 감사해줘."

FAQ

AI가 자기 작업을 비판하게 하는 방법은?

명시적으로 명령하세요:적대적 역할을 부여하고("냉혹한 악마의 대변자/회의적 투자자/레드팀으로 행동해"), 개수 지정된 결함 목록을 요구하고("치명적 결함 정확히 3개"), 심각도 순위를 요구하고, 소견을 읽기 전까지 재작성을 금지하세요.3부 구조 —— 역할, 개수, 평결 유보 —— 가 진짜 감사와 아부를 나눕니다.

AI는 나쁜데 좋다고 하는 이유는?

정중한 답이 하나뿐인 질문을 했기 때문입니다.모델은 상냥한 대화로 훈련되어 "이거 좋아?"는 "네, 사소한 제안 몇 개와 함께"를 끌어당깁니다.수정은 더 나은 질문이 아니라 다른 계약입니다:모델은 더 이상 친구의 작업을 평가하는 게 아니라, 발견한 결함으로 채점됩니다.인센티브를 바꾸면 정직함이 나타납니다.

AI 출력 점검에 추론 모델을 써야 하나요?

결과가 중요한 일이라면, 그렇습니다.추론 모델 —— Uzu의 프리미엄 모델 등 —— 은 답하기 전에 단계별로 숙고하며, 그것이 결함 사냥에 필요한 기술 그 자체입니다.효율적인 패턴은 분업입니다:빠른 모델이 싸게 초안을 쓰고, 추론 모델은 감사 패스에만 컴퓨팅을 씁니다.무거운 모델은 무거운 생각을 위해 아껴두세요.

다음 레슨

Auditor는 강력한 한 패스를 돌립니다:초안, 공격, 수정.하지만 완벽한 단일 답변으로도 너무 큰 작업이 있습니다 —— 조사 하고 변환 하고 다듬기, 각 단계가 다음을 먹이는 작업.프롬프트 쓰기를 멈추고 조립 라인을 짓기 시작하면 무슨 일이 벌어질까요?

다음 레슨으로: 프롬프트 체이닝

떠나기 전 연습:실제로 사용한 마지막 AI 출력을 가져와, 위의 감사 프롬프트를 그대로 실행하세요 —— 혹독한 역할, 결함 정확히 3개, 소견만.무엇이 떠오르든, 그것이 처음부터 줄곧 거기 앉아 발견 보수를 받을 누군가를 기다리고 있었다는 사실을 가만히 받아들이세요.