"블라인드는 리뷰 질문을 좁혀서 답을 믿을 수 있게 해."
권한부터 나눠
원문을 보는 리뷰어는 목표 문장이 절뚝여도 직역에 점수를 줄 수 있어. Inkwell은 더 날카롭게 물어. 이 번역문이 자기 언어의 자연스러운 글로 서 있나?
기록이 역할을 말하게 해
번역문과 목표 언어, 자연스러움 rubric으로 리뷰 packet을 만들어. 원문과 원래 키워드, 저자 reasoning은 빼. 이 제외는 예의 바른 프롬프트 한 줄이 아니라 API 계약이야.
편리한 월권
UI에서 원문만 가리고 모델 context에는 남기면 가짜 블라인드야. 볼 수 없는 사실 충실도를 확인하라고 해도 모순이고. 역할은 제공한 증거와 맞아야 해.
한 문장을 네 번 따라가
이 경계를 시험하려면 원문 작성, 번역 작성, 블라인드 리뷰, 저자 수정에서 같은 문장이 어떤 기록을 남기는지 따라가. 각 단계의 입력과 출력, 볼 수 있는 자료, 바꿀 수 있는 필드, 다음 단계에 넘기는 증거를 표로 써. 같은 브레인이 두 역할을 맡아도 job과 권한이 섞이면 안 돼.
직접 판정해
블라인드 리뷰 packet의 정확한 필드와 리뷰어가 답할 자격 없는 질문을 적어. 누가 최종 문구를 선택했는지 한 줄로 답할 수 없다면 provenance가 부족한 거야. 메모가 본문을 몰래 바꾸거나 stet 이유가 사라지면 펜의 주인이 바뀐 셈이고.
역할을 좁히면 품질이 선명해져
리뷰어에게 모든 진실을 주는 게 항상 좋은 건 아니야. 볼 수 있는 증거를 줄이고 할 수 있는 행동을 좁히면 자연스러움이라는 질문에 더 정직하게 답해. 저자는 그 답을 재료로 쓰되 최종 선택의 책임을 가져.
권한을 데이터로 증명해
blind packet을 로그로 확인해. 원문 필드가 없다는 것뿐 아니라 system prompt나 tool context, 첨부 metadata에도 원문이 숨어 있지 않아야 해. 리뷰어에게 목표 언어 자연스러움만 묻고, 볼 수 없는 충실도 판정은 다른 단계에 남겨.
권한은 프롬프트의 부탁만으로 지켜지지 않아. 입력 스키마와 출력 검증, 저장 가능한 필드가 같은 역할 경계를 말해야 해.
역할표를 직접 써
각 단계마다 볼 수 있는 입력, 만들 수 있는 출력, 바꿀 수 없는 필드, 다음 역할에 넘기는 증거를 한 줄씩 적어. 표 한 칸이 비면 그 빈칸에서 누군가 펜을 몰래 가져갈 수 있어.