Claude가 일하고 Codex가 검수한다: 업무 에이전트를 둘로 나눈 이유
한 모델이 작업하고 다른 모델이 읽기 전용으로 검수하는 업무 에이전트를 직접 만들었습니다. 구조와 권한 등급, 아직 구현하지 못한 부분을 정리했습니다.
도구를 하나 더 들이는 일이 아닙니다. 업무 규칙, 금지 행동, 산출물 규격, 검수 절차를 먼저 정하고 그 위에 에이전트를 올립니다.

매번 같은 기준으로 처리하지만, 사람이 하나씩 읽고 판단하느라 시간이 드는 일입니다.
받은 메일을 "직접 답해야 하는 것, 확인만 하면 되는 것, 무시해도 되는 것"으로 나누고, 답장이 필요한 메일에는 초안을 준비합니다. 발송은 사람이 합니다.
정해진 양식에 맞춰 자료를 모으고 초안을 만듭니다. 사실 확인이 필요한 자리는 비워 두고 표시합니다.
회의 내용을 결정 사항, 할 일, 담당자 기준으로 정리합니다. 양식과 작성 지침을 먼저 정해 둡니다.
저희가 직접 쓰는 업무 에이전트의 구조를 그대로 적용합니다.
한 에이전트가 작업을 하면, 다른 에이전트가 그 결과를 검토합니다. 검수자는 읽기 전용이어서 결과를 직접 고칠 수 없고 문제점만 지적합니다. 검수 의견을 반영할지는 따로 판정합니다. 검수 의견이 곧바로 수정 명령이 되면, 틀린 지적도 그대로 실행되기 때문입니다.
| 등급 | 해당 행동 | 처리 |
|---|---|---|
| 자동 허용 | 읽기, 요약, 초안 작성, 작업 폴더 안의 산출물 생성 | 바로 실행하고 기록 |
| 승인 필수 | 메일 발송, 일정 생성, 공유 설정 변경, 파일 삭제 | 사람이 승인한 뒤 실행 |
| 금지 | 결제와 구매, 비밀번호와 카드 정보 처리 | 거부하고 사유를 기록 |
에이전트가 매번 읽는 지침 파일에 역할, 금지 행동, 분류 기준, 산출물 규격, 완료 조건을 적습니다. 사람이 바뀌거나 모델이 바뀌어도 같은 기준으로 일하게 하기 위해서입니다. 구체적인 항목은 자동화를 시작하기 전에 정해야 할 다섯 가지에 정리했습니다.
저희가 운영하는 방식은 사람이 한 번 명령하면 분류, 작성, 검수가 이어지는 주문형 자동화입니다. 정해진 시간에 스스로 실행되는 무인 자동화는 다음 단계로 준비하고 있으며, 이 경우에도 발송은 사람이 최종 확인합니다.
업무 하나로 작게 시작하고, 결과를 본 다음에 넓힙니다.
자동화할 업무 하나를 고르고, 지금의 처리 기준과 예외를 듣습니다.
역할, 금지 행동, 분류 기준, 산출물 규격을 지침 파일로 만듭니다.
실제 데이터로 돌려 보고, 틀린 판단과 사람이 고친 부분을 기록합니다.
운영 문서와 점검 방법을 남기고, 직접 운영할 수 있게 안내합니다.
결과물은 파일과 문서로 남아, 저희 없이도 이어서 쓸 수 있습니다.
자동화할 일과 사람이 계속 해야 하는 일을 나눈 문서.
역할, 금지 행동, 기준, 산출물 규격을 담은 지침 파일.
작업자와 검수자가 연결된 실행 환경과 작업 기록.
점검 방법, 예외 처리, 기준을 바꾸는 방법.
더 궁금한 점은 문의로 알려 주세요.
보내지 않습니다. 답장은 임시보관함에 초안으로만 만들고, 발송은 사람이 직접 합니다. 삭제, 보관, 읽음 표시 변경도 하지 않도록 지침에 금지 행동으로 적습니다.
저희 구성에서는 Claude가 작업하고 Codex가 검수합니다. 고객 환경과 보안 요건에 따라 달라질 수 있으며, 규칙을 문서로 분리해 두기 때문에 모델을 바꿔도 기준은 유지됩니다.
틀릴 수 있다는 전제로 설계합니다. 판단이 애매하면 더 중요한 쪽으로 분류하게 하고, 모르는 사실은 지어내지 않고 빈칸으로 남기게 합니다. 검수자가 한 번 더 확인하고, 되돌리기 어려운 행동은 사람의 승인을 거칩니다.
에이전트의 작업 폴더를 따로 두어 접근 범위를 제한하고, 무엇을 읽고 무엇을 만들었는지 기록을 남깁니다. 다루는 자료의 범위와 보관 방식은 진단 단계에서 먼저 정합니다.
업무 범위에 따라 달라서 정해진 가격표는 없습니다. 업무 내용을 알려 주시면 범위를 정리해 답장드립니다.
자동화를 직접 만들고 운영하며 기록한 글입니다.
한 모델이 작업하고 다른 모델이 읽기 전용으로 검수하는 업무 에이전트를 직접 만들었습니다. 구조와 권한 등급, 아직 구현하지 못한 부분을 정리했습니다.
안 읽은 메일 약 201건을 AI 에이전트에게 분류시킨 실제 결과입니다. 분류 기준, 금지 규칙, 보고서 형식과 함께 예상과 달랐던 점을 적었습니다.
에이전트에게 일을 맡기기 전에 문서로 정해 두어야 하는 범위, 금지 행동, 산출물 규격, 불확실할 때의 규칙, 완료 조건을 실제 지침 파일을 예로 설명합니다.
AI 브라우저 Aside에게 "독일산 크레아틴을 찾아 장바구니에 담아 줘"라고 시켜 본 기록입니다. 어디까지 시험했고 무엇을 확인하지 못했는지, 다음에 볼 항목을 정리했습니다.
자동화하고 싶은 업무, 필요한 교육, 만들고 싶은 광고를 알려 주세요. 범위와 진행 방식을 먼저 정리해 답장드립니다.