- 홈
- 업무 에이전트
일을 맡길 수 있는
업무 에이전트.
중소기업의 일상 업무에 넣으려고 만드는 제품입니다. 업무 규칙, 금지 행동, 산출물 규격, 검수 절차를 먼저 정하고 그 위에 에이전트를 올립니다. 공개 출시 전이며, 저희 업무에 먼저 쓰면서 첫 고객사 에이전트를 준비하고 있습니다.
네 가지 역할.
한 에이전트에게 다 맡기지 않습니다. 역할을 나누고 권한을 다르게 줍니다.
주작업자
요청을 처리해 초안과 산출물을 만듭니다. 이름을 부르지 않으면 주작업자가 답합니다.
회의록 담당
회의 녹취와 양식을 받아 회의록 초안을 만듭니다.
검수자
결과를 검토하고 문제점을 지적합니다. 설계상 항상 읽기 전용입니다.
판정자
검수 의견을 읽고 수정이 필요한지 판단합니다.
맡길 수 있는 업무.
매번 같은 기준으로 처리하지만, 사람이 하나씩 읽고 판단하느라 시간이 드는 일입니다.
메일 분류와 답장 초안
받은 메일을 "직접 답해야 하는 것, 확인만 하면 되는 것, 무시해도 되는 것"으로 나누고, 답장이 필요한 메일에는 초안을 준비합니다. 발송은 사람이 합니다.
보고서와 발표 자료
정해진 양식에 맞춰 자료를 모으고 초안을 만듭니다. 확인이 필요한 자리는 비워 두고 표시합니다.
회의록 정리
회의 녹취와 양식을 받아 결정 사항, 할 일, 담당자 기준으로 정리하고 검수까지 거칩니다.
어떻게 설계하나.
틀릴 수 있다는 전제로 설계했습니다.
작업자와 검수자를 나눕니다
한 에이전트가 작업을 하면, 다른 에이전트가 그 결과를 검토합니다. 검수자는 읽기 전용이어서 결과를 직접 고칠 수 없고 문제점만 지적합니다. 검수 의견을 반영할지는 따로 판정합니다. 검수 의견이 곧바로 수정 명령이 되면, 틀린 지적도 그대로 실행되기 때문입니다.
행동을 세 등급으로 나눕니다
| 등급 | 해당 행동 | 처리 |
|---|---|---|
| 자동 허용 | 읽기, 요약, 초안 작성, 작업 폴더 안의 산출물 생성 | 바로 실행하고 기록 |
| 승인 필수 | 메일 발송, 일정 생성, 공유 설정 변경, 파일 삭제 | 사람이 승인한 뒤 실행 |
| 금지 | 결제와 구매, 비밀번호와 카드 정보 처리 | 거부하고 사유를 기록 |
규칙과 기록을 남깁니다
에이전트가 매번 읽는 지침 파일에 역할, 금지 행동, 분류 기준, 산출물 규격, 완료 조건을 적습니다. 사람이 바뀌거나 모델이 바뀌어도 같은 기준으로 일하게 하기 위해서입니다. 작업이 끝나면 무엇을 읽었는지, 어떤 도구를 실행했는지, 어떤 파일을 만들었는지, 밖으로 보낸 것이 있는지를 기록으로 남깁니다. 구체적인 항목은 자동화를 시작하기 전에 정해야 할 다섯 가지에 정리했습니다.
저희가 운영하는 방식은 사람이 한 번 명령하면 분류, 작성, 검수가 이어지는 주문형 자동화입니다. 정해진 시간에 스스로 실행되는 무인 자동화는 다음 단계로 준비하고 있으며, 이 경우에도 발송은 사람이 최종 확인합니다.
지금 단계와 다음.
된 것과 안 된 것을 구분해 적습니다.
- 01 / 동작함
대화와 자동 검수
채팅 화면, 두 모델 연결, 호출 대상 판단, 자동 검수, 회의록 데스크. 자동 테스트 28개 통과.
- 02 / 설계 완료
정책과 승인
권한 정책, 승인 요청 화면, 실행 기록과 감사 기록, 실패 시 대체 실행.
- 03 / 계획
도구 연동
파일 도구, 메일 연동, 여러 에이전트가 함께 쓰는 스킬.
- 04 / 계획
원격과 운영
외부 접속, 접근 인증, 사용량과 비용 집계.
Claude를 쓰는 자리.
제품의 중심은 Claude입니다. 다른 모델을 쓰는 자리도 숨기지 않고 적습니다.
| 자리 | 모델 | 이유 |
|---|---|---|
| 주작업자 | Claude | 요청을 처리하고 초안과 산출물을 만듭니다. Claude Code를 비대화형으로 실행합니다. |
| 판정자 | Claude | 검수 의견을 반영할지 판단합니다. |
| 검수자, 회의록 담당 | Codex | 작업한 모델과 다른 모델이 검토하게 하려는 것입니다. |
| 확장 기능 | Claude의 스킬 | 작업 기억 같은 기능을 평소 말투로 불러 씁니다. |
규칙은 모델 밖의 파일에 두기 때문에, 모델을 바꿔도 기준이 유지됩니다.
도입은 이렇게 진행합니다.
업무 하나로 작게 시작하고, 결과를 본 다음에 넓힙니다.
업무 진단
맡길 업무 하나를 고르고, 지금의 처리 기준과 예외를 듣습니다.
규칙 작성
역할, 금지 행동, 분류 기준, 산출물 규격을 지침 파일로 만듭니다.
시험 운영
실제 자료로 돌려 보고, 틀린 판단과 사람이 고친 부분을 기록합니다.
인계
운영 문서와 점검 방법을 남겨, 직접 운영할 수 있게 합니다.
자주 묻는 질문.
더 궁금한 점은 문의로 알려 주세요.
에이전트가 메일을 마음대로 보내지는 않나요?
보내지 않습니다. 답장은 임시보관함에 초안으로만 만들고, 발송은 사람이 직접 합니다. 삭제, 보관, 읽음 표시 변경도 하지 않도록 지침에 금지 행동으로 적습니다.
어떤 AI 모델을 쓰나요?
저희 구성에서는 Claude가 작업하고 Codex가 검수합니다. 고객 환경과 보안 요건에 따라 달라질 수 있으며, 규칙을 문서로 분리해 두기 때문에 모델을 바꿔도 기준은 유지됩니다.
AI가 틀리면 어떻게 되나요?
틀릴 수 있다는 전제로 설계합니다. 판단이 애매하면 더 중요한 쪽으로 분류하게 하고, 모르는 사실은 지어내지 않고 빈칸으로 남기게 합니다. 검수자가 한 번 더 확인하고, 되돌리기 어려운 행동은 사람의 승인을 거칩니다.
개인정보나 사내 자료는 어떻게 다루나요?
에이전트의 작업 폴더를 따로 두어 접근 범위를 제한하고, 무엇을 읽고 무엇을 만들었는지 기록을 남깁니다. 다루는 자료의 범위와 보관 방식은 진단 단계에서 먼저 정합니다.
지금 써 볼 수 있나요?
공개 출시 전이라 누구나 가입해 쓸 수 있는 상태는 아닙니다. 맡기고 싶은 업무를 알려 주시면 시험 도입이 가능한지 함께 검토합니다. 가격은 아직 정하지 않았습니다.
먼저 써 보고 싶다면.
첫 고객사와 함께할 에이전트를 준비하고 있습니다. 맡기고 싶은 반복 업무가 있다면 알려 주세요. 업무 하나로 작게 시작하는 시험 도입을 함께 검토합니다.