대화하는 에이전트들로 애플리케이션을 만드는 AutoGen
Microsoft의 AutoGen은 LLM과 사람과 도구를 조합한 여러 에이전트가 서로 대화하며 과업을 수행하는 오픈소스 프레임워크로, 수학과 코딩과 질의응답 등 다양한 영역에서 효과를 입증했습니다. 하나의 만능 에이전트 대신 역할을 나눈 에이전트 팀으로 업무를 자동화하는 구성이 실무에서 왜 관리하기 쉬운지 보여주는 기준점입니다.
멀티 에이전트라는 말이 업계 표준 어휘가 되기 전에 그 설계 패턴을 실용적인 프레임워크로 정리한 것이 2023년 Microsoft가 공개한 AutoGen입니다. 역할이 다른 에이전트들이 대화를 주고받으며 함께 문제를 푸는 구조를 오픈소스로 제공해, 이후 멀티 에이전트 프레임워크 생태계의 기준점이 됐습니다.
문제 배경
복잡한 업무를 에이전트 하나에 전부 맡기면 프롬프트가 비대해지고 실패 지점을 찾기 어려워집니다. 코드 작성과 검증, 계획과 실행처럼 성격이 다른 역할이 하나의 컨텍스트에 섞이면 어느 판단이 어디서 틀렸는지 추적할 수 없습니다. 사람의 조직이 업무를 분장하는 것과 같은 이유로 에이전트에도 역할 분리가 필요하지만, 이를 구현할 표준적인 방법이 없었습니다.
방법
AutoGen의 기본 단위는 대화 가능한 에이전트입니다. 각 에이전트는 LLM, 사람의 입력, 도구 실행을 자유롭게 조합해 구성할 수 있고, 에이전트 간 상호작용은 자연어와 코드 양쪽으로 프로그래밍할 수 있습니다. 예를 들어 코드를 작성하는 에이전트와 실행 결과를 검증하는 에이전트를 분리하면, 작성과 검증이 대화 형태로 반복되며 오류가 자연스럽게 걸러집니다. 사람이 개입하는 지점도 설정으로 정할 수 있어 완전 자동 운영과 승인 기반 운영 사이를 과업 성격에 따라 조절할 수 있습니다.

결과
논문은 이 구조의 효과를 여러 도메인의 응용 사례로 실증했습니다. 하나의 프레임워크가 단순한 2자 대화부터 사람이 개입하는 승인 루프, 여러 에이전트가 참여하는 그룹 대화까지 복잡도가 다른 구성을 모두 수용한다는 점을 보인 것입니다.
| 응용 영역 | 구성 예 |
|---|---|
| 수학 문제 풀이 | 풀이 에이전트와 검증 루프 |
| 검색 증강 질의응답 | 검색 에이전트와 응답 에이전트 |
| 코딩 | 작성과 실행 검증의 분리 |
| 운영 연구, 의사결정 | 도구 실행과 사람 개입 조합 |
한계와 주의점
프레임워크는 구조를 제공할 뿐 좋은 역할 분장을 대신 설계해 주지는 않습니다. 어떤 업무를 몇 개의 역할로 나눌지, 대화가 수렴하지 않고 공회전할 때 언제 끊을지는 여전히 설계자의 몫입니다. 에이전트 수가 늘면 대화 턴이 늘어 비용과 지연이 커지므로, 역할 분리가 주는 이득이 이 비용을 넘어서는지 과업별로 따져야 합니다.
도입 검토 가이드
작성과 검증, 계획과 실행처럼 성격이 다른 역할이 섞인 업무를 에이전트로 자동화하려는 조직, 특히 단일 에이전트로 만들었다가 프롬프트가 비대해지고 실패 원인 추적이 어려워진 경험이 있는 조직에 해당합니다. 역할이 하나뿐인 단순 과업은 분리로 얻는 것 없이 대화 턴 비용만 늘어납니다.
| 구분 | 내용 |
|---|---|
| 검토 주체 | 에이전트 구조를 설계하는 AI 엔지니어링팀과 자동화 대상 업무의 분장 체계를 아는 프로세스 오너 |
| 전제 조건 | 자동화 대상 업무의 역할 분장이 문서로 정의되어 있을 것, 에이전트 간 대화 기록을 저장하고 검토할 로그 체계, 대화가 공회전할 때 끊을 최대 턴 수 같은 종료 조건. 논문이 밝혔듯 좋은 역할 분장은 프레임워크가 대신 설계해 주지 않습니다 |
| 첫 적용 지점 | 논문의 응용 사례처럼 작성과 실행 검증이 분리되는 업무 하나. 예를 들어 코드 작성과 테스트 실행 검증의 2자 구성에 사람 승인 지점을 넣은 형태가 가장 작게 시작하는 구성입니다 |
| 판단 기준 | 단일 에이전트 구성과 비교해 오류가 대화 루프에서 걸러지는 비율이 오르는지, 실패 발생 시 어느 역할의 판단이 틀렸는지 로그로 특정되는지, 그리고 늘어난 턴 수만큼의 비용과 지연을 이 이득이 넘어서는지 |
코텍시스는 Agentic Workflow 구축 시 기존 조직의 업무 분장을 먼저 정의하고 그 분장을 에이전트 구조로 옮기는 순서를 권합니다. 사람의 협업 구조가 이미 검증한 역할 경계가 에이전트 설계의 가장 좋은 출발점이기 때문입니다.
코텍시스 AI사업부는 sLLM 최적화, Advanced RAG, AI Agent 개발을 수행합니다. 이런 기법의 도입을 검토 중이라면 문의를 남겨주세요.
AI 개발 문의기술 블로그 최신 글
AI 네이티브 SDLC 플레이북, 여섯 단계 중 먼저 바꿀 곳
코드 작성이 병목에서 빠지면 계획·리뷰·배포가 새 병목이 됩니다. Anthropic Applied AI 팀의 AI 네이티브 SDLC 플레이북을 여섯 단계 전환표, 통제 계층, 측정 지표로 정리하고 국내 도입 시 확인할 것을 덧붙였습니다.
Anthropic이 AI 교육을 설계한 다섯 원칙과 한국 기업교육의 거리
Anthropic이 Claude Academy를 공개하며 밝힌 AI 교육 설계 원칙 다섯 가지를 정리하고, 국내 기업교육 발주에 옮길 때 제안서에서 확인할 질문과 실패 유형을 덧붙였습니다.
Slack에 상주하는 에이전트, Claude Tag가 실제로 한 일
Anthropic 사내에서 Claude Tag가 처리한 세 가지 업무를 소요 시간과 산출물 기준으로 정리하고, 잘 작동한 지시의 공통 구조와 국내 조직 도입 시 확인할 항목을 덧붙였습니다.
같은 주제의 다른 인사이트
깃허브 이슈로 코드 에이전트를 시험하는 SWE-bench
SWE-bench는 12개 파이썬 오픈소스 저장소의 실제 깃허브 이슈 2,294건을 언어 모델이 해결할 수 있는지 테스트로 검증하는 벤치마크로, 발표 당시 최고 모델의 해결률은 1.96%에 그쳤습니다. 이후 코드 에이전트 경쟁의 표준 척도가 된 이 벤치마크는 개발 업무 자동화의 성숙도를 기업이 수치로 추적할 수 있게 해줍니다.
MCP 생태계의 구조와 보안 위협을 정리한 첫 체계적 분석
이 논문은 AI 모델과 외부 도구를 잇는 표준인 Model Context Protocol의 아키텍처와 생태계를 정리하고, 서버 생명주기 4단계에 걸친 16개 위협 시나리오의 보안 분류체계를 제시한 첫 체계적 연구입니다. MCP로 사내 시스템을 에이전트에 연결하려는 기업에게 표준 도입의 이점과 함께 서버 검증 절차가 왜 필수인지를 알려줍니다.
언어 모델이 스스로 도구 사용을 배우는 방법, Toolformer
Meta AI의 Toolformer는 언어 모델이 사람의 개입 없이 스스로 API 호출 시점과 인자를 학습하는 자기지도 방식을 제시한 논문입니다. 업무 자동화 에이전트를 도입하려는 기업에게는 도구 호출 능력이 별도의 대규모 수작업 라벨링 없이도 학습될 수 있다는 근거가 되어 사내 시스템 연동 에이전트 설계의 출발점이 됩니다.