한 줄 정의
하나의 작업을 여러 개의 독립된 LLM 에이전트(서브에이전트)로 나눠 병렬·위임 구조로 처리하게 만드는 설계 방식과, 서로 다른 에이전트·프레임워크가 통신하기 위한 프로토콜들.
지금 상태 (2026-09 기준)
"서브에이전트"(한 오케스트레이터가 하위 작업자를 호출)와 "멀티에이전트 프로토콜"(A2A처럼 이질적인 시스템 간 통신 표준)은 서로 다른 층위의 개념으로 정착했습니다. Claude Code는 Task 도구 기반 서브에이전트에서 더 나아가 여러 세션이 파일을 공유하며 협업하는 실험적 "에이전트 팀"까지 실험 중이고, OpenAI Agents SDK는 handoff로 제어권을 다른 에이전트에 완전히 넘기는 패턴을 표준화했습니다. 다만 업계에는 "무작정 멀티에이전트로 쪼개지 말라"는 반작용도 강합니다 — 병렬 서브에이전트는 컨텍스트 분산과 상태 비일치로 오히려 성능이 떨어질 수 있다는 실증적 경고가 나온 뒤, 실제로는 "명확히 분리 가능한 하위 작업 + 읽기 전용 병렬 조사" 같은 좁은 범위에만 멀티에이전트를 쓰는 쪽으로 실무 관행이 수렴하고 있습니다.
개념
- 서브에이전트(subagent): 메인 에이전트가 별도의 컨텍스트 창과 시스템 프롬프트를 가진 하위 에이전트를 호출해 특정 작업(코드 리뷰, 리서치 등)을 위임하고 결과만 요약받는 구조. 메인 컨텍스트를 오염시키지 않는 것이 핵심 이점.
- 오케스트레이터-워커 패턴: 하나의 리드 에이전트가 작업을 하위 과제로 분해하고, 여러 서브에이전트에 병렬로 위임한 뒤 결과를 합성. Anthropic의 멀티에이전트 리서치 시스템이 이 패턴의 대표 사례.
- Handoff(OpenAI Agents SDK): 한 에이전트가 대화의 제어권 자체를 다른 전문 에이전트에게 완전히 넘기는 방식(위임 후 요약 보고가 아니라 인계). 고객 지원처럼 "라우터 에이전트 → 전문 에이전트" 흐름에 적합.
- A2A(Agent2Agent) 프로토콜: Google이 만든, 서로 다른 벤더·프레임워크로 만들어진 에이전트들이 정체성 확인, 태스크 위임, 상태 스트리밍을 표준화된 방식으로 주고받게 하는 프로토콜. MCP(도구 호출 표준)와는 층위가 다르며, A2A는 "에이전트 대 에이전트" 통신을, MCP는 "에이전트 대 도구/데이터" 연결을 다룹니다.
- 에이전트 팀(Claude Code, 실험적): 단순 서브에이전트 위임을 넘어, 여러 Claude Code 세션이 공유 작업공간·파일을 통해 상태를 유지하며 협업하는 실험 기능.
- 멀티에이전트의 비용 문제: 병렬 서브에이전트는 토큰 사용량이 단일 에이전트 대비 크게(수배) 늘어납니다. 따라서 "충분히 가치가 큰 병렬 조사"에만 정당화되며, 상태를 서로 공유해야 하는 긴밀한 코드 작업에는 오히려 컨텍스트 단절로 품질이 떨어질 수 있다는 것이 업계 반작용의 핵심 논지.
벤더별 비교
| 항목 | Anthropic (Claude Code) | OpenAI (Agents SDK / Codex) | Google (A2A) | Cognition (Devin) |
|---|---|---|---|---|
| 핵심 개념 | Subagents(Task 도구), Agent Teams(실험적) | Handoffs, Guardrails, Sessions | 에이전트 간 통신 프로토콜(벤더 중립) | 단일 강력한 에이전트 지향, 멀티에이전트 신중론 |
| 위임 방식 | 위임 후 결과 요약 수신(컨텍스트 분리) | 제어권 자체를 완전히 인계 | 표준 메시지로 태스크 위임·상태 스트리밍 | 컨텍스트 압축·긴 단일 세션 우선 |
| 거버넌스 | Anthropic 자체 | OpenAI 자체 | Linux Foundation(2025-06 기증) | 자체 블로그 기반 실무 가이드 |
잘 쓰는 법
- 서브에이전트는 "독립적으로 검증 가능하고 결과만 필요한" 작업(코드 리뷰, 웹 리서치, 테스트 실행)에 씁니다. 서로 상태를 주고받아야 하는 긴밀한 리팩터링 작업을 여러 에이전트로 쪼개면 컨텍스트 불일치로 오히려 느려집니다.
- 병렬 서브에이전트를 쓸 때는 토큰 비용이 단일 에이전트 대비 크게 늘어난다는 것을 전제하고, 그만큼 가치가 큰 작업(광범위 리서치, 독립적 다중 후보 탐색)에만 적용합니다.
- 오케스트레이터에는 "무엇을, 왜, 어떤 형식으로 보고할지"를 명확히 지시합니다. 위임 지시가 모호하면 서브에이전트 결과의 품질 편차가 커집니다.
- 서브에이전트 간 통신이 필요하면 A2A 같은 표준 프로토콜을 검토하되, 같은 벤더·프레임워크 안에서만 동작한다면 오히려 벤더 자체 서브에이전트/handoff 메커니즘이 더 단순합니다.
- "멀티에이전트가 더 똑똑해 보인다"는 이유만으로 아키텍처를 복잡하게 만들지 않습니다 — 먼저 단일 에이전트 + 긴 컨텍스트로 해결이 안 되는지 확인한 뒤에 분리합니다.
- 팀 단위로 여러 에이전트 세션을 동시에 돌릴 때는(예: Claude Code 에이전트 팀) 파일 충돌·상태 동기화 규칙을 먼저 정해둡니다.
타임라인
2025-04 · Google, A2A(Agent2Agent) 프로토콜 발표
- 이전 대비: 최초 등장. 그전에는 에이전트 간 통신이 벤더별 사내 구현에 머물러 있었음.
- 서로 다른 프레임워크로 만든 에이전트가 정체성·능력을 알리고 태스크를 위임·스트리밍할 수 있는 개방 프로토콜을 Google이 공개.
- 출처: Agent2Agent - Wikipedia
2025-06-14 · Anthropic, 멀티에이전트 리서치 시스템 공개
- 이전 대비: A2A가 에이전트 간 "통신 규격"이라면, 이 글은 오케스트레이터-워커 패턴의 실전 설계(토큰 소비, 병렬 조사, 실패 복구)를 처음으로 상세히 공개.
- 리드 에이전트가 조사를 하위 과제로 나눠 여러 서브에이전트에 병렬 위임하고 결과를 합성하는 구조, 그리고 이 구조가 단일 에이전트보다 토큰을 훨씬 많이 쓴다는 점을 명시.
- 출처: How we built our multi-agent research system
2025-06 · Cognition, "Don't Build Multi-Agents" 공개
- 이전 대비: Anthropic의 멀티에이전트 옹호론 직후, 실무에서 병렬 서브에이전트가 컨텍스트 분산·상태 불일치로 실패하기 쉽다는 반대 논지를 제시.
- 긴밀하게 연결된 작업(코드 작성 등)에는 단일 강력한 에이전트가 여러 병렬 에이전트보다 나을 수 있다는 주장을 데이터와 함께 제시.
- 출처: Don't Build Multi-Agents - Cognition
2025-06-24 · Google, A2A 프로토콜을 Linux Foundation에 기증
- 이전 대비: Google 단독 관리 프로토콜에서 다자간 오픈소스 거버넌스로 전환.
- Linux Foundation 산하에 A2A Project가 출범해 여러 기업이 함께 스펙을 관리.
- 출처: Google donates Agent2Agent Protocol to the Linux Foundation
2025-07-24 · Claude Code, 커스텀 서브에이전트(/agents) 출시
- 이전 대비: 연구용 블로그 사례로만 알려졌던 오케스트레이터-워커 패턴이, 사용자가 직접 정의하는 제품 기능(
/agents명령, 파일 기반 서브에이전트 정의)으로 구현. - 사용자가 별도 시스템 프롬프트·도구 권한을 가진 서브에이전트를 정의해 메인 대화 컨텍스트를 오염시키지 않고 위임할 수 있게 됨.
- 출처: Create custom subagents - Claude Code Docs
2025 (추정) · OpenAI Agents SDK, Handoffs 정식 지원
- 이전 대비: Claude Code 서브에이전트의 "위임 후 요약"과 달리, 대화 제어권 자체를 다른 에이전트에게 완전히 넘기는 handoff 패턴을 SDK 1급 기능으로 제공.
- 라우터 에이전트가 사용자의 요청을 분류해 전문 에이전트로 넘기는 패턴을 표준 API로 지원.
- 출처: Handoffs - OpenAI Agents SDK
2026-02-05 · Claude Code, 에이전트 팀 리서치 프리뷰
- 이전 대비: 단일 오케스트레이터가 서브에이전트를 호출하는 구조에서, 여러 세션이 공유 작업공간을 통해 동등하게 협업하는 구조로 확장.
- Opus 4.6과 함께 실험적 "Agent Teams"가 리서치 프리뷰로 공개되어, 여러 Claude Code 세션이 상태를 공유하며 작업.
- 출처: Claude Code Timeline
출처
- Simon Willison, "How we built our multi-agent research system" (2025-06-14 기사)
- Cognition, "Don't Build Multi-Agents" (2025-06)
- SiliconANGLE, 2025-06-24
- Wikipedia, "Agent2Agent"
- Claude Code Docs, sub-agents
- OpenAI Agents SDK 공식 문서, handoffs
- scriptbyai.com, Claude Code Timeline