wikiline.dev🇰🇷
Wikiline › AI (Artificial Intelligence) › AI Agent Stack › Subagents & Multi-Agent Systems

Subagents & Multi-Agent Systems

Updated 2026-09-28

Splitting big tasks across multiple AIs

One-line definition

A design approach that splits a single task across multiple independent LLM agents (subagents) for parallel, delegated processing, along with the protocols that let different agents and frameworks communicate with each other.

Full timeline and sources below are currently in Korean.

지금 상태 (2026-09 기준)

"서브에이전트"(한 오케스트레이터가 하위 작업자를 호출)와 "멀티에이전트 프로토콜"(A2A처럼 이질적인 시스템 간 통신 표준)은 서로 다른 층위의 개념으로 정착했습니다. Claude Code는 Task 도구 기반 서브에이전트에서 더 나아가 여러 세션이 파일을 공유하며 협업하는 실험적 "에이전트 팀"까지 실험 중이고, OpenAI Agents SDK는 handoff로 제어권을 다른 에이전트에 완전히 넘기는 패턴을 표준화했습니다. 다만 업계에는 "무작정 멀티에이전트로 쪼개지 말라"는 반작용도 강합니다 — 병렬 서브에이전트는 컨텍스트 분산과 상태 비일치로 오히려 성능이 떨어질 수 있다는 실증적 경고가 나온 뒤, 실제로는 "명확히 분리 가능한 하위 작업 + 읽기 전용 병렬 조사" 같은 좁은 범위에만 멀티에이전트를 쓰는 쪽으로 실무 관행이 수렴하고 있습니다.

개념

  • 서브에이전트(subagent): 메인 에이전트가 별도의 컨텍스트 창과 시스템 프롬프트를 가진 하위 에이전트를 호출해 특정 작업(코드 리뷰, 리서치 등)을 위임하고 결과만 요약받는 구조. 메인 컨텍스트를 오염시키지 않는 것이 핵심 이점.
  • 오케스트레이터-워커 패턴: 하나의 리드 에이전트가 작업을 하위 과제로 분해하고, 여러 서브에이전트에 병렬로 위임한 뒤 결과를 합성. Anthropic의 멀티에이전트 리서치 시스템이 이 패턴의 대표 사례.
  • Handoff(OpenAI Agents SDK): 한 에이전트가 대화의 제어권 자체를 다른 전문 에이전트에게 완전히 넘기는 방식(위임 후 요약 보고가 아니라 인계). 고객 지원처럼 "라우터 에이전트 → 전문 에이전트" 흐름에 적합.
  • A2A(Agent2Agent) 프로토콜: Google이 만든, 서로 다른 벤더·프레임워크로 만들어진 에이전트들이 정체성 확인, 태스크 위임, 상태 스트리밍을 표준화된 방식으로 주고받게 하는 프로토콜. MCP(도구 호출 표준)와는 층위가 다르며, A2A는 "에이전트 대 에이전트" 통신을, MCP는 "에이전트 대 도구/데이터" 연결을 다룹니다.
  • 에이전트 팀(Claude Code, 실험적): 단순 서브에이전트 위임을 넘어, 여러 Claude Code 세션이 공유 작업공간·파일을 통해 상태를 유지하며 협업하는 실험 기능.
  • 멀티에이전트의 비용 문제: 병렬 서브에이전트는 토큰 사용량이 단일 에이전트 대비 크게(수배) 늘어납니다. 따라서 "충분히 가치가 큰 병렬 조사"에만 정당화되며, 상태를 서로 공유해야 하는 긴밀한 코드 작업에는 오히려 컨텍스트 단절로 품질이 떨어질 수 있다는 것이 업계 반작용의 핵심 논지.

벤더별 비교

항목 Anthropic (Claude Code) OpenAI (Agents SDK / Codex) Google (A2A) Cognition (Devin)
핵심 개념 Subagents(Task 도구), Agent Teams(실험적) Handoffs, Guardrails, Sessions 에이전트 간 통신 프로토콜(벤더 중립) 단일 강력한 에이전트 지향, 멀티에이전트 신중론
위임 방식 위임 후 결과 요약 수신(컨텍스트 분리) 제어권 자체를 완전히 인계 표준 메시지로 태스크 위임·상태 스트리밍 컨텍스트 압축·긴 단일 세션 우선
거버넌스 Anthropic 자체 OpenAI 자체 Linux Foundation(2025-06 기증) 자체 블로그 기반 실무 가이드

잘 쓰는 법

  • 서브에이전트는 "독립적으로 검증 가능하고 결과만 필요한" 작업(코드 리뷰, 웹 리서치, 테스트 실행)에 씁니다. 서로 상태를 주고받아야 하는 긴밀한 리팩터링 작업을 여러 에이전트로 쪼개면 컨텍스트 불일치로 오히려 느려집니다.
  • 병렬 서브에이전트를 쓸 때는 토큰 비용이 단일 에이전트 대비 크게 늘어난다는 것을 전제하고, 그만큼 가치가 큰 작업(광범위 리서치, 독립적 다중 후보 탐색)에만 적용합니다.
  • 오케스트레이터에는 "무엇을, 왜, 어떤 형식으로 보고할지"를 명확히 지시합니다. 위임 지시가 모호하면 서브에이전트 결과의 품질 편차가 커집니다.
  • 서브에이전트 간 통신이 필요하면 A2A 같은 표준 프로토콜을 검토하되, 같은 벤더·프레임워크 안에서만 동작한다면 오히려 벤더 자체 서브에이전트/handoff 메커니즘이 더 단순합니다.
  • "멀티에이전트가 더 똑똑해 보인다"는 이유만으로 아키텍처를 복잡하게 만들지 않습니다 — 먼저 단일 에이전트 + 긴 컨텍스트로 해결이 안 되는지 확인한 뒤에 분리합니다.
  • 팀 단위로 여러 에이전트 세션을 동시에 돌릴 때는(예: Claude Code 에이전트 팀) 파일 충돌·상태 동기화 규칙을 먼저 정해둡니다.

타임라인

2025-04 · Google, A2A(Agent2Agent) 프로토콜 발표

  • 이전 대비: 최초 등장. 그전에는 에이전트 간 통신이 벤더별 사내 구현에 머물러 있었음.
  • 서로 다른 프레임워크로 만든 에이전트가 정체성·능력을 알리고 태스크를 위임·스트리밍할 수 있는 개방 프로토콜을 Google이 공개.
  • 출처: Agent2Agent - Wikipedia

2025-06-14 · Anthropic, 멀티에이전트 리서치 시스템 공개

  • 이전 대비: A2A가 에이전트 간 "통신 규격"이라면, 이 글은 오케스트레이터-워커 패턴의 실전 설계(토큰 소비, 병렬 조사, 실패 복구)를 처음으로 상세히 공개.
  • 리드 에이전트가 조사를 하위 과제로 나눠 여러 서브에이전트에 병렬 위임하고 결과를 합성하는 구조, 그리고 이 구조가 단일 에이전트보다 토큰을 훨씬 많이 쓴다는 점을 명시.
  • 출처: How we built our multi-agent research system

2025-06 · Cognition, "Don't Build Multi-Agents" 공개

  • 이전 대비: Anthropic의 멀티에이전트 옹호론 직후, 실무에서 병렬 서브에이전트가 컨텍스트 분산·상태 불일치로 실패하기 쉽다는 반대 논지를 제시.
  • 긴밀하게 연결된 작업(코드 작성 등)에는 단일 강력한 에이전트가 여러 병렬 에이전트보다 나을 수 있다는 주장을 데이터와 함께 제시.
  • 출처: Don't Build Multi-Agents - Cognition

2025-06-24 · Google, A2A 프로토콜을 Linux Foundation에 기증

2025-07-24 · Claude Code, 커스텀 서브에이전트(/agents) 출시

  • 이전 대비: 연구용 블로그 사례로만 알려졌던 오케스트레이터-워커 패턴이, 사용자가 직접 정의하는 제품 기능(/agents 명령, 파일 기반 서브에이전트 정의)으로 구현.
  • 사용자가 별도 시스템 프롬프트·도구 권한을 가진 서브에이전트를 정의해 메인 대화 컨텍스트를 오염시키지 않고 위임할 수 있게 됨.
  • 출처: Create custom subagents - Claude Code Docs

2025 (추정) · OpenAI Agents SDK, Handoffs 정식 지원

  • 이전 대비: Claude Code 서브에이전트의 "위임 후 요약"과 달리, 대화 제어권 자체를 다른 에이전트에게 완전히 넘기는 handoff 패턴을 SDK 1급 기능으로 제공.
  • 라우터 에이전트가 사용자의 요청을 분류해 전문 에이전트로 넘기는 패턴을 표준 API로 지원.
  • 출처: Handoffs - OpenAI Agents SDK

2026-02-05 · Claude Code, 에이전트 팀 리서치 프리뷰

  • 이전 대비: 단일 오케스트레이터가 서브에이전트를 호출하는 구조에서, 여러 세션이 공유 작업공간을 통해 동등하게 협업하는 구조로 확장.
  • Opus 4.6과 함께 실험적 "Agent Teams"가 리서치 프리뷰로 공개되어, 여러 Claude Code 세션이 상태를 공유하며 작업.
  • 출처: Claude Code Timeline

출처

  • Simon Willison, "How we built our multi-agent research system" (2025-06-14 기사)
  • Cognition, "Don't Build Multi-Agents" (2025-06)
  • SiliconANGLE, 2025-06-24
  • Wikipedia, "Agent2Agent"
  • Claude Code Docs, sub-agents
  • OpenAI Agents SDK 공식 문서, handoffs
  • scriptbyai.com, Claude Code Timeline