📕 이 사이트를 굴린 428커밋의 기록이 상품이 됐습니다 — 전자책·스타터 키트 보기 →
agenwiki

AI 연구

WebSwarm: 깊이와 폭을 동시에 잡는 멀티에이전트 웹 검색

단일 에이전트의 궤적 한계를 넘어, 검색 작업을 재귀적으로 위임해 깊고 넓은 웹 조사를 수행하는 멀티에이전트 프레임워크 WebSwarm을 소개한다.

WebSwarm은 단일 에이전트의 궤적·컨텍스트 한계를 넘기 위해 검색 작업을 재귀적으로 하위 노드에 위임하는 멀티에이전트 웹 검색 프레임워크다. 각 검색 노드는 스스로 목표를 풀거나 하위 노드에 다시 위임하고, 근거와 결과를 상위 노드로 되돌려 취합한다. BrowseComp-Plus·WideSearch·DeepWideSearch·GISA 네 벤치마크에서 단일 에이전트와 기존 멀티에이전트 기준선을 일관되게 앞섰다.

LLM 기반 웹 검색 에이전트는 단순한 사실 질의응답을 넘어, 깊이 있고 폭넓은 조사형 작업까지 다루는 방향으로 확장되고 있다. 그런데 ReAct 방식의 단일 에이전트는 하나의 긴 궤적과 제한된 컨텍스트 윈도우에 묶여 있어서, 깊이와 범위를 동시에 챙기기가 어렵다. 병렬 실행과 결과 취합으로 커버리지를 넓히는 기존 멀티에이전트 시스템도 재귀적인 깊이 확장, 협업 유연성, 근거 기반 확장 면에서는 한계가 뚜렷하다는 것이 이 논문의 문제의식이다.

일반적으로 단일 에이전트가 조사를 오래 이어갈수록 이전 검색 결과와 중간 판단이 쌓여 컨텍스트 윈도우를 채우게 되고, 결국 새로운 정보를 담을 여유가 줄어든다. 이런 구조적 한계가 깊고 넓은 조사형 작업에서 단일 에이전트 방식이 흔히 부딪히는 병목 중 하나로 꼽힌다.

검색을 어떻게 재귀적으로 위임하나?

이 논문이 제안하는 WebSwarm은 추론 과정 중에 과제 분해, 재귀적 확장, 에이전트 간 협업을 함께 구성해 나가는 점진적 재귀 위임 프레임워크다. WebSwarm은 검색을 수행하는 에이전트 노드를 동적으로 만들어 내는데, 각 노드는 자신의 목표와 함께 그 목표를 어떤 방식으로 조직하고 협업할지를 정하는 검색 모드를 갖는다. 노드의 동작은 다음과 같이 이어진다.

  1. 노드가 스스로 목표를 해결하거나, 하위 노드에 다시 위임한다.
  2. 하위 노드가 문제를 풀면 근거와 결과를 상위 노드로 되돌려 보낸다.
  3. 상위 노드는 이를 바탕으로 검색 과정을 더 확장하거나 수정하거나 취합한다.

확장은 무엇을 근거로 이끄나?

이 확장 과정을 이끌기 위해 WebSwarm은 먼저 과제와 관련된 정보가 웹에서 어떻게 조직되어 있는지를 탐지해 이후 노드 확장의 근거로 삼는다. 또한 성격이 비슷한 형제 노드들 사이에서는 과정 수준의 경험을 재사용한다.

벤치마크 결과는 어땠나?

BrowseComp-Plus, WideSearch, DeepWideSearch, GISA 네 가지 벤치마크에서 WebSwarm은 깊은 조사, 넓은 조사, 그리고 깊이와 폭이 뒤섞인 과제 모두에서 단일 에이전트 방식과 기존 멀티에이전트 기준선을 일관되게 앞섰다. 저자들은 제거 실험, 과제 난이도별 분석, 웹 도구 사용 효율, 모델 일반화 분석을 통해 이런 효과의 원인을 짚고, 멀티에이전트 검색 시스템 설계에 대한 시사점을 제시한다.

실무자는 무엇을 고려해야 하나?

리서치 자동화나 웹 조사 에이전트를 설계하는 실무자에게 이런 재귀적 위임 구조는 참고할 만한 설계 패턴이다. 하나의 에이전트가 모든 것을 처리하려 하면 컨텍스트 윈도우와 추론 궤적이 함께 한계에 부딪히기 쉬운데, 과제를 하위 목표로 쪼개 별도의 에이전트 노드에 위임하고 결과만 상위로 취합하는 구조는 이런 병목을 완화하는 방향이다. 다만 에이전트 수가 늘어날수록 조율 비용과 API 호출 비용도 함께 늘어나므로, 실제 적용 시에는 과제의 복잡도에 맞춰 위임 깊이를 제한하는 장치를 함께 고려할 필요가 있다.

자주 묻는 질문

  • Q. 단일 에이전트의 한계가 무엇인가?
    • A. 하나의 긴 궤적과 제한된 컨텍스트 윈도우에 묶여, 조사가 길어질수록 새 정보를 담을 여유가 줄어 깊이와 범위를 동시에 챙기기 어렵다.
  • Q. 어떤 벤치마크로 검증했나?
    • A. BrowseComp-Plus, WideSearch, DeepWideSearch, GISA 네 가지 벤치마크에서 검증했다.
  • Q. 실무 도입 시 주의점은?
    • A. 에이전트 수가 늘수록 조율 비용과 API 호출 비용도 늘어나므로, 과제 복잡도에 맞춰 위임 깊이를 제한하는 장치를 함께 고려해야 한다.

함께 보면 좋은 글

출처: arXiv:2607.08662v1 https://arxiv.org/abs/2607.08662v1

실무에서 여러 에이전트를 한 팀으로 운영하는 방법은 멀티에이전트 운영법에서 다룹니다.

관련 글