「발견됨 – 미색인」 79건의 원인을 직접 찾아본 기록
구글이 크롤은 했는데 색인하지 않는 상태. 사이트 5개를 에이전트 12기로 진단해 찾은 구조 결함 9가지와, 고친 뒤 실제로 달라진 수치를 그대로 공개합니다.
멀티에이전트, 장기 실행, 메모리 등 에이전트 심화·연구 콘텐츠 모음
구글이 크롤은 했는데 색인하지 않는 상태. 사이트 5개를 에이전트 12기로 진단해 찾은 구조 결함 9가지와, 고친 뒤 실제로 달라진 수치를 그대로 공개합니다.
AI 에이전트 5개가 릴레이로 협업해 문서 하나를 완성하는 데 든 실제 비용과 홉별 내역을 공개합니다. 어느 역할이 비싸고 어디를 아낄 수 있는지 실측으로 확인했습니다.
AI와 작업하다 세션이 끊기면 맥락이 통째로 사라집니다. task·context·log 세 파일로 작업 기억을 파일에 남기고, 새 세션이 한 줄로 복귀하는 구조를 실제 운영 사례와 함께 정리합니다.
AI가 쓴 글에 존재하지 않는 출처가 섞이는 일은 흔합니다. 사람이 눈으로 확인하는 대신 링크 응답을 기계로 검증하고, 겪지 않은 경험을 쓰지 않게 규칙으로 막는 발행 게이트 구성법을 정리합니다.
AI 에이전트를 여러 개 띄웠는데 결과가 뒤엉킨다면 문제는 모델이 아니라 운영 구조입니다. 역할 분리, 지시서와 검수, 감사 분리, 작업 기록, 계측까지 멀티에이전트 협업의 실전 운영법을 정리합니다.
AI가 "검증 통과"라고 보고했는데 실제로는 아무것도 검사하지 않은 경우가 있습니다. 빈 대상, 동어반복 테스트, 파괴 후 비교라는 세 가지 함정과 이를 걸러내는 변이 검증 절차, 증거 양식을 정리합니다.
Claude Code가 읽는 CLAUDE.md에 무엇을 어떻게 적어야 하는지, 실전 예시와 함께 정리합니다. AGENTS.md·.cursorrules와의 차이도 다룹니다.
OpenAI가 GPT-5.6 계열 세 모델 Luna·Terra·Sol을 정식 출시했다. 가격, 공통 사양, 에이전트 벤치마크 주장과 새 API 기능을 제공된 자료 기준으로 정리한다.
긴 작업 궤적에서 중요한 상태가 컨텍스트 밖으로 밀려나는 문제를 별도의 메모리 에이전트가 능동적으로 개입해 완화하는 접근을 정리한다.
홍콩대 MMLab이 공개한 UniClawBench는 라이브 Docker와 폐루프 멀티턴 평가로 능동형 AI 에이전트의 다섯 가지 기본 역량을 분리 측정하는 벤치마크다.
단일 에이전트의 궤적 한계를 넘어, 검색 작업을 재귀적으로 위임해 깊고 넓은 웹 조사를 수행하는 멀티에이전트 프레임워크 WebSwarm을 소개한다.
도구 호출·분기·승인 같은 LLM 워크플로 실행 과정을 로그가 아니라 조회·재개·검토가 가능한 지식 객체로 다루는 개념 모델을 정리한다.
모델이 한 번에 답하는 대신 계획·실행·점검을 여러 차례 반복하며 작업을 진행하도록 짜 놓은 구성이다. 도구 호출과 자기 점검을 루프로 묶어 한 번의 응답으로는 어려운 일을 해낸다.
에이전트란 무엇인가라는 기본 질문부터 최신 모델의 에이전트 벤치마크, 실환경 평가, 장기 실행 중 메모리 관리, 재귀적 웹 검색까지 다섯 편의 가이드로 '에이전트'라는 주제를 한 바퀴 돌아봅니다.