AI 작업 기억 관리 — 세션이 끊겨도 이어서 일하는 폴더 구조
AI와 작업하다 세션이 끊기면 맥락이 통째로 사라집니다. task·context·log 세 파일로 작업 기억을 파일에 남기고, 새 세션이 한 줄로 복귀하는 구조를 실제 운영 사례와 함께 정리합니다.
멀티에이전트, 장기 실행, 메모리 등 에이전트 심화·연구 콘텐츠 모음
AI와 작업하다 세션이 끊기면 맥락이 통째로 사라집니다. task·context·log 세 파일로 작업 기억을 파일에 남기고, 새 세션이 한 줄로 복귀하는 구조를 실제 운영 사례와 함께 정리합니다.
AI가 쓴 글에 존재하지 않는 출처가 섞이는 일은 흔합니다. 사람이 눈으로 확인하는 대신 링크 응답을 기계로 검증하고, 겪지 않은 경험을 쓰지 않게 규칙으로 막는 발행 게이트 구성법을 정리합니다.
AI 에이전트를 여러 개 띄웠는데 결과가 뒤엉킨다면 문제는 모델이 아니라 운영 구조입니다. 역할 분리, 지시서와 검수, 감사 분리, 작업 기록, 계측까지 멀티에이전트 협업의 실전 운영법을 정리합니다.
AI가 "검증 통과"라고 보고했는데 실제로는 아무것도 검사하지 않은 경우가 있습니다. 빈 대상, 동어반복 테스트, 파괴 후 비교라는 세 가지 함정과 이를 걸러내는 변이 검증 절차, 증거 양식을 정리합니다.
Claude Code가 읽는 CLAUDE.md에 무엇을 어떻게 적어야 하는지, 실전 예시와 함께 정리합니다. AGENTS.md·.cursorrules와의 차이도 다룹니다.
OpenAI가 GPT-5.6 계열 세 모델 Luna·Terra·Sol을 정식 출시했다. 가격, 공통 사양, 에이전트 벤치마크 주장과 새 API 기능을 제공된 자료 기준으로 정리한다.
긴 작업 궤적에서 중요한 상태가 컨텍스트 밖으로 밀려나는 문제를 별도의 메모리 에이전트가 능동적으로 개입해 완화하는 접근을 정리한다.
홍콩대 MMLab이 공개한 UniClawBench는 라이브 Docker와 폐루프 멀티턴 평가로 능동형 AI 에이전트의 다섯 가지 기본 역량을 분리 측정하는 벤치마크다.
단일 에이전트의 궤적 한계를 넘어, 검색 작업을 재귀적으로 위임해 깊고 넓은 웹 조사를 수행하는 멀티에이전트 프레임워크 WebSwarm을 소개한다.
도구 호출·분기·승인 같은 LLM 워크플로 실행 과정을 로그가 아니라 조회·재개·검토가 가능한 지식 객체로 다루는 개념 모델을 정리한다.
에이전트란 무엇인가라는 기본 질문부터 최신 모델의 에이전트 벤치마크, 실환경 평가, 장기 실행 중 메모리 관리, 재귀적 웹 검색까지 다섯 편의 가이드로 '에이전트'라는 주제를 한 바퀴 돌아봅니다.