Vitest 4로 AI 에이전트 테스트하기 — LLM 호출 모킹, 스트리밍 응답 테스트 실전 패턴
Vitest 4.1.7로 Anthropic SDK messages.create()와 스트리밍 응답을 모킹하는 실전 패턴. vi.fn()과 화살표 함수 차이, async function* 제너레이터로 SSE 스트림을 재현해 9개 테스트를 142ms에 통과시키는 방법을 안내한다.
태그
7개 글
Vitest 4.1.7로 Anthropic SDK messages.create()와 스트리밍 응답을 모킹하는 실전 패턴. vi.fn()과 화살표 함수 차이, async function* 제너레이터로 SSE 스트림을 재현해 9개 테스트를 142ms에 통과시키는 방법을 안내한다.
Google I/O 2026에서 발표된 Gemini Managed Agents를 직접 실행해봤다. client.interactions.create() 한 번으로 에이전트를 돌리는 구조, Claude·OpenAI Managed Agents와의 차이점, 멀티턴 대화 구현까지 코드로 정리한다.
Claude Opus 4.8의 1,000개 병렬 서브에이전트와 Fast Mode가 AI 에이전트 개발 워크플로우를 실제로 어떻게 바꾸는지 심층 분석. 공식 릴리스 문서와 실제 구현 사례를 기준으로 멀티에이전트 아키텍처, 비용 구조, 운영상 한계를 체계적으로 빠짐없이 정리했다.
2026년 5월 Code with Claude SF에서 발표된 Dreaming, Outcomes, Multiagent Orchestration 기술 구조를 분석한다. Harvey 6배 수치의 맥락, LLM-as-judge 제품화, 자기 개선 루프의 거버넌스 리스크까지.
Cloudflare Agents Week 2026 전체 발표 심층 분석 — Sandboxes GA, Artifacts, Dynamic Workers, 에이전트가 직접 인프라를 자율 프로비저닝하는 기능까지. @cloudflare/agents SDK 로컬 실험 결과 포함.
Claude Opus 4.7(4월 16일)과 Managed Agents 베타(4월 8일)가 같은 달 출시됐다. 역대급 벤치마크 뒤에 숨겨진 토큰나이저 비용 충격, task_budget 설계 원리, 세션당 $0.08 에이전트 모델의 실제 의미를 EM 시각에서 깊이 분석한다.
MCP, A2A, Open Responses 세 프로토콜의 설계 목적과 생태계를 비교합니다. 2026년 실전 에이전트 프로젝트에서 각 프로토콜의 사용 시점과 조합 방법, OpenAI·Google·Anthropic이 벌이는 에이전트 통신 표준 경쟁의 핵심을 정리했습니다.