ARCHIVE
아카이브
기존에 공개한 글을 원래 주소 그대로 보관합니다.
과거의 글에는 작성 당시의 기술과 관점이 담겨 있습니다.
356개 글 · 4 / 12 페이지
· KO
Claude Opus 4.8 Dynamic Workflows 실전 분석
Claude Opus 4.8의 1,000개 병렬 서브에이전트와 Fast Mode가 AI 에이전트 개발 워크플로우를 실제로 어떻게 바꾸는지 심층 분석. 공식 릴리스 문서와 실제 구현 사례를 기준으로 멀티에이전트 아키텍처, 비용 구조, 운영상 한계를 체계적으로 빠짐없이 정리했다.
· KO
Ollama + FastAPI 로컬 LLM API 서버 구축 — Docker 프로덕션 배포 가이드
Ollama REST API를 FastAPI로 래핑해 SSE 스트리밍·헬스 체크·Docker 컨테이너 배포까지 갖춘 프로덕션급 로컬 LLM 서버를 단계별로 구축합니다. Llama 3.2, Mistral 등 주요 모델 실행 로그와 API 테스트 예제를 포함한 실전 가이드.
· KO
MCP 원격 HTTP 서버 배포 패턴 — stdio에서 Streamable HTTP로 전환하는 실전 가이드
MCP Streamable HTTP 트랜스포트로 stdio 서버를 원격 배포 가능한 HTTP 서비스로 전환하는 실전 가이드. TypeScript v1.29.0 기준 stateful·stateless 모드 구현과 Docker·Cloudflare 배포 패턴을 실험 로그와 함께 설명합니다.
· KO
Jest에서 Vitest 4로 마이그레이션하기 — 설치부터 실전 테스트까지 완전 가이드
Vitest 4.1.7 기준으로 Jest 프로젝트를 단계별로 마이그레이션하는 실전 가이드. 설치, 설정 전환, jest→vitest 코드 변환 패턴, Browser Mode stable, 신규 매처(toSatisfy, toBeOneOf)까지 직접 실험한 결과를 담았다.
· KO
Bun Shell로 TypeScript 자동화 스크립트 만들기 — 설치부터 실전 패턴까지
Bun 1.3.14에서 직접 실험한 Bun Shell 완전 가이드. $ 템플릿 리터럴 기본 패턴, .nothrow() 에러 처리, Promise.all 병렬화, macOS echo 함정까지 실제 출력 로그와 함께 정리했다. zx와의 실질적 차이점과 프로덕션 배포 주의사항도 포함.
· KO
Gemini API 모델 선택 가이드 2026 — Flash-Lite·Flash·Pro 속도·비용 완전 비교
2026년 5월 실측 데이터. Gemini 2.5 Flash-Lite(65 TPS), 2.5 Flash, 2.5 Pro, 3.5 Flash를 동일 조건에서 비교했다. 챗봇·코드리뷰·RAG 시나리오별 월 비용 계산과 어떤 프로젝트에 어느 모델을 써야 하는지 결정 기준을 정리한다.
· KO
Vector DB 비교 2026: Qdrant vs ChromaDB vs pgvector 선택 가이드
Qdrant, ChromaDB, pgvector를 1000개 벡터(dim=384)로 직접 벤치마크했다. 삽입 속도·쿼리 지연·필터 성능 수치를 실측 데이터로 비교하고, RAG 앱 상황별 명확한 선택 기준을 제시한다. 소규모에서 ChromaDB가 더 빠른 이유도 설명한다.
· KO
RTK(Rust Token Killer) 직접 써봤다 — LLM 토큰 비용 60〜90% 줄이는 CLI 프록시
RTK(Rust Token Killer)는 AI 코딩 에이전트의 Bash 출력을 LLM에 보내기 전에 압축하는 CLI 프록시다. 직접 설치해 find에서 90%, ls에서 50% 절감을 측정했다. 효과가 있는 경우와 없는 경우, Claude Code 통합 방법, 솔직한 한계를 정리한다.
· KO
Google I/O 2026 Antigravity 2.0 — Gemini CLI 종료와 에이전트 IDE 전쟁
Google이 I/O 2026에서 Antigravity 2.0을 발표하며 Gemini CLI를 6월 18일부로 종료한다. 실제 설치된 앱의 확장 구조와 Gemini 3.5 Flash API를 직접 분석한다. Claude Code와의 비교, 에이전트 IDE 전쟁의 변화 지형도 다룬다.
· KO
Next.js 16 + Claude API로 스트리밍 AI 채팅 앱 만들기 — App Router 가이드
Next.js 16 App Router에서 Claude API 스트리밍을 완성하는 실전 가이드. Route Handler 설계, SSE 응답 처리, React 19 클라이언트 훅, 백프레셔와 타임아웃·에러 복구 패턴까지 실제로 빌드한 코드와 동작 로그를 모두 담아 정리했다.
· KO
AutoGen 0.7.x 멀티에이전트 실전 — AssistantAgent·GraphFlow 처음부터 구현
AutoGen 0.7.x의 새로운 API로 멀티에이전트 시스템을 처음부터 구현하는 실전 가이드. RoundRobinGroupChat, SelectorGroupChat, GraphFlow, FunctionTool을 직접 코드로 실행하며 0.2.x와 차이를 단계별로 비교한다.
· KO
Claude Agent SDK 서브에이전트 오케스트레이션 실전 가이드 — 멀티 에이전트 병렬 처리 완전 정복
claude-agent-sdk 0.2.82를 직접 설치해 AgentDefinition 구조와 서브에이전트 병렬 실행 패턴을 직접 검증했다. 오케스트레이터가 3개 서브에이전트를 동시에 스폰하고 TaskBudget으로 비용을 제어하는 전체 흐름을 Python 코드와 함께 설명한다.
· KO
Gemini 2.5 Flash Thinking API 개발 가이드 — thinking_budget 실험 결과
Gemini 2.5 Flash의 Thinking Budget을 Budget=0/1024/8000 세 가지로 단순 작업·수학 추론·코드 리뷰에 직접 실험했다. 단순 작업은 5배 느려지고, 수학 문제는 오히려 출력 토큰을 줄여준다. 작업 유형별 최적 설정 프레임워크를 공유한다.
· KO
Claude Managed Agents의 Dreaming, Outcomes, Orchestration
2026년 5월 Code with Claude SF에서 발표된 Dreaming, Outcomes, Multiagent Orchestration 기술 구조를 분석한다. Harvey 6배 수치의 맥락, LLM-as-judge 제품화, 자기 개선 루프의 거버넌스 리스크까지.
· KO
Cloudflare Agents Week 2026 — 에이전트가 클라우드를 직접 프로비저닝한다
Cloudflare Agents Week 2026 전체 발표 심층 분석 — Sandboxes GA, Artifacts, Dynamic Workers, 에이전트가 직접 인프라를 자율 프로비저닝하는 기능까지. @cloudflare/agents SDK 로컬 실험 결과 포함.
· KO
AWS MCP Server GA 실전 가이드 — CloudWatch·IAM 에이전트 연동 완전 분석
AWS MCP Server가 2026년 5월 정식 출시됐다. uvx 한 줄로 CloudWatch 31개 도구와 IAM 29개 도구를 Claude Code에 연결한 실전 설치기. IAM 조건 키 기반 에이전트 권한 분리 아키텍처와 실제 AWS 계정 테스트 결과, 솔직한 평가까지.
· KO
Claude Agent SDK 실전 가이드 — Tool Use로 AI 에이전트 구현하기
anthropic 0.101.0 SDK를 직접 설치해 tool_use 에이전틱 루프를 구현했다. JSON 스키마 도구 정의부터 다중 도구 호출, 에러 핸들링, 스트리밍 응답, 비용 최적화까지 — 챗봇과 에이전트를 가르는 핵심 패턴을 단계별 Python 실전 코드로 설명한다.
· KO
FastMCP 3.x로 Python MCP 서버 30분 만에 만들기 — @tool 데코레이터 하나면 충분하다
FastMCP 3.2.4를 직접 설치해 @mcp.tool(), @mcp.resource(), @mcp.prompt() 데코레이터로 동작하는 MCP 서버를 만들어봤다. Claude Desktop과 Cursor가 호출하는 AI 도구 서버를 Python 30줄로 구현하는 실전 가이드.
· KO
FastAPI + Claude API 스트리밍 백엔드 — SSE·재시도·에러 복구 프로덕션 가이드
FastAPI와 Anthropic SDK로 프로덕션 수준의 스트리밍 AI 백엔드를 구축하는 완전 가이드. SSE 스트리밍 엔드포인트, 레이트 리밋 지수 백오프 재시도, 에러 분류 전략, 토큰 스트리밍 최적화, Docker 컨테이너 배포까지 단계별 코드와 함께 정리합니다.
· KO
Claude Code 실전 마스터클래스 #1 — 슬래시 명령어·훅·서브에이전트 3단계 워크플로우 자동화
슬래시 명령어(.claude/commands/)로 작업을 정의하고, settings.json 훅으로 이벤트에 연결하고, 서브에이전트(.claude/agents/)에게 위임하는 3단계 Claude Code 자동화 패턴을 실제 블로그 자동화 시스템 구축 사례와 함께 설명합니다.
· KO
Anthropic SDK vs OpenAI SDK 개발자 경험 실측 비교 2026
anthropic 0.100.0과 openai 2.36.0을 직접 설치해 비교합니다. 타입 수 408 vs 230, 에러 계층 설계 차이, 스트리밍 구현 패턴, 툴 호출 포맷, SDK별 고유 기능까지 Python 코드로 직접 검증한 개발자를 위한 실전 비교 가이드입니다.
· KO
OpenAI Codex 클라우드 에이전트 vs Claude Code — 2026년 5월, 어느 쪽이 맞나
OpenAI Codex가 4월 대규모 업데이트로 클라우드 에이전트 워크스페이스로 전환했다. Claude Code와의 아키텍처·벤치마크·비용 차이를 실제 개발 워크플로우 관점에서 직접 비교하고, 2026년 5월 기준으로 어느 쪽이 팀에 더 적합한지 판단 기준을 제시한다.
· KO
uv로 AI 개발 환경 세팅하기 — Claude SDK 프로젝트를 0.87초 만에 시작하는 법
Rust로 만들어진 Python 패키지 매니저 uv 0.11로 anthropic, openai 등 AI SDK 개발 환경을 설정하는 완전 실전 가이드. pip 대비 100배+ 빠른 설치 속도, 재현 가능한 환경 관리, Claude SDK 프로젝트 시작까지 실제 로그와 함께 정리했다.
· KO
Gemini 2.5 Flash API 비용 최적화 실전 가이드 — 실험으로 확인한 99% 절감 전략
Gemini 2.5 Flash API를 직접 실험해서 발견한 비용 최적화 기법 4가지. Thinking 토큰 비활성화, Context Caching, Flash-Lite 선택 기준, Batch API 활용까지 — 실측 데이터로 99% 비용 절감 전략을 단계별로 검증합니다.
· KO
Anthropic Files API 실전 가이드 — PDF 반복 업로드 없이 문서 배치 분석하기
Anthropic Files API로 PDF·이미지를 한 번 업로드해 여러 API 요청에서 반복 재사용하는 실전 가이드. Python SDK 배치 분석 완성 코드, 프롬프트 캐싱과 비용 비교, file_id 관리 패턴, 문서당 최적 모델 선택 기준까지 상세히 다룹니다.
· KO
Google ADK vs LangGraph 2026: 두 AI 에이전트 프레임워크를 직접 설치하고 비교했다
Google ADK v1.32.0과 LangGraph v1.1.10을 샌드박스에서 직접 설치해 코드 구조, 의존성, 상태 관리, 조건부 분기, 배포 CLI까지 실험으로 비교했습니다. 어느 상황에서 어떤 프레임워크를 선택해야 하는지 실측 데이터를 바탕으로 명확하게 정리합니다.
· KO
Langfuse v3 셀프호스팅 완전 가이드 — LLM 트레이싱을 로컬에서 직접 구축하기
Langfuse v3를 Docker Compose로 셀프호스팅하는 완전한 실전 가이드. Python SDK 4.x 계측 코드 작성부터 RAG 파이프라인 트레이싱, 비용·지연 모니터링 대시보드 구성까지. 데이터 주권을 지키며 LLM 옵저버빌리티를 자체 인프라에 구축하세요.
· KO
Anthropic이 OpenClaw를 끊은 이유 — Claude 구독 정책 전환과 개발자 비용 현실
2026년 4월 4일, Anthropic이 Claude Pro/Max 구독으로 서드파티 에이전트(OpenClaw 등)를 차단했다. Fast Mode 6배 과금과 새 토큰나이저 비용 충격까지 더해진 구조적 전환이 개발자 워크플로우에 미치는 영향을 비용 계산과 함께 분석한다.
· KO
Anthropic 4월 쌍둥이 출시 — Opus 4.7과 Managed Agents의 에이전트 비용 충격
Claude Opus 4.7(4월 16일)과 Managed Agents 베타(4월 8일)가 같은 달 출시됐다. 역대급 벤치마크 뒤에 숨겨진 토큰나이저 비용 충격, task_budget 설계 원리, 세션당 $0.08 에이전트 모델의 실제 의미를 EM 시각에서 깊이 분석한다.
· KO
GitHub Actions + Claude Code CLI로 PR 자동 리뷰 파이프라인 구축하기
GitHub Actions에 claude -p를 직접 연동해 PR 리뷰를 자동화하는 실전 가이드. --bare, --dangerously-skip-permissions, --max-budget-usd 플래그로 CI 환경에서 안전하게 Claude Code를 실행하는 법을 설명합니다.