ARCHIVE
아카이브
기존에 공개한 글을 원래 주소 그대로 보관합니다.
과거의 글에는 작성 당시의 기술과 관점이 담겨 있습니다.
356개 글 · 6 / 12 페이지
· KO
LiteLLM 공급망 공격 — AI 인프라 의존성의 보안 사각지대
PyPI를 통해 발생한 LiteLLM 공급망 공격 사례를 심층 분석합니다. AI 개발 도구 체인의 의존성 취약점과 악성 패키지 탐지 방법, 공급망 보안 강화 전략을 다루며, 엔지니어링 팀이 즉시 실무에 적용할 수 있는 구체적인 방어 절차와 보안 체크리스트를 제공합니다.
· KO
AI 코딩 에이전트가 2,900만 시크릿을 유출시켰다 — MCP 설정 파일 보안의 사각지대
GitGuardian 2026 리포트에 따르면 AI 코딩 도구 사용 리포지토리의 시크릿 유출률은 GitHub 평균의 2배다. MCP 설정 파일에서만 24,000개 이상의 크리덴셜이 노출됐다. 실제 점검 방법과 대응책을 정리한다.
· KO
Mistral Voxtral TTS — 3초 보이스 클로닝에 오픈 웨이트, 그런데 일본어가 없다
Mistral이 공개한 4B 파라미터 오픈 웨이트 TTS 모델 Voxtral을 분석한다. ElevenLabs를 인간 평가에서 이겼고 3초 보이스 클로닝을 지원하지만, 일본어·한국어 미지원이라는 치명적 빈자리가 아시아 시장 활용을 막는다. 라이선스 함정과 실무 대안도 함께 짚는다.
· KO
Gemini 3.1 Flash Live로 실시간 음성 에이전트 만들기 — 써보니 이런 느낌
Google이 공개한 Gemini 3.1 Flash Live의 실시간 음성·영상 에이전트 구축 기능을 분석합니다. API 구조, 도구 호출, 90개 언어 지원 등 실제 개발자 관점에서 가능성과 한계를 짚어봅니다.
· KO
GitHub Copilot이 4월부터 내 코드로 AI를 학습한다 — 옵트아웃 안 하면 동의한 것
GitHub이 3월 25일 Copilot Free·Pro·Pro+ 사용자의 코드 스니펫과 채팅 인터랙션 데이터를 AI 모델 학습에 기본 사용하겠다고 발표했다. 4월 24일까지 설정 변경이 없으면 자동 동의로 처리된다. 옵트아웃 방법, 수집 데이터 범위, 개발자 실무 대응법을 정리한다.
· KO
Google TurboQuant — KV Cache를 3비트로 압축해도 정확도가 안 떨어진다고?
Google이 발표한 TurboQuant의 PolarQuant+QJL 기법을 분석한다. KV cache 메모리 6배 절감, 어텐션 8배 가속이 실제로 의미하는 것.
· KO
Vibe Physics — 물리학 교수가 Claude에게 논문을 시켜봤다
Anthropic Science 블로그 첫 글에서 하버드 물리학 교수 Matthew Schwartz가 Claude를 "대학원생"처럼 지도한 실험을 분석합니다. 110번의 드래프트, 36M 토큰, 그리고 2주 만에 나온 논문.
· KO
Dapr Agents v1.0 GA — AI 에이전트를 Kubernetes에서 죽지 않게 만드는 법
KubeCon Europe 2026에서 발표된 Dapr Agents v1.0의 durable workflow, 자동 복구, scale-to-zero를 분석하고, 기존 에이전트 프레임워크와의 차이를 짚어봅니다.
· KO
NemoClaw — NVIDIA가 OpenClaw에 엔터프라이즈 보안을 입혔다
GTC 2026에서 발표된 NVIDIA NemoClaw는 OpenClaw를 기업 환경에서 안전하게 운용하기 위한 오픈소스 레퍼런스 스택이다. 알파 단계의 현실적 한계와 가능성을 짚어본다.
· KO
Claude Code Channels로 텔레그램에서 코딩 시키기 — OpenClaw 사용자가 본 솔직한 비교
Claude Code에 Channels 기능이 추가됐다. 텔레그램에서 메시지를 보내면 로컬 터미널의 Claude가 코드를 실행하고 답장한다. OpenClaw의 채널 개념을 가져오면서도 보안 모델을 완전히 다르게 설계한 점이 흥미롭다.
· KO
Deeptune: AI 에이전트 '트레이닝 짐' — a16z $43M 투자와 에이전트 훈련의 미래
Deeptune이 a16z 주도로 $43M Series A 투자를 유치했습니다. 전문 업무 워크플로우를 시뮬레이션하는 RL 환경에서 AI 에이전트를 훈련하는 '트레이닝 짐' 접근법의 작동 원리와, 이것이 엔지니어링 조직의 채용·자동화 전략에 미칠 실질적 영향을 함께 분석합니다.
· KO
IBM의 Confluent $110억 인수 — 실시간 데이터가 AI 에이전트의 연료가 되는 시대
IBM이 Confluent를 $110억에 인수하며 실시간 데이터 스트리밍이 AI 에이전트의 핵심 인프라로 부상했다. CTO 관점에서 이 인수의 의미와 엔지니어링 조직의 대응 전략을 분석한다.
· KO
Gemini Embedding 2 — 멀티모달 임베딩이 RAG 파이프라인을 바꾼다
Google이 발표한 첫 네이티브 멀티모달 임베딩 모델 Gemini Embedding 2의 핵심 기능과 기존 텍스트 전용 임베딩 대비 아키텍처 변화, RAG 파이프라인 실전 적용법을 EM 관점에서 정리한다.
· KO
AlphaEvolve가 라마지 수 5개를 갱신하다 — AI가 수학 연구의 동반자가 되는 시대
Google DeepMind의 AlphaEvolve가 최대 20년간 유지되던 라마지 수 하한 5개를 동시에 갱신한 사례를 분석하고, AI가 코딩 도구를 넘어 과학 연구의 동반자가 되는 흐름을 CTO/EM 관점에서 정리합니다.
· KO
Hindsight — AI 에이전트에 학습하는 기억을 부여하는 오픈소스 MCP 메모리
AI 에이전트에 학습하는 기억을 부여하는 오픈소스 MCP 메모리 시스템 Hindsight. LongMemEval 91.4% 달성의 3계층 기억 구조, Retain·Recall·Reflect, Mental Model 자동 형성과 Docker 5분 도입 방법을 분석합니다.
· KO
Morgan Stanley가 경고한 2026 AI 도약 — CTO가 지금 준비해야 할 5가지
Morgan Stanley가 경고한 2026년 상반기 AI 능력의 비선형 도약. AI 로드맵 분기 재설계, Centaur Pod 팀 구조, 하이브리드 인프라 비용, 거버넌스 프레임워크, AI 리터러시까지 CTO와 엔지니어링 리더가 지금 실행해야 할 5가지 준비 전략을 정리합니다.
· KO
Perplexity Computer — 나 대신 24시간 일하는 AI 에이전트의 등장
Perplexity가 발표한 Personal Computer와 Enterprise를 분석합니다. 24/7 상시 AI 에이전트가 4주 만에 3.25년치 업무를 처리한 사례와 EM 관점 도입 전략을 다룹니다.
· KO
AI 에이전트 아이덴티티 다크 매터: 기업의 80%가 자신의 AI를 통제하지 못하는 이유
기업의 70%가 AI 에이전트를 운용 중이지만, 80%는 에이전트의 실시간 행동을 파악하지 못합니다. Identity Dark Matter 개념, 거버넌스 격차 실태, EM/CTO를 위한 5단계 대응 전략을 정리합니다.
· KO
GLM-5: MIT 라이선스 프런티어 모델의 등장과 엔터프라이즈 전략
Zhipu AI의 GLM-5는 744B MoE 구조로 NVIDIA 없이 화웨이 Ascend 칩만으로 훈련된 MIT 오픈소스 최전선 모델입니다. EM/CTO 관점에서 엔터프라이즈 AI 전략을 재검토합니다.
· KO
Microsoft Agent Framework GA: AutoGen + Semantic Kernel 통합 완성
AutoGen과 Semantic Kernel이 통합된 Microsoft Agent Framework가 Q1 2026 GA를 앞두고 있습니다. EM/CTO 관점에서 핵심 기능, 마이그레이션 전략, 프로덕션 도입 로드맵을 정리합니다.
· KO
OpenAI의 Promptfoo 인수 — AI 에이전트 DevSecOps 시대가 열린다
OpenAI가 AI 보안 테스트 플랫폼 Promptfoo를 인수했다. Fortune 500의 25%가 사용하는 이 도구가 Frontier에 통합되면서 AI 에이전트 DevSecOps의 새로운 표준이 형성된다. 레드팀 테스트와 CI/CD 보안 파이프라인 구축법을 소개합니다.
· KO
에이전트 워싱 감별법: EM을 위한 7가지 체크리스트
수천 개 AI 에이전트 벤더 중 진짜는 130개뿐. Engineering Manager가 진짜 에이전틱 AI와 단순 자동화를 구별하는 7가지 실전 체크리스트. 목표 재설정, 컨텍스트 기억, 도구 유연성, 실패 복구 테스트와 벤더 미팅 질문 목록을 제공합니다.
· KO
Anthropic의 AI 생태계 대전환 — 연구소와 $1억 파트너 투자
Anthropic Institute 출범과 Claude Partner Network $1억 투자, Claude Certified Architect 인증까지. CTO 관점에서 AI 벤더 생태계 성숙도를 분석합니다.
· KO
GPT-5.4 출시 — 네이티브 컴퓨터 사용과 1M 컨텍스트가 엔지니어링 팀을 바꾼다
OpenAI가 GPT-5.4를 출시했습니다. OSWorld 벤치마크에서 인간(72.4%)을 뛰어넘은 컴퓨터 사용 능력(75%), 1M 토큰 컨텍스트 윈도우, 툴 서치로 47% 토큰 절감까지 — EM 관점에서 핵심 임팩트를 분석합니다.
· KO
AI 에이전트 프로덕션 배포를 위한 9가지 설계 원칙 — arXiv 최신 논문 기반 실전 가이드
2026년 AI 에이전트 프로덕션 전환의 핵심 과제를 해결하는 9가지 설계 원칙을 arXiv 논문과 실무 사례를 통해 Engineering Manager 관점으로 정리합니다.
· KO
AI 에이전트 옵저버빌리티 실전 가이드: 프로덕션 LLM 시스템을 투명하게 만드는 방법
멀티 에이전트 시스템을 프로덕션에서 운영할 때 반드시 갖춰야 할 옵저버빌리티 전략의 실전 가이드. OpenTelemetry 트레이싱·메트릭·로그 구조화부터 Langfuse·LangSmith·Braintrust 3종 도구 비교, 알림 설계까지 EM 관점으로 상세히 총정리.
· KO
MCP Apps: AI 채팅 안에서 인터랙티브 UI가 동작한다
MCP Apps가 AI 에이전트 UX를 어떻게 바꾸는지, sandboxed iframe과 JSON-RPC 양방향 통신 아키텍처부터 실전 구현 코드까지 Engineering Manager 관점에서 완벽 해설합니다.
· KO
mcp2cli — MCP 토큰 비용을 96〜99% 절감하는 CLI 기반 툴 디스커버리
MCP 서버 연동 시 매 턴마다 전체 스키마를 주입하면 120개 툴 기준 362,000 토큰이 낭비된다. mcp2cli는 CLI 기반 온디맨드 디스커버리로 이 비용을 96〜99% 줄인다. 구조, 실측 수치, 도입 전략을 정리한다.
· KO
OpenAI Open Responses — 에이전틱 AI 워크플로우의 공통 표준이 등장하다
OpenAI가 공개한 Open Responses 스펙이 에이전틱 AI 워크플로우를 표준화합니다. 핵심 개념, 지원 생태계, EM/CTO 관점의 도입 전략을 분석합니다.
· KO
Claude Code Review — 멀티 에이전트 PR 리뷰로 코드 리뷰율 16%→54% 달성
Anthropic이 발표한 Claude Code의 Code Review 기능 완전 분석: 병렬 멀티 에이전트 아키텍처, PR당 평균 $15〜25 비용 구조, 그리고 Engineering Manager가 도입을 검토할 때 알아야 할 모든 것