모델 버전을 올릴 때마다 인젝션 테스트를 다시 돌리는 이유: 게이트를 직접 짜봤다
LLM 파이프라인에 프롬프트 인젝션 회귀 스위트를 직접 돌렸다. 순진한 키워드 가드는 11건 중 2건, 구조적 가드는 11건 전부를 잡았고, 내가 저지른 리팩터링이 떨어뜨린 탐지까지 게이트가 집어냈다. 모델 버전을 올릴 때마다 다시 돌려야 하는 이유를 실측으로 정리했다.
태그
12개 글
LLM 파이프라인에 프롬프트 인젝션 회귀 스위트를 직접 돌렸다. 순진한 키워드 가드는 11건 중 2건, 구조적 가드는 11건 전부를 잡았고, 내가 저지른 리팩터링이 떨어뜨린 탐지까지 게이트가 집어냈다. 모델 버전을 올릴 때마다 다시 돌려야 하는 이유를 실측으로 정리했다.
WebMCP가 Chrome 149 오리진 트라이얼로 배포됐지만 2월 API는 이미 바뀌었다. navigator.modelContext는 document.modelContext로 옮겨졌고 provideContext는 보안 문제로 사라졌다. 지금 등록해야 할 툴 형태를 정리했다.
Anthropic의 npm 패키지 배포 실수로 Claude Code 전체 소스가 공개됐다. 에이전트 루프, 메모리 시스템, 비용 최적화 전략까지 — 유출된 코드에서 개발자가 실제로 가져갈 수 있는 것들을 정리한다.
MCP가 월 9,700만 다운로드를 돌파하며 사실상 표준이 됐지만, 에이전트가 어떤 도구를 얼마나 호출하는지 통제하는 레이어는 빠져 있다. MCP Gateway 패턴으로 이 문제를 풀어본다.
PyPI를 통해 발생한 LiteLLM 공급망 공격 사례를 심층 분석합니다. AI 개발 도구 체인의 의존성 취약점과 악성 패키지 탐지 방법, 공급망 보안 강화 전략을 다루며, 엔지니어링 팀이 즉시 실무에 적용할 수 있는 구체적인 방어 절차와 보안 체크리스트를 제공합니다.
GitGuardian 2026 리포트에 따르면 AI 코딩 도구 사용 리포지토리의 시크릿 유출률은 GitHub 평균의 2배다. MCP 설정 파일에서만 24,000개 이상의 크리덴셜이 노출됐다. 실제 점검 방법과 대응책을 정리한다.
GTC 2026에서 발표된 NVIDIA NemoClaw는 OpenClaw를 기업 환경에서 안전하게 운용하기 위한 오픈소스 레퍼런스 스택이다. 알파 단계의 현실적 한계와 가능성을 짚어본다.
기업의 70%가 AI 에이전트를 운용 중이지만, 80%는 에이전트의 실시간 행동을 파악하지 못합니다. Identity Dark Matter 개념, 거버넌스 격차 실태, EM/CTO를 위한 5단계 대응 전략을 정리합니다.
GitHub Codespaces에서 발견된 RoguePilot 취약점 분석과 AI 코딩 도구의 패시브 프롬프트 인젝션 위험, EM이 팀에 적용해야 할 보안 가이드라인을 정리합니다.
MCP(Model Context Protocol)의 공격 표면이 급속 확대되고 있습니다. 30개 CVE 분석, 3계층 공격 모델, 엔터프라이즈 보안 하드닝 체크리스트를 정리합니다.
NIST AI Agent Standards Initiative의 핵심 내용과 Engineering Manager가 팀 내 AI 에이전트 보안을 체계적으로 강화하기 위한 단계별 체크리스트를 정리합니다. 접근 제어, 감사 로그, 가드레일 설계까지 실전 대응 전략을 제시합니다.
ICML에 제출된 논문 PDF에 "특정 문구를 리뷰에 포함하라"는 프롬프트 인젝션이 숨겨진 사건이 발각됐습니다. AI 심사에 의존하는 학술 peer review의 구조적 취약성과 공격 원리, 실제 위험 시나리오, 그리고 학계가 마련해야 할 방어책까지 기술적으로 해설합니다.