GLM-5: MIT 라이선스 프런티어 모델의 등장과 엔터프라이즈 전략
Zhipu AI의 GLM-5는 744B MoE 구조로 NVIDIA 없이 화웨이 Ascend 칩만으로 훈련된 MIT 오픈소스 최전선 모델입니다. EM/CTO 관점에서 엔터프라이즈 AI 전략을 재검토합니다.
archive
356 · 페이지 15
Zhipu AI의 GLM-5는 744B MoE 구조로 NVIDIA 없이 화웨이 Ascend 칩만으로 훈련된 MIT 오픈소스 최전선 모델입니다. EM/CTO 관점에서 엔터프라이즈 AI 전략을 재검토합니다.
AutoGen과 Semantic Kernel이 통합된 Microsoft Agent Framework가 Q1 2026 GA를 앞두고 있습니다. EM/CTO 관점에서 핵심 기능, 마이그레이션 전략, 프로덕션 도입 로드맵을 정리합니다.
OpenAI가 AI 보안 테스트 플랫폼 Promptfoo를 인수했다. Fortune 500의 25%가 사용하는 이 도구가 Frontier에 통합되면서 AI 에이전트 DevSecOps의 새로운 표준이 형성된다. 레드팀 테스트와 CI/CD 보안 파이프라인 구축법을 소개합니다.
수천 개 AI 에이전트 벤더 중 진짜는 130개뿐. Engineering Manager가 진짜 에이전틱 AI와 단순 자동화를 구별하는 7가지 실전 체크리스트. 목표 재설정, 컨텍스트 기억, 도구 유연성, 실패 복구 테스트와 벤더 미팅 질문 목록을 제공합니다.
Anthropic Institute 출범과 Claude Partner Network $1억 투자, Claude Certified Architect 인증까지. CTO 관점에서 AI 벤더 생태계 성숙도를 분석합니다.
OpenAI가 GPT-5.4를 출시했습니다. OSWorld 벤치마크에서 인간(72.4%)을 뛰어넘은 컴퓨터 사용 능력(75%), 1M 토큰 컨텍스트 윈도우, 툴 서치로 47% 토큰 절감까지 — EM 관점에서 핵심 임팩트를 분석합니다.
2026년 AI 에이전트 프로덕션 전환의 핵심 과제를 해결하는 9가지 설계 원칙을 arXiv 논문과 실무 사례를 통해 Engineering Manager 관점으로 정리합니다.
멀티 에이전트 시스템을 프로덕션에서 운영할 때 반드시 갖춰야 할 옵저버빌리티 전략의 실전 가이드. OpenTelemetry 트레이싱·메트릭·로그 구조화부터 Langfuse·LangSmith·Braintrust 3종 도구 비교, 알림 설계까지 EM 관점으로 상세히 총정리.
MCP Apps가 AI 에이전트 UX를 어떻게 바꾸는지, sandboxed iframe과 JSON-RPC 양방향 통신 아키텍처부터 실전 구현 코드까지 Engineering Manager 관점에서 완벽 해설합니다.
MCP 서버 연동 시 매 턴마다 전체 스키마를 주입하면 120개 툴 기준 362,000 토큰이 낭비된다. mcp2cli는 CLI 기반 온디맨드 디스커버리로 이 비용을 96〜99% 줄인다. 구조, 실측 수치, 도입 전략을 정리한다.
OpenAI가 공개한 Open Responses 스펙이 에이전틱 AI 워크플로우를 표준화합니다. 핵심 개념, 지원 생태계, EM/CTO 관점의 도입 전략을 분석합니다.
Anthropic이 발표한 Claude Code의 Code Review 기능 완전 분석: 병렬 멀티 에이전트 아키텍처, PR당 평균 $15〜25 비용 구조, 그리고 Engineering Manager가 도입을 검토할 때 알아야 할 모든 것