ARCHIVE
아카이브
기존에 공개한 글을 원래 주소 그대로 보관합니다.
과거의 글에는 작성 당시의 기술과 관점이 담겨 있습니다.
356개 글 · 6 / 12 페이지
· ZH
LiteLLM供应链攻击 — AI基础设施依赖的安全盲区
深入分析PyPI上发生的LiteLLM供应链攻击。涵盖AI工具链依赖漏洞与恶意包检测方法、供应链安全强化策略, 以及工程团队可立即应用于实务的具体防御步骤与安全检查清单。
· ZH
AI编程代理泄露了2900万个密钥 — MCP配置文件安全的盲区
根据GitGuardian 2026报告,使用AI编程工具的仓库密钥泄露率是GitHub平均水平的2倍。仅MCP配置文件就暴露了超过24,000个凭证。本文整理了实际排查方法和应对措施。
· ZH
Mistral Voxtral TTS — 3秒语音克隆+开放权重,但不支持日语
分析Mistral于2026年3月发布的4B参数开放权重TTS模型Voxtral:盲测中以更自然语调击败ElevenLabs Flash v2.5,3秒音频即可完成零样本语音克隆,且仅需8GB显存本地运行。然而日语和韩语的缺席是进军亚洲市场的致命短板。详解CC BY NC 4.0商用限制及替代方案选型。
· ZH
用Gemini 3.1 Flash Live构建实时语音Agent — 实际体验报告
分析Google发布的Gemini 3.1 Flash Live的实时语音和视觉Agent构建功能。涵盖API结构、工具调用、90+语言支持等,从开发者视角探讨其可能性与局限。
· ZH
GitHub Copilot 4月起将用你的代码训练AI — 不退出就等于同意
GitHub宣布从4月24日起,Copilot Free/Pro/Pro+用户的代码片段、内联建议采纳及对话交互等数据将默认用于AI模型训练。未主动关闭此选项即视为同意接受数据采集。整理具体退出步骤、所采集数据的类型与范围,以及企业和涉密项目开发者的实际应对建议,还包括团队管理员的组织策略设置要点。
· ZH
TurboQuant:KV Cache 3位量化与零精度损失
Google发布TurboQuant:PolarQuant+QJL双技术组合实现KV cache内存节省6倍、attention加速8倍,但精度真的零损失吗?
· ZH
Vibe Physics — 物理学教授让Claude写了一篇论文
分析Anthropic Science博客首篇文章:哈佛物理学教授Matthew Schwartz以"AI研究生"的方式指导Claude的实验。110次草稿、36M tokens、两周完成的论文。
· ZH
Dapr Agents v1.0 GA — 让 AI Agent 在 Kubernetes 上永不宕机的方法
深入分析 KubeCon Europe 2026 发布的 Dapr Agents v1.0 的 durable workflow、自动恢复、scale-to-zero,并与现有 Agent 框架进行对比。
· ZH
NemoClaw — NVIDIA为OpenClaw穿上了企业级安全外衣
在GTC 2026上发布的NVIDIA NemoClaw是一个用于在企业环境中安全运行OpenClaw的开源参考栈。本文探讨其Alpha阶段的现实局限与发展可能性。
· ZH
用 Claude Code Channels 从 Telegram 远程编程 — 一个 OpenClaw 用户的真实对比
Claude Code 新增了 Channels 功能。从 Telegram 发送消息,本地终端中的 Claude 就能执行代码并回复结果。它借鉴了 OpenClaw 的 Channel 概念,但安全模型的设计完全不同,这一点很有意思。
· ZH
Deeptune:AI Agent的「训练健身房」— a16z $43M投资揭示的Agent训练未来
Deeptune完成了由a16z领投的$43M Series A融资。通过模拟专业工作流的RL环境训练AI Agent,这一方法将对工程组织产生深远影响。
· ZH
IBM斥资110亿美元收购Confluent — 实时数据驱动AI Agent时代
IBM以110亿美元收购Confluent,实时数据流正式成为AI Agent核心基础设施。本文从CTO视角分析此次收购的战略意义及工程组织的应对策略。
· ZH
Gemini Embedding 2 — 多模态 embedding 改变 RAG 流水线
Google 发布的首个原生多模态 embedding 模型 Gemini Embedding 2 核心功能解析,以及与纯文本 embedding 的架构对比和 RAG 流水线实战应用,从 EM 视角进行系统梳理。
· ZH
AlphaEvolve刷新Ramsey数:AI研究伙伴时代
Google DeepMind的AlphaEvolve同时刷新5项保持长达20年的Ramsey数下界记录,从CTO/EM视角深入解读AI进化为科学研究伙伴。
· ZH
Hindsight——赋予AI智能体学习记忆的开源MCP内存系统
开源MCP内存系统Hindsight赋予AI智能体真正的学习记忆能力,在LongMemEval基准测试中达到91.4%。本文深入解析三层记忆架构、Retain·Recall·Reflect核心操作、Mental Model自动形成机制,以及基于Docker实现5分钟快速部署的生产落地策略。
· ZH
Morgan Stanley警告2026 AI飞跃——CTO现在必须准备的5件事
Morgan Stanley警告2026年上半年AI能力非线性飞跃即将到来。本文整理CTO与工程领导者必须立即执行的5大准备策略:AI路线图季度重构、Centaur Pod团队新模式、混合基础设施成本优化、AI治理框架与合规管理,以及系统提升工程团队AI素养的具体行动方案。
· ZH
Perplexity Computer:全天候AI智能体
分析Perplexity发布的Personal Computer与Enterprise。24/7 AI智能体4周完成3.25年工作量的案例与EM视角落地策略。
· ZH
AI代理身份暗物质:为什么80%的企业无法掌控自己的AI
70%的企业已在生产环境中运行AI代理,但80%无法实时追踪其行为。本文解析"身份暗物质"概念、 治理差距现状,并为工程经理和CTO提供5步应对战略。
· ZH
GLM-5:MIT开源前沿模型的企业AI采纳战略重塑
智谱AI发布的GLM-5是744B MoE开源模型,仅用华为昇腾芯片训练,MIT许可证完全商用自由。从EM/CTO视角解析企业AI采纳战略。
· ZH
Microsoft Agent Framework GA: AutoGen + Semantic Kernel整合完成
整合AutoGen与Semantic Kernel的Microsoft Agent Framework即将于Q1 2026正式发布。本文从EM/CTO视角梳理核心功能、迁移策略与生产环境落地路线图。
· ZH
OpenAI收购Promptfoo——AI智能体DevSecOps时代开启
OpenAI收购AI安全测试平台Promptfoo,这一被Fortune 500中25%企业使用的工具将集成至其企业平台Frontier,正为AI智能体DevSecOps制定全新行业标准。本文深度解析Promptfoo的红队测试方法、CI/CD流水线安全集成步骤与智能体行为策略制定,涵盖EM/CTO须知的实操指南。
· ZH
识别"代理洗白":工程经理的7项检查清单
数千家AI智能体供应商中真正具备智能体能力的仅约130家,其余均为简单自动化或营销噱头包装。本文为工程经理提供7项实用检查清单,全面涵盖目标重设、上下文记忆、动态工具选择、失败恢复与资源约束感知等核心能力测试,并附供应商评估问题清单,帮助准确识别真正的智能体AI系统。
· ZH
Anthropic AI生态大布局:研究所与1亿美元投资
Anthropic Institute成立与Claude Partner Network 1亿美元投资。从CTO视角深度分析AI厂商生态系统成熟度演进。
· ZH
GPT-5.4发布 — 原生计算机使用和1M上下文窗口将改变工程团队
OpenAI于2026年3月5日发布GPT-5.4。在OSWorld基准测试中超越人类(75% vs 72.4%)的计算机使用能力、1M令牌上下文窗口、工具搜索节省47%令牌 — 工程管理者必知的核心影响分析。
· ZH
AI智能体生产环境部署的9项设计原则 — 基于arXiv最新论文的实战指南
通过arXiv论文与实务案例,从Engineering Manager视角梳理解决2026年AI智能体生产化核心挑战的9项设计原则。
· ZH
AI智能体可观测性实战指南:让生产环境LLM系统透明化
面向工程经理的多智能体LLM系统生产运维可观测性策略。涵盖分布式追踪、指标、日志记录,OpenTelemetry应用,以及Langfuse、LangSmith、Braintrust工具对比。
· ZH
MCP Apps:交互式UI在AI对话中直接运行
MCP Apps如何改变AI智能体UX——从沙箱iframe与JSON-RPC双向通信架构到实战实现代码,从Engineering Manager视角全面解析。
· ZH
mcp2cli — 用CLI按需发现工具,将MCP令牌成本削减96〜99%
接入MCP服务器时,每轮对话都会注入全部工具schema——120个工具25轮对话将浪费362,000个token。mcp2cli通过CLI按需发现机制将这一成本削减96〜99%。本文解析其工作原理、实测数据与落地策略。
· ZH
OpenAI Open Responses——智能体AI工作流的通用标准正式登场
OpenAI发布的Open Responses规范旨在标准化智能体AI工作流。本文深入分析其核心概念、支持生态以及EM/CTO视角下的落地策略。
· ZH
Claude Code Review — 多智能体PR审查将代码审查率从16%提升至54%
全面解析Anthropic发布的Claude Code Review功能:并行多智能体架构、每PR平均$15〜25的成本结构,以及Engineering Manager在考虑采用时需要了解的一切