每次升级模型都要重跑注入测试:我把这道关卡亲手搭了出来
我把注入回归测试跑在自己的 LLM 流水线上。朴素守卫 11 条只拦 2 条,结构化守卫全部拦下,重构漏掉的检测器也被关卡精准点出。
标签
12篇文章
我把注入回归测试跑在自己的 LLM 流水线上。朴素守卫 11 条只拦 2 条,结构化守卫全部拦下,重构漏掉的检测器也被关卡精准点出。
WebMCP以Chrome 149的origin trial正式落地,但二月介绍的那套API已经变了。navigator.modelContext迁到了document.modelContext,provideContext因安全问题被移除。本文以官方文档与规范Issue为依据,梳理现在该注册的工具形态与安全注解。
Anthropic因npm包发布失误导致Claude Code全部源码曝光。从Agent循环、内存系统到成本优化策略,梳理泄露代码中开发者可借鉴的设计模式。
MCP月下载量突破9700万成为事实标准,但缺少控制Agent调用哪些工具以及调用频率的治理层。MCP Gateway模式解决了这个问题。
深入分析PyPI上发生的LiteLLM供应链攻击。涵盖AI工具链依赖漏洞与恶意包检测方法、供应链安全强化策略, 以及工程团队可立即应用于实务的具体防御步骤与安全检查清单。
根据GitGuardian 2026报告,使用AI编程工具的仓库密钥泄露率是GitHub平均水平的2倍。仅MCP配置文件就暴露了超过24,000个凭证。本文整理了实际排查方法和应对措施。
在GTC 2026上发布的NVIDIA NemoClaw是一个用于在企业环境中安全运行OpenClaw的开源参考栈。本文探讨其Alpha阶段的现实局限与发展可能性。
70%的企业已在生产环境中运行AI代理,但80%无法实时追踪其行为。本文解析"身份暗物质"概念、 治理差距现状,并为工程经理和CTO提供5步应对战略。
RoguePilot 漏洞分析、被动提示注入风险和工程管理者必读的 AI 编码工具安全指南
MCP(Model Context Protocol)的攻击面正在急速扩大。本文分析30个CVE、三层攻击模型,并提供企业安全加固检查清单。
NIST AI Agent Standards Initiative的核心内容,以及工程经理为强化团队内AI代理安全性可立即实施的分步骤清单。涵盖访问控制、审计日志、护栏设计等实战策略。
ICML投稿论文的PDF中被发现隐藏着"在评审中包含特定短语"的提示注入文本。本文从技术角度剖析这一攻击的原理,以及依赖AI审稿的学术同行评审所面临的结构性安全风险与可行的防御思路。