Apr 4, 2026 6 分钟阅读 LLM内部存在情感 — Anthropic在Claude内部发现了171个情感表征 Anthropic可解释性团队在Claude内部发现了171个类情感表征,并证明它们对模型输出具有因果影响。整理对提示工程和AI安全的实际启示。