ARCHIVE
아카이브
기존에 공개한 글을 원래 주소 그대로 보관합니다.
과거의 글에는 작성 당시의 기술과 관점이 담겨 있습니다.
356개 글 · 5 / 12 페이지
· ZH
PydanticAI实战教程 — 用FastAPI的感觉构建类型安全的AI智能体
我实际安装了PydanticAI 1.88.0,直接测试了TestModel、output_type、@agent.tool和多提供商切换。包括result_type→output_type变更等真实陷阱,以及完整的FunctionModel测试策略。
· ZH
Anthropic Message Batches API 实战指南 — 大规模LLM请求成本降低50%的方法
深入讲解Anthropic Message Batches API:将最多100,000个请求合并为单次批量处理,成本立降50%。结合Prompt Caching,最高可节省95%。附Node.js和Python完整代码示例。
· ZH
Claude API提示缓存实战 — 4种模式将LLM成本降低70%
基于真实生产环境经验的Claude API提示缓存完全实战指南。涵盖系统提示、RAG文档、工具定义和多轮对话四种缓存模式, 以及2026年TTL变更的陷阱、缓存命中率与成本节省的计算方法,附实测数据。
· ZH
我为什么从OpenClaw转向Codex+Nanobot
从OpenClaw迁移到Codex+Nanobot的实战经验分享。对比launchd调度配置、Telegram桥接集成和MCP宿主组合的真实利弊, 介绍搭建无资源过载轻量级AI智能体工具链的最优方案。
· ZH
Cursor 3 vs Claude Code vs Windsurf: 2026年AI编程工具选择指南
基于亲身使用三款AI编程工具经验的深度对比指南。Cursor 3.1的异步子智能体、Claude Code 2.1.119的架构推理、 Windsurf 2.0.67的Cascade——各工具适合什么场景,从性能和成本角度坦率整理。
· ZH
MCP vs A2A vs Open Responses — 2026年AI智能体通信协议三足鼎立,实战中该用什么
深度对比MCP、A2A、Open Responses三个协议的设计目标与生态系统。分析2026年实际AI代理项目中各协议的使用时机与组合方法,以及OpenAI、Google、Anthropic在代理通信标准竞争中的核心策略。
· ZH
GPT-5.5发布 — OpenAI转向Agent Runtime,与Claude的实战对比
昨天发布的GPT-5.5,SWE-bench 88.7%,价格翻倍。OpenAI声称专为Agent Runtime重新设计,这对开发者选择究竟意味着什么?
· ZH
用Vercel AI SDK构建Claude流式代理
使用Vercel AI SDK v6 + @ai-sdk/anthropic在Next.js App Router中实现Claude流式聊天和工具调用代理的实战指南。通过代码学习streamText、generateObject和工具循环模式。
· ZH
Claude Code Routines 实战 — 定时·API·GitHub 事件自动化指南
Claude Code Routines 只需一次配置提示词、代码库和连接器,即可在 Anthropic 基础设施上自主运行。本指南详解定时调度、API 调用、GitHub 事件三种触发方式的设置步骤,并分享从 PR 审查自动化到文档漂移检测的实战用例。
· ZH
MCP服务器Kubernetes生产部署 — 在52%宕机率中活下来的方法
2026年4月生产MCP端点52%异常。本文提供完整的生存清单:Kubernetes资源配置、Streamable HTTP迁移、健康检查自动化、 OAuth 2.1认证,帮助您构建稳定的生产级MCP服务器。
· ZH
Python AI智能体库比较 — Pydantic·Instructor·Smolagents
用真实基准代码对比Pydantic AI、Instructor和Smolagents。从结构化输出、智能体架构、生产就绪度、成本效率四个维度,为您提供2026年明确的Python AI库选型决策依据。
· ZH
AI智能体框架比较2026: LangGraph vs CrewAI vs Dapr 生产选型指南
从实际生产角度比较LangGraph v1.0、CrewAI v1.10和Dapr Agents v1.0。分析架构、开发速度、运营耐久性和成本, 为状态管理型、协作型、基础设施集成型各场景提供多智能体框架选型标准。
· ZH
LLM API定价对比2026 — GPT-5 vs Claude vs Gemini vs DeepSeek实际成本计算
基于2026年4月数据,通过实际生产场景对比主要LLM API定价。涵盖GPT-5.4、Claude Opus 4.6、Gemini 3.1 Pro和DeepSeek V4的Token成本、缓存折扣及批量API策略。
· ZH
Anthropic悄悄降低Claude性能的争议——权力用户反弹的真实背景
2026年3月,Anthropic悄悄将Claude默认effort调低为"medium",引发权力用户强烈反弹。本文从CTO视角分析 价格上涨争议及这一事件揭示的AI服务透明度与信任危机。
· ZH
亲测Claude Managed Agents — 无需基础设施,30分钟部署AI智能体
Anthropic 于 2026 年 4 月 8 日把 Claude Managed Agents 公开测试。我实际接过一遍,从部署侧写下四件事:API 三步链路怎么走、$0.08/小时真实合计是多少、不用自建基础设施时结构变成什么样、供应商锁定会卡在哪一步。没有自己搭服务器,只走官方 API 核对。
· ZH
Claude Code智能体工作流5种模式 — 哪种适合你的工作?
Claude Code智能体工作流5种模式全面对比 — 顺序、操作者、并行、团队、自律,亲身使用后整理。详解各模式工作原理、适合的任务类型、成本与速度的权衡,以及选择依据。
· ZH
用本地LLM构建私有MCP服务器 — Gemma 4 + FastMCP 完全离线AI工具指南
使用Ollama + Gemma 4 + FastMCP构建无需互联网的离线AI工具管道。适用于医疗、法律、金融环境中数据不能外发的实战实现指南。
· ZH
Claude Code 并行会话运行指南 — 使用 Git Worktree 同时处理多项任务
将 Git Worktree 与 Claude Code 结合,实现多功能并行开发的方法。涵盖 Plan Mode 应用、会话隔离、无冲突并行工作模式,基于实际使用经验整理。
· ZH
从零构建MCP服务器 — 使用Streamable HTTP传输实现真实AI工具
使用Python FastMCP从零构建MCP服务器的实战教程。涵盖Streamable HTTP传输配置、工具实现及Claude Code集成,基于实际操作经验分享。
· ZH
Hermes Agent — 每完成一个任务就自我进化的开源AI代理
安装了NousResearch的Hermes Agent v0.7.0。它在每次任务完成后自动生成技能文档, 并在下次运行时引用。记录了自我进化循环是否真的有效。
· ZH
Claude Mythos Preview — AI"太强了所以不公开",这说得通吗
Anthropic决定不公开发布SWE-bench得分93.9%的Claude Mythos Preview。 这个发现了27年前OpenBSD漏洞的模型,仅通过Project Glasswing向12家企业提供。 这是真正的责任感,还是巧妙的营销?
· ZH
PrismML Bonsai — 1.15GB的8B模型,真的可行吗?
由Caltech团队打造的PrismML Bonsai是一款1-bit LLM,仅用{-1, +1}两个值表示权重。 8B模型压缩至1.15GB,据称推理速度是全精度的8倍。本文做了实际验证。
· ZH
在本地跑了一下Gemma 4——8B模型居然能做函数调用了
Google以Apache 2.0开源了Gemma 4,我用Ollama亲自安装并测试了中文、结构化输出和函数调用。 一个9.6GB的本地模型,能成为Agent流水线的构建模块吗?
· ZH
Claude Code源码泄露 — 从51万行代码解读Agent架构内幕
Anthropic因npm包发布失误导致Claude Code全部源码曝光。从Agent循环、内存系统到成本优化策略,梳理泄露代码中开发者可借鉴的设计模式。
· ZH
LLM内部存在情感 — Anthropic在Claude内部发现了171个情感表征
Anthropic可解释性团队在Claude内部发现了171个类情感表征,并证明它们对模型输出具有因果影响。整理对提示工程和AI安全的实际启示。
· ZH
Stripe Minions — 一个 Slack 表情触发每周 1,300 个 PR 的编码 Agent
Stripe 如何通过自主编码 Agent Minions 每周生产超过 1,300 个 PR。分析 Blueprint 架构、沙箱 VM 和三层反馈循环背后的实际工程实践。
· ZH
effloow — 用14个AI Agent运营公司的Side Project
基于Paperclip搭建了由14个AI Agent组成的内容业务。分享Laravel、Markdown、Git驱动的站点自动化架构与Day 1的实战经验。
· ZH
MCP Gateway — 谁在控制AI Agent的工具调用?
MCP月下载量突破9700万成为事实标准,但缺少控制Agent调用哪些工具以及调用频率的治理层。MCP Gateway模式解决了这个问题。
· ZH
Paperclip — 像管理员工一样管理AI Agent的开源平台,我装了试试
以员工方式管理AI Agent的开源平台Paperclip亲测体验。Linear风格仪表板、Org Chart、费用追踪、多种Agent适配器一网打尽 — 用Claude Code雇佣Agent组织化运营的实战经验与真实评价。
· ZH
Sora关停与AI视频市场的急剧重塑 — Google Veo 4瞄准空白
OpenAI宣布关停Sora应用。日亏100万美元、用户跌破50万的全貌,以及Google Veo 4即将发布、Runway·Kling的崛起如何重塑AI视频市场, 从实战工作流角度进行分析。