ARCHIVE
아카이브
기존에 공개한 글을 원래 주소 그대로 보관합니다.
과거의 글에는 작성 당시의 기술과 관점이 담겨 있습니다.
356개 글 · 4 / 12 페이지
· ZH
Claude Opus 4.8 Dynamic Workflows 深度解析
Claude Opus 4.8的1000个并行子代理与Fast Mode如何改变AI代理开发工作流。基于官方文档与真实实现案例,系统梳理多代理架构设计、成本结构与运营限制,并给出何时适合采用的诚实评估。
· ZH
用Ollama + FastAPI搭建本地LLM API服务器 — 从开发到Docker部署完整指南
本指南完整介绍如何通过FastAPI封装Ollama REST API,逐步构建具备SSE流式传输、健康检查、Docker Compose容器化部署的生产级本地LLM服务器,并附有Llama 3.2、Mistral等主流模型的实际运行日志与完整API调用测试示例。
· ZH
MCP远程HTTP服务器部署模式 — 从stdio迁移到Streamable HTTP的实践指南
使用MCP Streamable HTTP传输将stdio服务器转变为可远程部署的HTTP服务的实战指南。基于TypeScript SDK v1.29.0,通过实验日志详解stateful与stateless模式实现及Docker、Cloudflare部署模式。
· ZH
从 Jest 迁移到 Vitest 4 完整指南 — 2026 年更快的测试环境搭建
基于 Vitest 4.1.7 的 Jest 项目完整迁移实战指南,附实验验证结果。涵盖安装配置切换、jest→vitest 代码转换模式、稳定 Browser Mode 及新断言器(toSatisfy、toBeOneOf),可直接应用于生产。
· ZH
用Bun Shell构建TypeScript自动化脚本 — 从安装到实战模式
基于Bun 1.3.14实际实验的Bun Shell完整指南。涵盖$模板字面量、.nothrow()错误处理、Promise.all并行化及macOS echo陷阱,附真实执行日志。还包含与zx的实质差异及生产环境部署的注意事项。
· ZH
Gemini API 模型选择指南 2026 — Flash-Lite至Pro速度与成本完全对比
2026年5月实测数据。在相同条件下对比了Gemini 2.5 Flash-Lite(65 TPS)、2.5 Flash、2.5 Pro和3.5 Flash。包含聊天机器人、代码审查、RAG场景的月度成本计算,以及不同项目应选择哪个模型的决策依据。
· ZH
向量数据库对比 2026: Qdrant vs ChromaDB vs pgvector 选型指南
在1000个向量(dim=384)环境下实测Qdrant、ChromaDB与pgvector,对比插入速度、查询延迟和过滤性能,提供RAG应用的明确选型标准,并解释小规模下ChromaDB过滤查询快于Qdrant的原因。
· ZH
亲测RTK(Rust Token Killer) — 削减LLM Token成本60〜90%的CLI代理
RTK(Rust Token Killer)是一个在Bash命令输出发送给LLM之前进行压缩的CLI代理。在自己机器上实际安装后,在find命令上测到90%的Token削减,ls命令上50%。本文整理了哪些场景有效、哪些完全无效、如何与Claude Code集成,以及它诚实的局限到底在哪里、什么时候不值得装。
· ZH
Google I/O 2026: Antigravity 2.0 — Gemini CLI终止与智能体IDE之战
Google 在 I/O 2026 发布 Antigravity 2.0,并将于 6 月 18 日终止 Gemini CLI。深度分析已安装应用的扩展结构和 Gemini 3.5 Flash API,并与 Claude Code 对比,解析 Agent IDE 竞争格局的变化。
· ZH
用Next.js 16 + Claude API构建流式AI聊天应用 — App Router完整指南
在Next.js 16 App Router中实现Claude API流式传输的实战指南。涵盖Route Handler设计、SSE响应处理、React 19客户端Hook、背压与错误恢复模式,附实际构建代码和运行日志。
· ZH
AutoGen 0.7.x多智能体实战 — AssistantAgent到GraphFlow从零构建
基于AutoGen 0.7.x新API从零实现多智能体系统的实战指南。逐步运行RoundRobinGroupChat、SelectorGroupChat、GraphFlow、FunctionTool,通过真实代码对比0.2.x差异。
· ZH
Claude Agent SDK 子代理编排实战指南 — 多代理并行处理完全掌握
我亲自安装claude-agent-sdk 0.2.82,实测AgentDefinition结构与ClaudeAgentOptions类型,验证编排器同时spawn三个子代理的并行模式。完整讲解通过TaskBudget控制成本上限,以及SubagentStartHookInput钩子的Python实现全流程。
· ZH
Gemini 2.5 Flash Thinking API 实战指南 — thinking_budget亲测结论
我用 Budget=0/1024/8000 三种配置,在简单任务、数学推理、代码审查三类场景下亲测了 Gemini 2.5 Flash Thinking API。简单任务速度慢 5 倍毫无收益,数学推理反而减少了输出 token。分享按任务类型选择最优 budget 的决策框架。
· ZH
Claude Managed Agents的Dreaming、Outcomes与Orchestration
深度解析2026年5月Code with Claude SF大会发布的Dreaming、Outcomes和多代理编排技术架构。剖析Harvey 6倍数据的背景、LLM-as-judge的产品化,以及自我改进循环的治理风险。
· ZH
Cloudflare Agents Week 2026分析 — AI智能体成为云基础设施的自主运营者
动手读完 Cloudflare Agents Week 2026 的通读记录。Sandboxes GA、Artifacts、Dynamic Workers 都看过,再加上智能体自己开通云账号、再去买域名。文里还附上了 @cloudflare/agents SDK 本地实验里动手才会真正撞上的那几处细节。
· ZH
AWS MCP Server GA 实战指南 — 用CloudWatch与IAM让AI编程助手真正理解你的AWS环境
AWS MCP Server于2026年5月正式发布。实际测试了uvx一行同时接入CloudWatch 31个工具和IAM 29个工具到Claude Code的全过程。深入分析IAM条件键(aws:ViaAWSMCPService)权限分离架构,附真实AWS账号连接测试结果与客观评价,判断生产环境实用性。
· ZH
Claude Agent SDK 实战指南 — 用Tool Use让AI代理真正执行任务
亲自安装anthropic 0.101.0 SDK并完整实现了tool_use代理循环全流程。本文系统介绍了从JSON Schema工具定义、多工具并发调用、错误处理策略到流式响应与成本优化,通过Python实战代码逐步详细讲解区分聊天机器人与真正AI代理的核心设计模式,附可运行代码示例与步骤说明。
· ZH
用FastMCP 3.x在30分钟内构建Python MCP服务器 — 一个@tool装饰器就够了
我实际安装了FastMCP 3.2.4,用@mcp.tool()、@mcp.resource()、@mcp.prompt()装饰器构建了可运行的MCP服务器。这是一份用30行Python实现Claude Desktop和Cursor可调用的AI工具服务器的实战指南。
· ZH
FastAPI + Claude API 流式生产后端构建 — SSE、重试与错误恢复实战指南
本文是面向后端开发者的FastAPI + Anthropic SDK生产级流式AI后端完整指南。涵盖SSE流式端点实现、限速指数退避重试机制、错误分类与恢复策略、令牌流优化,以及基于Docker的完整容器化部署方案,每步均附完整可运行Python代码示例,是快速掌握并部署流式AI后端的最佳实践指南。
· ZH
Claude Code 实战大师班 #1 — 用斜线命令·Hook·子代理三步实现工作流自动化
通过斜线命令(.claude/commands/)定义任务,用settings.json Hook连接事件,并委托给子代理(.claude/agents/)执行。本文以真实博客自动化系统为案例,从头到尾详解Claude Code三步自动化工作流构建方式,所有代码均可直接运行,帮你掌握这一高效自动化范式。
· ZH
Anthropic SDK vs OpenAI SDK 开发者体验对比 — 类型安全性、错误处理与流式模式实测
在沙箱中同时安装anthropic 0.100.0和openai 2.36.0并深入比较。类型数量408 vs 230、错误类层级、流式实现、工具调用格式、SDK专有功能——全部从代码层面分析的实战比较指南。
· ZH
OpenAI Codex 云端智能体 vs Claude Code — 2026年5月对比
OpenAI Codex于2026年4月转型为云端智能体专用工作区。本文对比Codex与Claude Code的架构差异、基准测试、成本与工作流程适配性,提供2026年5月基准下的团队选型判断框架。
· ZH
用uv搭建AI开发环境 — 0.87秒启动Claude SDK项目的实战指南
使用Rust编写的Python包管理器uv 0.11搭建AI SDK开发环境的完整实战指南。覆盖pip速度100倍以上的加速安装、可复现环境管理、Claude SDK项目初始化全流程,附真实运行日志,是2026年Python AI开发的首选工具链。
· ZH
Gemini 2.5 Flash API 成本优化实战指南 — 实验验证的99%节省策略
通过直接实验Gemini 2.5 Flash API发现的四大成本优化技巧:禁用Thinking令牌可削减高达99%费用、Context Caching降低重复调用成本、Flash-Lite与Flash的选型基准、以及Batch API异步调用方案,全程附实测数据说明。
· ZH
Anthropic Files API实战指南 — 无需重复上传PDF即可批量分析文档
通过Anthropic Files API将PDF文档上传一次、在多个请求中反复复用的实战指南。含Python SDK批量代码、与提示词缓存的成本对比、 file_id生命周期管理模式及批量分析适用场景判断。
· ZH
Google ADK vs LangGraph 2026: 亲手安装两个框架并对比
实际沙盒安装测试Google ADK v1.32.0与LangGraph v1.1.10,系统对比代码结构、依赖数量、状态管理实现、条件分支架构及部署CLI差异。基于实验数据,提供不同应用场景下的AI代理框架选型指南。
· ZH
Langfuse v3 自托管完整指南 — 在本地基础设施上直接构建LLM追踪
从Langfuse v3 Docker Compose安装到Python SDK 4.x代码检测和RAG管道追踪,全程实战指南。在保持数据主权的同时,在自有基础设施上部署LLM可观测性。
· ZH
Anthropic为何切断OpenClaw — Claude订阅政策转变与开发者成本现实
2026年4月4日,Anthropic封锁了Claude Pro/Max订阅用于第三方代理工具的使用权限。加上Fast Mode 6倍计费,这次结构性转变需要用数据来分析。
· ZH
Anthropic四月双重发布 — Opus 4.7与Managed Agents如何改变Agent开发
Claude Opus 4.7(4月16日)和Managed Agents测试版(4月8日)在同一个月发布。基准测试创历史新高,但社区反应两极分化。本文分析新分词器成本冲击、task_budget参数,以及每会话$0.08定价模式的实际意义。
· ZH
使用GitHub Actions + Claude Code CLI构建PR自动审查流水线
在GitHub Actions中直接集成claude -p实现PR审查自动化的实战指南。详解--bare、--dangerously-skip-permissions、--max-budget-usd标志,让Claude Code在CI环境中安全运行的完整YAML示例。