向量数据库对比 2026: Qdrant vs ChromaDB vs pgvector 选型指南
在1000个向量(dim=384)环境下实测Qdrant、ChromaDB与pgvector,对比插入速度、查询延迟和过滤性能,提供RAG应用的明确选型标准,并解释小规模下ChromaDB过滤查询快于Qdrant的原因。
archive
356 · 第 9
在1000个向量(dim=384)环境下实测Qdrant、ChromaDB与pgvector,对比插入速度、查询延迟和过滤性能,提供RAG应用的明确选型标准,并解释小规模下ChromaDB过滤查询快于Qdrant的原因。
RTK(Rust Token Killer)是一个在Bash命令输出发送给LLM之前进行压缩的CLI代理。在自己机器上实际安装后,在find命令上测到90%的Token削减,ls命令上50%。本文整理了哪些场景有效、哪些完全无效、如何与Claude Code集成,以及它诚实的局限到底在哪里、什么时候不值得装。
Google 在 I/O 2026 发布 Antigravity 2.0,并将于 6 月 18 日终止 Gemini CLI。深度分析已安装应用的扩展结构和 Gemini 3.5 Flash API,并与 Claude Code 对比,解析 Agent IDE 竞争格局的变化。
在Next.js 16 App Router中实现Claude API流式传输的实战指南。涵盖Route Handler设计、SSE响应处理、React 19客户端Hook、背压与错误恢复模式,附实际构建代码和运行日志。
基于AutoGen 0.7.x新API从零实现多智能体系统的实战指南。逐步运行RoundRobinGroupChat、SelectorGroupChat、GraphFlow、FunctionTool,通过真实代码对比0.2.x差异。
我亲自安装claude-agent-sdk 0.2.82,实测AgentDefinition结构与ClaudeAgentOptions类型,验证编排器同时spawn三个子代理的并行模式。完整讲解通过TaskBudget控制成本上限,以及SubagentStartHookInput钩子的Python实现全流程。
我用 Budget=0/1024/8000 三种配置,在简单任务、数学推理、代码审查三类场景下亲测了 Gemini 2.5 Flash Thinking API。简单任务速度慢 5 倍毫无收益,数学推理反而减少了输出 token。分享按任务类型选择最优 budget 的决策框架。
深度解析2026年5月Code with Claude SF大会发布的Dreaming、Outcomes和多代理编排技术架构。剖析Harvey 6倍数据的背景、LLM-as-judge的产品化,以及自我改进循环的治理风险。
动手读完 Cloudflare Agents Week 2026 的通读记录。Sandboxes GA、Artifacts、Dynamic Workers 都看过,再加上智能体自己开通云账号、再去买域名。文里还附上了 @cloudflare/agents SDK 本地实验里动手才会真正撞上的那几处细节。
AWS MCP Server于2026年5月正式发布。实际测试了uvx一行同时接入CloudWatch 31个工具和IAM 29个工具到Claude Code的全过程。深入分析IAM条件键(aws:ViaAWSMCPService)权限分离架构,附真实AWS账号连接测试结果与客观评价,判断生产环境实用性。
亲自安装anthropic 0.101.0 SDK并完整实现了tool_use代理循环全流程。本文系统介绍了从JSON Schema工具定义、多工具并发调用、错误处理策略到流式响应与成本优化,通过Python实战代码逐步详细讲解区分聊天机器人与真正AI代理的核心设计模式,附可运行代码示例与步骤说明。
我实际安装了FastMCP 3.2.4,用@mcp.tool()、@mcp.resource()、@mcp.prompt()装饰器构建了可运行的MCP服务器。这是一份用30行Python实现Claude Desktop和Cursor可调用的AI工具服务器的实战指南。