Hermes Agent — 每完成一个任务就自我进化的开源AI代理
安装了NousResearch的Hermes Agent v0.7.0。它在每次任务完成后自动生成技能文档, 并在下次运行时引用。记录了自我进化循环是否真的有效。
标签
17篇文章
安装了NousResearch的Hermes Agent v0.7.0。它在每次任务完成后自动生成技能文档, 并在下次运行时引用。记录了自我进化循环是否真的有效。
Google以Apache 2.0开源了Gemma 4,我用Ollama亲自安装并测试了中文、结构化输出和函数调用。 一个9.6GB的本地模型,能成为Agent流水线的构建模块吗?
以员工方式管理AI Agent的开源平台Paperclip亲测体验。Linear风格仪表板、Org Chart、费用追踪、多种Agent适配器一网打尽 — 用Claude Code雇佣Agent组织化运营的实战经验与真实评价。
分析Mistral于2026年3月发布的4B参数开放权重TTS模型Voxtral:盲测中以更自然语调击败ElevenLabs Flash v2.5,3秒音频即可完成零样本语音克隆,且仅需8GB显存本地运行。然而日语和韩语的缺席是进军亚洲市场的致命短板。详解CC BY NC 4.0商用限制及替代方案选型。
智谱AI发布的GLM-5是744B MoE开源模型,仅用华为昇腾芯片训练,MIT许可证完全商用自由。从EM/CTO视角解析企业AI采纳战略。
AI2的Olmo Hybrid将Transformer与DeltaNet以3:1的比例结合,仅用49%更少的token量达到同等精度,数据效率提升2倍。深入分析混合LLM架构的设计原理、性能基准测试,以及对LLM工程师的实务启示。
ggml.ai团队加入Hugging Face,确保llama.cpp的长期可持续发展。本文分析本地AI推理生态系统的结构性变化及技术意义。
Mistral Devstral Small 2 24B和Qwen3 Coder 30B同时登场。可在Raspberry Pi上运行的小型编码模型对比分析及本地AI编码的未来展望。
深入分析14M参数、不到25MB即可实现云端TTS品质的Kitten TTS V0.8。探讨边缘设备部署的可能性及本地语音AI最新趋势。
深度解析BarraCUDA开源编译器,无需LLVM或HIP转换层,即可将CUDA .cu源码直接编译为AMD RDNA3 GPU机器码。本文完整涵盖其15,000行C99实现的架构原理、所支持的CUDA功能清单,以及对打破NVIDIA GPU市场垄断格局的重要意义。
DeepSeek V4发布在即,Qwen3.5、GLM-5等中国AI企业的模型大战持续升温。本文深入分析相比DeepSeek-R1的推理性能提升与编程基准改进,并探讨开源LLM逼近GPT-4级性能背景下全球AI竞争格局的深层变化。
4亿参数轻量级TTS模型KaniTTS2已开源发布,仅需3GB VRAM即可实现零样本语音克隆,预训练代码完全公开。本文分析MOS评分和语音克隆质量,并深入探讨其在本地AI环境中的实际应用潜力与语音AI民主化意义。
OpenRouter周使用量排行TOP5中4个为开源模型(Qwen3-Coder、DeepSeek R2、MiniMax M2.5等)。分析闭源模型优势的终结以及开源模型在实际使用中被选择的原因。
Heretic 1.2正式发布。通过4bit量化将VRAM使用量最多降低70%,MPOA技术实现高质量消融。详解本地LLM运营成本削减的最新方法。
分析GPT-OSS 120B Uncensored模型的技术特征,以及无审查开源LLM引发的安全护栏争论,从技术和伦理两个维度进行深入探讨。
MiniMax M2.5在SWE-Bench Verified上达到80.2%,超越Claude Opus 4.6。我们通过全面的基准测试数据,分析开源权重模型与闭源模型之间性能差距快速缩小的现状。
介绍开源 AI 助手平台 OpenClaw 的核心功能与架构。多渠道、多模型、节点系统一网打尽的完全指南。