用sentence-transformers实测RAG嵌入 — 韩语查询准确率为何下降67%
在本地安装all-MiniLM-L6-v2,直接测量余弦相似度、运行迷你RAG,并比较英语与多语言嵌入模型。 用英语优化模型构建韩语RAG系统时,准确率下降67%的实测结果与解决方案。
标签
6篇文章
在本地安装all-MiniLM-L6-v2,直接测量余弦相似度、运行迷你RAG,并比较英语与多语言嵌入模型。 用英语优化模型构建韩语RAG系统时,准确率下降67%的实测结果与解决方案。
亲自安装测试了LlamaIndex 0.14、LangChain 1.3和Haystack 2.30。包含langchain-community弃用警告、代码复杂度测量和InMemory检索实际运行结果的实测比较指南。
在1000个向量(dim=384)环境下实测Qdrant、ChromaDB与pgvector,对比插入速度、查询延迟和过滤性能,提供RAG应用的明确选型标准,并解释小规模下ChromaDB过滤查询快于Qdrant的原因。
Google 发布的首个原生多模态 embedding 模型 Gemini Embedding 2 核心功能解析,以及与纯文本 embedding 的架构对比和 RAG 流水线实战应用,从 EM 视角进行系统梳理。
DeNA 内部 LLM 研究 Part 4:从基础 RAG 实现到利用知识图谱的 GraphRAG、自主决定检索策略的 Agentic RAG, 深度分析最新架构演进。同时整理生产环境采用标准与 2025〜2026 年技术趋势。
2025年11月发布的Gemini File Search Tool使用指南,无需复杂RAG管道即可构建文档检索与问答系统。完全托管的RAG方案显著缩短开发时间。