sentence-transformersでRAG埋め込みを直接実験 — 韓国語クエリで精度が67%落ちる理由
all-MiniLM-L6-v2をローカルで動かし、コサイン類似度・ミニRAG・多言語モデル比較まで直接測定した。英語最適化の 埋め込みモデルで韓国語RAGを構築すると精度が67%低下するという実測結果と解決策を共有する。
タグ
6件の記事
all-MiniLM-L6-v2をローカルで動かし、コサイン類似度・ミニRAG・多言語モデル比較まで直接測定した。英語最適化の 埋め込みモデルで韓国語RAGを構築すると精度が67%低下するという実測結果と解決策を共有する。
LlamaIndex 0.14、LangChain 1.3、Haystack 2.30を実際にインストール・テストした。langchain-community deprecation警告、コード複雑度測定、InMemory検索の実行結果を含む実測比較ガイド。
Qdrant・ChromaDB・pgvectorを1000ベクトル(dim=384)環境で直接ベンチマーク。挿入速度・クエリ遅延・フィルタ性能の実測値でRAGアプリの選択基準を示し、小規模でChromaDBが速い理由も解説する。
GoogleのネイティブマルチモーダルエンベディングモデルGemini Embedding 2の核心機能と、既存テキスト専用モデル対比のアーキテクチャ変化、RAGパイプラインへの実践的な適用方法をEM視点でまとめます。
DeNA社内LLMスタディPart 4: 基本的なRAG実装から知識グラフを活用したGraphRAG、検索戦略を自ら決定するAgentic RAGまで、 最新アーキテクチャの進化を分析。プロダクション導入の判断基準と2025〜2026年のトレンドも解説します。
2025年11月発表のGemini File Search Toolを使い、複雑なRAGパイプラインなしでドキュメント検索とQ&Aシステムを構築する実践ガイド。フルマネージドRAGで開発時間を劇的に短縮。