Gemini Embedding 2
ジェミニエンベディングツー

Gemini Embedding 2 とは、Google が開発したマルチモーダル対応のエンベディングモデルであり、テキスト・画像・動画・音声・ドキュメントを単一のベクトル空間に変換できる。
テキストだけを扱う従来のエンベディングモデルとは異なり、5 種類のメディアを 1 つの意味空間にマッピングする点が最大の特徴。たとえば工場の異常音の音声クリップと設備異常の対応手順というテキストドキュメントが、ベクトル上で近い位置に配置される——といった具合に、モダリティをまたいだ検索が単一モデルで完結する。RAG パイプラインでテキスト以外のナレッジも検索対象にしたい場面で、モダリティごとに別モデルを用意する手間が大幅に減る。
入力ウィンドウは 8,192 トークンで、チャンクサイズを大きめに取れる。出力は最大 3,072 次元だが、Matryoshka 構造により 1,536(バランス重視)・768(低レイテンシ検索向き)にも縮小可能。タスク最適化パラメータも備えており、検索・分類などの用途に応じてベクトルの数学的特性を調整できる。
100 以上の言語をネイティブにサポートするため、多言語 RAG やクロスリンガル検索にも向く。LangChain・LlamaIndex・Weaviate・Qdrant・ChromaDB との統合が公式に提供されており、既存のベクトルデータベース基盤にそのまま組み込める。
料金は 100 万トークンあたり $0.25 で、無料枠も用意されている。従来の text-embedding-004 からの移行ではモデル ID の差し替え自体は容易だが、ベクトル空間が異なるため既存インデックスの再構築が必要になる。マルチモーダル入力を本格活用する場合は、画像や音声をどの粒度でインデックスに含めるか、検索精度とストレージコストのバランスを踏まえた設計が求められる。
この用語を扱う記事
- ハイブリッド検索とは?ベクトル検索×全文検索でRAG精度を上げる仕組みと実装ハイブリッド検索の仕組みをベクトル検索・BM25・RRFの観点から解説。RAGシステムの検索精度を高める設計パターンと実装時の注意点を実務目線でまとめます。
- ベクトルデータベースとは?仕組み・主要製品比較・RAG活用まで徹底解説ベクトルデータベースの基本概念から、Pinecone・Weaviate・pgvectorなど主要製品の比較、RAGシステムへの活用方法まで、AI導入担当者向けにわかりやすく解説します。
- Adaptive RAGとは?クエリ主導の動的検索でコストと精度を両立する方法すべての質問で検索を行う従来RAGの非効率を解消するAdaptive RAG(能動的検索)の仕組み・実装パターン・タイB2B企業への適用例を解説します。
- RAG 構築の失敗パターン10選と回避策 — 本番運用で起きる問題を事前に防ぐRAG構築で本番運用前後に起きやすい失敗パターン10選を解説。チャンク設計の誤り・検索精度の低下・ハルシネーション対策まで、実装前に知っておくべき回避策を具体的に紹介します。
関連用語

RRF
RRF(Reciprocal Rank Fusion)とは、複数の検索手法が返すランキング結果を統合するスコアリング手法である。各手法での順位の逆数を合算することで、異なるスコア体系を正規化なしに融合

Agentic RAG
Agentic RAG とは、LLM がエージェントとして検索クエリの生成・結果の評価・再検索の判断を自律的に繰り返すことで、単純な一問一答型 RAG では得られない回答精度を実現するアーキテクチャで

エンベディング
エンベディング(Embedding)とは、テキスト・画像・音声などの非構造化データを、意味的な関係性を保ったまま固定長の数値ベクトルに変換する技術である。

GraphRAG
ナレッジグラフとベクトル検索を組み合わせ、エンティティ間の関係性を活用して検索精度を向上させる次世代RAGアーキテクチャ。



