エンベディング
えんべでぃんぐ

エンベディング(Embedding)とは、テキスト・画像・音声などの非構造化データを、意味的な関係性を保ったまま固定長の数値ベクトルに変換する技術である。
コンピュータは「りんご」と「みかん」が似ていることを文字列からは判断できない。エンベディングはこの問題を解決する。「りんご」を [0.23, -0.41, 0.87, ...] のような数百次元のベクトルに変換すると、「みかん」のベクトルとは距離が近く、「自動車」のベクトルとは遠くなる。意味の近さが数値の近さとして表現される。
LLM の内部でもエンベディングは中核的な役割を果たしている。入力テキストはまずトークン化され、各トークンがエンベディングベクトルに変換される。Transformer はこのベクトル列を処理して出力を生成する。
実務で頻繁に使われるのは、文章単位のエンベディングだ。OpenAI の text-embedding-3-small や Cohere の embed-v4 といったモデルが、文章を一つのベクトルに変換する。このベクトルをベクトルデータベースに格納すれば、意味検索や RAG の検索層が構築できる。
モデル選択の際は、次元数・対応言語・コストのバランスが判断基準になる。日本語やタイ語を扱う場合、多言語対応モデルの精度を事前にベンチマークしておくことが重要だ。
この用語を扱う記事
- ベクトルデータベースとは?仕組み・主要製品比較・RAG活用まで徹底解説ベクトルデータベースの基本概念から、Pinecone・Weaviate・pgvectorなど主要製品の比較、RAGシステムへの活用方法まで、AI導入担当者向けにわかりやすく解説します。
- ハイブリッド検索とは?ベクトル検索×全文検索でRAG精度を上げる仕組みと実装ハイブリッド検索の仕組みをベクトル検索・BM25・RRFの観点から解説。RAGシステムの検索精度を高める設計パターンと実装時の注意点を実務目線でまとめます。
- Adaptive RAGとは?クエリ主導の動的検索でコストと精度を両立する方法すべての質問で検索を行う従来RAGの非効率を解消するAdaptive RAG(能動的検索)の仕組み・実装パターン・タイB2B企業への適用例を解説します。
- セマンティックキャッシュとは?AIゲートウェイでLLM費用を削減する仕組みと実装意味的類似度に基づいてAI応答をキャッシュし、重複クエリのLLM呼び出しを削減する技術を解説。AI GatewayへのSemanticキャッシュ統合手順とコスト削減効果の試算を紹介します。
関連用語

RRF
RRF(Reciprocal Rank Fusion)とは、複数の検索手法が返すランキング結果を統合するスコアリング手法である。各手法での順位の逆数を合算することで、異なるスコア体系を正規化なしに融合

Agentic RAG
Agentic RAG とは、LLM がエージェントとして検索クエリの生成・結果の評価・再検索の判断を自律的に繰り返すことで、単純な一問一答型 RAG では得られない回答精度を実現するアーキテクチャで

GraphRAG
ナレッジグラフとベクトル検索を組み合わせ、エンティティ間の関係性を活用して検索精度を向上させる次世代RAGアーキテクチャ。

Gemini Embedding 2
Gemini Embedding 2 とは、Google が開発したマルチモーダル対応のエンベディングモデルであり、テキスト・画像・動画・音声・ドキュメントを単一のベクトル空間に変換できる。



