RAG(Retrieval-Augmented Generation)
らぐ

RAG(Retrieval-Augmented Generation)とは、外部の知識ソースから関連情報を検索し、その結果を LLM の入力に付加することで、回答の正確性と最新性を向上させる手法である。
LLM は学習時点までの知識しか持たない。そして、持っている知識でも自信満々に間違えることがある(ハルシネーション)。RAG はこの二つの弱点に対する実務的な対処法として定着した。
仕組みは直感的だ。ユーザーの質問を受け取ったら、まず社内ドキュメントやナレッジベースから関連する文書を検索する。次に、検索結果を質問と一緒に LLM へ渡す。LLM は自分の知識だけでなく、渡された文書を根拠にして回答を生成する。出典を明示することもできるため、回答の検証が容易になる。
RAG を構成する要素を分解すると、文書の前処理(チャンク分割)、ベクトル埋め込み、類似度検索(セマンティック検索)、そして LLM への入力構成になる。各ステップに選択肢があり、チャンクの切り方一つで回答品質が大きく変わる。
ファインチューニングとの使い分けは頻繁に議論されるが、役割が違う。RAG は「外部の知識を参照させる」手法で、ファインチューニングは「モデルの振る舞いやトーンを調整する」手法だ。社内マニュアルの内容を正確に答えさせたいなら RAG、回答の形式や文体を統一したいならファインチューニング、が出発点として妥当だろう。両者を併用するプロジェクトも多い。
この用語を扱う記事
- ファインチューニングとRAGの選び方:コスト・精度・用途で比較する実践ガイドファインチューニングとRAGはどちらを選ぶべきか。コスト・精度・更新頻度・セキュリティの4軸で比較し、業務ユースケース別に最適な選択基準を解説します。
- AIグラウンディングとは?LLMの事実検証とWeb検索による回答精度改善の実装ガイドAI グラウンディングは LLM の回答を権威ある情報源で裏付ける技術。RAG や Web 検索を活用したハルシネーション抑制の仕組みと業務導入の実装ステップを解説します。
- RAG 構築の失敗パターン10選と回避策 — 本番運用で起きる問題を事前に防ぐRAG構築で本番運用前後に起きやすい失敗パターン10選を解説。チャンク設計の誤り・検索精度の低下・ハルシネーション対策まで、実装前に知っておくべき回避策を具体的に紹介します。
- ベクトルデータベースとは?仕組み・主要製品比較・RAG活用まで徹底解説ベクトルデータベースの基本概念から、Pinecone・Weaviate・pgvectorなど主要製品の比較、RAGシステムへの活用方法まで、AI導入担当者向けにわかりやすく解説します。
関連用語

RRF
RRF(Reciprocal Rank Fusion)とは、複数の検索手法が返すランキング結果を統合するスコアリング手法である。各手法での順位の逆数を合算することで、異なるスコア体系を正規化なしに融合

Agentic RAG
Agentic RAG とは、LLM がエージェントとして検索クエリの生成・結果の評価・再検索の判断を自律的に繰り返すことで、単純な一問一答型 RAG では得られない回答精度を実現するアーキテクチャで

エンベディング
エンベディング(Embedding)とは、テキスト・画像・音声などの非構造化データを、意味的な関係性を保ったまま固定長の数値ベクトルに変換する技術である。

GraphRAG
ナレッジグラフとベクトル検索を組み合わせ、エンティティ間の関係性を活用して検索精度を向上させる次世代RAGアーキテクチャ。



