チャンクサイズ
チャンクサイズ

チャンクサイズとは、RAG パイプラインにおいて文書をベクトルストアに格納する際の分割単位の大きさ(トークン数や文字数)を指す。検索精度と回答品質に直結する重要なパラメータである。
なぜ分割が必要なのか
LLM のコンテキストウィンドウには上限がある。数百ページの社内マニュアルをそのまま渡すことはできないため、文書を適切な粒度に分割(チャンキング)してベクトル化し、質問に関連する部分だけを検索・取得する必要がある。このとき「どの程度の大きさで切るか」がチャンクサイズの問題になる。
大きすぎても小さすぎても困る
チャンクが小さすぎると、1つのチャンクに含まれる文脈が不足し、検索でヒットしても LLM が回答を組み立てるのに必要な情報が欠ける。逆に大きすぎると、無関係な情報がノイズとして混入し、回答精度が下がるうえにトークンコストも増える。
一般的には 256〜1,024 トークン程度が出発点とされるが、最適値はドメインと質問の性質に依存する。FAQ のような短い Q&A なら小さめ、技術仕様書のような前後の文脈が重要な文書なら大きめに設定する、というのが実務での基本方針だ。
オーバーラップという工夫
チャンク境界で文脈が途切れる問題を緩和するために、隣接チャンクを一部重複させる「オーバーラップ」がよく使われる。たとえばチャンクサイズ 512 トークン、オーバーラップ 64 トークンなら、前のチャンクの末尾 64 トークンが次のチャンクの先頭にも含まれる。BM25 やベクトル検索の精度向上に寄与するが、ストレージとインデックスサイズは増加する。
この用語を扱う記事
- RAG 構築の失敗パターン10選と回避策 — 本番運用で起きる問題を事前に防ぐRAG構築で本番運用前後に起きやすい失敗パターン10選を解説。チャンク設計の誤り・検索精度の低下・ハルシネーション対策まで、実装前に知っておくべき回避策を具体的に紹介します。
- トークントラップとは?AIエージェントの隠れたコスト爆発を防ぐ消費管理の実践高頻度エージェントループで請求額が急増する「トークントラップ」の仕組みと、バジェット上限・スロットリング・ループ設計によるコスト爆発の防止策を解説します。
- ベクトルデータベースとは?仕組み・主要製品比較・RAG活用まで徹底解説ベクトルデータベースの基本概念から、Pinecone・Weaviate・pgvectorなど主要製品の比較、RAGシステムへの活用方法まで、AI導入担当者向けにわかりやすく解説します。
- ハイブリッド検索とは?ベクトル検索×全文検索でRAG精度を上げる仕組みと実装ハイブリッド検索の仕組みをベクトル検索・BM25・RRFの観点から解説。RAGシステムの検索精度を高める設計パターンと実装時の注意点を実務目線でまとめます。
関連用語

RRF
RRF(Reciprocal Rank Fusion)とは、複数の検索手法が返すランキング結果を統合するスコアリング手法である。各手法での順位の逆数を合算することで、異なるスコア体系を正規化なしに融合

Agentic RAG
Agentic RAG とは、LLM がエージェントとして検索クエリの生成・結果の評価・再検索の判断を自律的に繰り返すことで、単純な一問一答型 RAG では得られない回答精度を実現するアーキテクチャで

エンベディング
エンベディング(Embedding)とは、テキスト・画像・音声などの非構造化データを、意味的な関係性を保ったまま固定長の数値ベクトルに変換する技術である。

GraphRAG
ナレッジグラフとベクトル検索を組み合わせ、エンティティ間の関係性を活用して検索精度を向上させる次世代RAGアーキテクチャ。



