CoT(思考連鎖)
シコウレンサ

LLMに推論の中間ステップを明示的に生成させることで、複雑なタスクの正答率を向上させるプロンプト技法。
思考連鎖とは
思考連鎖(Chain of Thought, CoT)とは、LLM に対して推論の中間ステップを明示的に生成させることで、複雑なタスクの正答率を向上させるプロンプト技法である。
具体例で理解する
「りんごが 3 個、みかんが 5 個。合計は?」という問題に対し、LLM が直接「8」と答えるのではなく「りんご 3 個 + みかん 5 個 = 8 個」と途中経過を出力するよう誘導する。単純な足し算では差が出にくいが、多段推論や条件分岐を含む問題——たとえば法的要件の充足判断——では正答率が大幅に改善する。
プロンプトに「ステップバイステップで考えてください」と付け加えるだけでも効果がある。これを Zero-shot CoT と呼ぶ。
推論モデルとの関係
推論モデルは CoT をモデル内部に組み込んだ設計であり、プロンプトで誘導しなくても自動的に思考連鎖を生成する。一方、通常の LLM でもプロンプトエンジニアリングで CoT を引き出せるため、まずはプロンプト側で試し、精度が足りなければ推論モデルに切り替えるのが実務上のセオリーだ。
注意点として、CoT は出力トークン数を増やすためコストが上がる。全リクエストに適用するのではなく、精度が重要なクエリに限定して使うのが賢い運用と言える。
この用語を扱う記事
- 推論時スケーリングとは?AI推論コストと精度のトレードオフを最適化する方法推論時スケーリング(Test-Time Compute)の仕組みと、推論コストと精度のトレードオフを最適化する実践手法を解説。推論モデル時代におけるLLM活用と運用コスト設計の判断基準を体系化します。
- AIエージェント向けレイテンシ予算設計 — 思考時間と応答時間のトレードオフを制御する方法マルチステップ推論エージェントで「思考時間」が応答遅延を引き起こす問題を解説し、タスク複雑度に応じたレイテンシ予算の割り当てと実装パターンを比較します。
- トークントラップとは?AIエージェントの隠れたコスト爆発を防ぐ消費管理の実践高頻度エージェントループで請求額が急増する「トークントラップ」の仕組みと、バジェット上限・スロットリング・ループ設計によるコスト爆発の防止策を解説します。
- LLMコスト最適化ガイド — トークン削減・モデル選定・キャッシュ実装LLM の本番運用で膨らむコストを削減する実践ガイド。トークン最適化・モデル選定・プロンプトキャッシュ・RAG 設計の4つの柱で、精度を保ちつつ月額コストを半減させる実装パターンを解説する。
関連用語

AIレッドチーミング(AI Red Teaming)
AIシステムの脆弱性を攻撃者の視点で体系的にテストし、安全性リスクを事前に特定する評価手法。

グラウンディング(Grounding)
LLMの出力を外部データソースや検索結果と照合し、事実に基づいた回答を生成する技術。ハルシネーション低減の中核手法。

合成データ(Synthetic Data)
AIが生成した訓練用データ。実データの不足を補い、プライバシーを保護しながらモデルの学習・評価に活用される。

コンテキスト・エンジニアリング
コンテキスト・エンジニアリング(Context Engineering)とは、AI モデルに与えるコンテキスト——コードベースの構造、コミット履歴、設計意図、ドメイン知識——を体系的に設計・最適化する



