LLM(大規模言語モデル)
えるえるえむ

LLM(Large Language Model)とは、大量のテキストデータで事前学習された、数十億〜数兆のパラメータを持つニューラルネットワークモデルの総称であり、自然言語の理解・生成を高い精度で行う。
2022 年 11 月の ChatGPT 公開を境に、LLM という言葉は技術者の間だけでなく一般にも広まった。だが「大規模言語モデル」という名前が示す本質はシンプルで、「大量のテキストを読ませて、次に来る単語を予測する訓練を繰り返したモデル」に過ぎない。この単純な学習目標から、翻訳・要約・コード生成・推論といった多様な能力が創発的に現れるのが LLM の面白さであり、同時に理論的な理解が追いついていない部分でもある。
規模感を具体的に示すと、GPT-3 が 1,750 億パラメータ(2020 年)、Llama 3 が 700 億パラメータ(2024 年)、GPT-4 は非公開だが推定で 1 兆超とされている。パラメータ数が増えるほど賢くなる傾向はあるが、Llama 3 70B が GPT-3 175B を多くのベンチマークで上回っている事実が示すように、学習データの質とアーキテクチャの改善も同等以上に重要だ。
実務で LLM を使うルートは主に 3 つある。
1 つ目は API 経由。OpenAI や Anthropic のモデルをそのまま呼び出す。最も手軽だが、データが外部に送信される点と、従量課金のコスト管理が課題になる。
2 つ目は RAG との組み合わせ。社内ドキュメントを検索して LLM に渡すことで、ハルシネーション(事実と異なる出力)を抑えつつ社内知識を活用する。モデル自体は変更しないため導入障壁が低い。
3 つ目は ファインチューニング。自社データでモデルの振る舞いを調整する。回答のトーン統一や、業界特有の専門用語の正確な使用が必要な場合に有効だが、学習データの準備と GPU コストが必要になる。
どのルートを選ぶかは「何を解決したいか」次第であり、3 つを組み合わせるケースも増えている。
この用語を扱う記事
- ローカル LLM / SLM 導入比較 — クラウド API に依存しない AI 活用GPT OSS・Phi-4・Llama 4 Scout 等のオープンウェイトモデルを GPU 要件・タスク別精度・TCO の 3 軸でクラウド API と比較。データ主権とコスト最適化を両立するローカル AI 導入ガイド。
- エッジAIとは?オンデバイスLLMの仕組みと業務での選び方エッジAI・オンデバイスLLMの基本と、クラウドLLMでは難しい低レイテンシ・データ持ち出し不可・通信不安定の業務をどう設計するかを解説します。
- モデルマージとは?複数LLMを訓練なしで合成して性能を上げる技術ファインチューニング済モデルを数学的に結合し、計算コストを抑えながら複数スキルを統合するModel Mergingの仕組みと活用法を解説します。
- Liquid Neural Networksとは?挙動が動的に変わる次世代AI推論推論中に時定数(time-constant)が入力に応じて変化し、ネットワークの挙動がリアルタイムに適応するLNNの仕組み・従来モデルとの違い・エッジAI活用の可能性を解説。学習済みの重みは固定したまま動的に振る舞う点を整理します。
関連用語

PEFT
PEFT(Parameter-Efficient Fine-Tuning)とは、大規模言語モデルの全パラメータではなく一部のみを更新することで、少ない計算資源とデータでモデルを特定タスクに適応させるフ

QLoRA
QLoRA(Quantized LoRA)とは、LoRA に 4bit 量子化を組み合わせることで、コンシューマ向け GPU でも大規模言語モデルのファインチューニングを可能にした手法である。

RLHF
RLHFとは人間のフィードバックを報酬として使う強化学習手法、RLVRとは検証可能な正解を報酬として使う強化学習手法であり、いずれもLLMの出力を人間の期待に沿うよう調整するために用いられる。

SLM(Small Language Model)
SLM(Small Language Model)とは、パラメータ数を数十億〜百億程度に抑えた言語モデルの総称で、LLMに比べ少ない計算資源で推論・Fine-tuningが可能なことを特徴とする。



