ファインチューニング

ファインチューニング(Fine-Tuning)とは、事前学習済みの機械学習モデルに追加の学習データを与え、特定のタスクやドメインに適応させるプロセスを指す。
「汎用的に賢いが、自社の業務は知らない」——LLM を実務に投入しようとすると、ほぼ確実にこの壁にぶつかる。ファインチューニングは、この汎用モデルを自社仕様に仕立て直す工程だ。
歴史的には BERT の時代(2018 年頃)から NLP の標準的なワークフローとして定着していた。事前学習で言語の一般的な構造を学び、ファインチューニングでタスク固有のパターンを上書きする、という二段階学習の枠組みは今も変わっていない。変わったのはモデルの規模と、それに伴うコストの問題だ。
現在のファインチューニングは大きく 3 つに分かれる。
フル FT はモデルの全パラメータを更新する。精度は最も高くなり得るが、70B モデルなら A100 80GB が 8 枚以上必要で、学習に数日かかることも珍しくない。予算と時間に余裕がある研究機関やビッグテック向け。
PEFT(LoRA / QLoRA 等)はパラメータの一部だけを更新する。フル FT の 1/10〜1/100 のコストで、多くのタスクでフル FT に迫る精度が出る。2024 年以降、実務ではこちらが主流になりつつある。
Instruction Tuning は少し毛色が異なり、モデルに「指示に従う能力」を教える。ChatGPT が自然な対話ができるのも、ベースモデルに大量の指示応答ペアでファインチューニングを施した結果だ。
どの手法を選ぶにせよ、学習データの品質がすべてを左右する。1 万件の雑なデータより、1,000 件の丁寧にアノテーションされたデータの方が良い結果を出す——これは筆者が何度も痛感してきた教訓だ。
この用語を扱う記事
- ファインチューニング入門 — B2B企業が独自LLMを作る前に知るべき基礎と判断基準ファインチューニングの仕組みを基礎から解説。PEFT/LoRA との関係、RAG との使い分け、コスト試算、B2B 企業が独自モデル開発を判断するためのチェックリストまでをまとめます。
- ファインチューニングとRAGの選び方:コスト・精度・用途で比較する実践ガイドファインチューニングとRAGはどちらを選ぶべきか。コスト・精度・更新頻度・セキュリティの4軸で比較し、業務ユースケース別に最適な選択基準を解説します。
- PEFT(パラメータ効率型ファインチューニング)とは?AI モデルカスタマイズのコストを 90% 削減する技術PEFT(Parameter-Efficient Fine-Tuning)の仕組みと主要手法(LoRA・QLoRA・Adapter)を意思決定者向けに解説。自社 GPU 環境での実践事例と投資判断のポイントも紹介。
- SLM蒸留とは?大規模LLMから小型特化モデルを作る方法大規模LLMを教師に使い、業務特化の小型プライベートモデルを低コストで構築するSLM蒸留の仕組みと実装手順を解説します。
関連用語

PEFT
PEFT(Parameter-Efficient Fine-Tuning)とは、大規模言語モデルの全パラメータではなく一部のみを更新することで、少ない計算資源とデータでモデルを特定タスクに適応させるフ

QLoRA
QLoRA(Quantized LoRA)とは、LoRA に 4bit 量子化を組み合わせることで、コンシューマ向け GPU でも大規模言語モデルのファインチューニングを可能にした手法である。

RLHF
RLHFとは人間のフィードバックを報酬として使う強化学習手法、RLVRとは検証可能な正解を報酬として使う強化学習手法であり、いずれもLLMの出力を人間の期待に沿うよう調整するために用いられる。

SLM(Small Language Model)
SLM(Small Language Model)とは、パラメータ数を数十億〜百億程度に抑えた言語モデルの総称で、LLMに比べ少ない計算資源で推論・Fine-tuningが可能なことを特徴とする。



