定義
中間学習 (Mid-training) とは、 事前学習と 指示チューニングの間に挟む 追加学習フェーズのこと。 推論力や長文処理耐性を強化する目的で行う。
中間学習 (Mid-training)とは(詳しく解説)
中間学習とは、 LLM 開発で 事前学習 (Pre-training) と 事後学習 (SFT/RLHF 等) の間に位置づけられる 追加学習フェーズのこと。 事前学習で得た汎用知識に対し、 数学的推論・長文コンテキスト処理・コード理解 など特定能力を伸ばす目的で、 比較的小規模で高品質なデータセットを使い再学習させる手法が 業界標準として広がりつつある。 Llama や DeepSeek など主要モデル系列の技術レポートでも 中間学習フェーズの存在が言及されるようになった。 2026 年時点の実運用での落とし穴は、 中間学習と ファインチューニングの境界が曖昧なまま 社内で「うちも中間学習を」と 過大なデータ整備コストをかけてしまうケース。 実際に中間学習を担うのは モデル開発元であり、 一般企業が現場で扱うのは その後段の ファインチューニングや RAG が中心になる。 選定の相場感としては、 モデルカードに中間学習の詳細開示があるかを目安にし、 開示が薄いモデルは推論力の裏付けが弱いと見るのが現実的。
この解説の引用について
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「中間学習 (Mid-training)とは」 https://aipicks.jp/glossary/mid-training
中間学習 (Mid-training)の使用例
- モデルカードの『Mid-training』欄を確認し、 推論ベンチマークの根拠データが開示されているか比較する。
- 自社でファインチューニングする前に、 候補モデルが中間学習でどの能力を強化済みか調べてから着手する。