Pre-trainingの意味
公式・公的資料で確認
Pre-trainingとは
Pre-trainingは、モデルを特定の業務へ調整する前に、幅広いデータを使って基本的なパターンや表現を学習させる段階です。大規模言語モデルでは大量の文章などから次のトークンを予測する学習が代表例です。Fine-tuningやInstruction Tuningの前段にあたります。
詳しい説明
それが何か、何ができるか、どこで使われるか
Pre-trainingは、モデルを特定の用途へ適応させる前に、幅広いデータから一般的なパターンや表現を学習させる初期学習段階です。Googleの機械学習用語集は、LLMを大規模な一般データセットで最初に訓練する段階として説明し、その後にFine-tuning、Distillation、Instruction Tuning、Parameter-Efficient Tuningなどを行う流れを示しています。言語モデルでは、入力されたトークンから次のトークンを予測する学習が代表的ですが、画像や音声など別のデータ形式では学習目的が変わります。Pre-trainingで得られたモデルは、すぐに特定業務へ最適化されているとは限らず、指示に従う能力、出力形式、安全性、専門領域への適合は別の学習や評価で確認します。学習データの出所、権利、重複、偏り、除外処理も、モデルの挙動やリスクに影響します。Pre-trainingを行ったという事実だけで、最新情報や高い正確性を意味しません。
大量データで共通する表現を先に学習することで、後段のFine-tuningやInstruction Tuningの土台を作れます。
現在はデータの出所・権利・重複・偏りと、学習後の評価や専門用途への適合を別々に確認します。
関連する用語
この言葉を位置づけるための関連語
根拠資料と確認状況
確認日・出典
公式・公的資料で確認
最終確認2026/8/23
読み方と意味を、
分けて確認。
正式名称、意味、使われる分野を分けて記録しています。