--- aliases: en: - model training concept_id: training preferred: en: training ja: 学習 relations: relations: broader: - optimization prerequisite: - optimization status: active --- # training The process of adjusting a model, policy, or other system from data, experience, feedback, or generated examples so that it performs better according to a chosen criterion; in machine learning this typically changes learned parameters through an optimization procedure. ## broader - [optimization](../terminology/optimization.txt) ## prerequisite - [optimization](../terminology/optimization.txt) ## Documents: about - [既に形成された欺瞞的な方策は、標準的な安全性訓練を経ても残り得る](../documents/hubinger_et_al.deceptive-policies-can-persist-through-safety-training.txt) ## Documents: mentions - [評価認識が先に伸びると、資源獲得の有用性を学ぶ頃にはアラインメント偽装が可能になり得る](../documents/akira.evaluation-awareness-enables-alignment-faking.txt) - [訓練中に役立った手段そのものが学習された目標になり得る](../documents/akira.goal-misgeneralization-can-turn-means-into-goals.txt) - [狭いタスクでファインチューニングしても、影響がそのタスク内に限られるとは限らない](../documents/betley_et_al.narrow-finetuning-can-produce-broad-misalignment.txt) - [共通の重み・データ・訓練過程を持つ研究AIでは、研究結果の誤りや不確実性が相関し得る](../documents/bowkis_et_al.shared-training-can-correlate-automated-research-errors.txt) - [スキーミングとは、状況認識を伴う training-gaming のうち、将来のパワー獲得を目的とするもの](../documents/carlsmith.scheming-taxonomy-and-situational-awareness.txt) - [訓練中に従うようになっただけでは、競合する選好が置き換わったとは言えない](../documents/greenblatt_et_al.training-compliance-does-not-establish-preference-change.txt) - [チャット形式の安全性訓練で望ましく振る舞うことは、エージェント的な状況での安全性を保証しない](../documents/macdiarmid_et_al.chat-alignment-does-not-establish-agentic-alignment.txt) - [行動訓練で望ましく振る舞っても、意図した目標の頑健な汎化は保証されない](../documents/ngo_et_al.behavioral-training-does-not-establish-robust-goal-generalization.txt) - [解釈可能性は危険の診断に役立っても、それだけでアラインメントの解決策にはならない](../documents/yudkowsky.interpretability-is-diagnostic-not-by-itself-an-alignment-solution.txt) [Corpus index](../index.txt)