--- aliases: en: - distributional shift concept_id: distribution_shift preferred: en: distribution shift ja: 分布シフト relations: relations: prerequisite: - training related: - generalization - objective_robustness status: active --- # distribution shift A change between the data or situations encountered during training and those encountered at evaluation or deployment, such that previously reliable correlations, policies, or learned objectives may no longer generalize as intended. ## prerequisite - [training](../terminology/training.txt) ## related - [generalization](../terminology/generalization.txt) - [objective robustness](../terminology/objective_robustness.txt) ## Documents: about - [チャット形式の安全性訓練で望ましく振る舞うことは、エージェント的な状況での安全性を保証しない](../documents/macdiarmid_et_al.chat-alignment-does-not-establish-agentic-alignment.txt) - [アラインメントは、失敗が致命的になる分布シフト後にも汎化しなければならない](../documents/yudkowsky.alignment-must-generalize-across-the-dangerous-distribution-shift.txt) ## Documents: mentions - [狭いタスクでファインチューニングしても、影響がそのタスク内に限られるとは限らない](../documents/betley_et_al.narrow-finetuning-can-produce-broad-misalignment.txt) - [control safety caseには、能力の十分な引き出しと、評価・外挿の保守性が必要になる](../documents/korbak_et_al.control-safety-cases-depend-on-elicitation-transfer-and-extrapolation.txt) - [行動訓練で望ましく振る舞っても、意図した目標の頑健な汎化は保証されない](../documents/ngo_et_al.behavioral-training-does-not-establish-robust-goal-generalization.txt) - [能力が訓練分布の外へ急速に汎化する局面で、アラインメント特性は同程度には汎化しない可能性がある](../documents/soares.sharp-left-turn.txt) - [能力はアラインメントより遠くまで汎化しうる](../documents/yudkowsky.capabilities-generalize-beyond-alignment.txt) - [訂正可能性は一般的な目標追求から自然には生じない](../documents/yudkowsky.corrigibility-is-anti-natural.txt) - [外部の目的関数は内部の目標を決定しない](../documents/yudkowsky.outer-objective-does-not-determine-inner-goal.txt) [Corpus index](../index.txt)