Knowledge Distillation During Mid-Training Favors Reasoning over Factual Recall
尚未评估计划受阻指标结果claim_fig4_factual_acquisition_quintiles

Teacher entropy under OLMo-2 7B Instruct strongly predicts factual acquisition under NTP: by the end of pre-training, the student learns 67% of Q1 facts vs 5% of Q5 facts; by mid-training initialization (4T tokens), 80% of Q1 facts are learned vs 7% of Q5 facts.

来源:source_paper:Figure 4, Page 6

报告指标与观测值

factual_examples_learned

fig4_factual_acq_pretraining_100b_q1

论文报告 67 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_pretraining_100b_q2

论文报告 47 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_pretraining_100b_q3

论文报告 34 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_pretraining_100b_q4

论文报告 21 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_pretraining_100b_q5

论文报告 5 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_midtraining_init_4t_q1

论文报告 80 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_midtraining_init_4t_q2

论文报告 55 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_midtraining_init_4t_q3

论文报告 42 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_midtraining_init_4t_q4

论文报告 24 percentage_points

实际观测 — percentage_points

factual_examples_learned

fig4_factual_acq_midtraining_init_4t_q5

论文报告 7 percentage_points

实际观测 — percentage_points

Assessment(0)

这条 Claim 暂无已发布的不可变 Assessment。

关联运行(0)

这条 Claim 暂无关联执行。