跳到正文
原文
OpenAI:Alignment 研究博客(RSS)· Tomek Korbak, Cameron Raymond, Micah Carroll, Marcus Williams, Mikita Balesni, Alan Guo, Jason Wolfe, Akshay Jagadeesh, Ian Kivlichan·· 2026-03-28AI 评分56

OpenAI 实验:对齐中期训练在 o4-mini 类模型上难以泛化

How far does alignment midtraining generalize?

AI 导读

OpenAI 对齐团队在 o4-mini 规模模型上测试了 Tice et al. 提出的对齐中期训练,用各 230k 文档(约 340M tokens)分别做对齐与错位中期训练后再做推理后训练。

来源:OpenAI:Alignment 研究博客(RSS) · alignment.openai.com