OpenAI 暂停前沿 RL 训练两周,强化安全与对齐标准
"We temporarily paused reinforcement learning (RL) training on our latest models intended for deployment for two weeks while we hardened and red-teamed our research environments and expanded monitoring coverage."
OpenAI 明确表示"模型能力若超出安全与对齐进度将采取行动",这对依赖前沿模型的开发者意味着:模型发布节奏可能放缓,但安全性审查会更严格;同时"安全信心将设定 AI 进展节奏"这一表态值得关注。