OmniTools 8月19日消息,OpenAI 因模型能力增强导致内部开发与测试风险上升,已暂停最新部署模型的强化学习(RL)训练两周,旨在加固研究环境、扩大红队测试与监控覆盖范围。 目前,其最大规模的前沿 RL 训练仍处于暂停状态。后续将通过小规模训练和系统性评估,验证安全措施有效性,并积累模型对齐相关证据。