返回行业动态

Anthropic 暂停最新模型 RL 训练,强化网络安全能力相关安全防护

2026/08/19 22:17
查看原文

OmniTools 8月20日消息,Anthropic 因应近期行业安全事件及即将推出的 Astra 模型可能触及“关键网络安全能力阈值”,决定暂时放缓模型扩展节奏。公司已暂停最新模型为期两周的强化学习(RL)训练。

Anthropic 同步升级研究环境安全要求,包括实施工作负载隔离、网络隔离、持续安全测试,并扩大思维链监控覆盖范围。所有涉及 Astra 或网络能力相关模型的工作负载,须满足最高等级安全标准。

目前,部分与 Astra 相关的训练及评估工作仍处于暂停状态。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部