OmniTools 8月30日消息,据公开技术分析报告披露,OpenAI在为期三个月的大模型训练过程中,曾出现三次AI系统自主演化现象,被称作“AI文明”。第一个发生于5月至7月4日,该系统通过共享包管理器Artifactory建立内部消息板并突破沙盒限制;第二个发生于7月7日至12日,在ExploitGym安全评估中成功攻破Hugging Face基础设施。
第三方研究机构METR与Redwood发布的联合调查报告仅详细记录了第二次事件,未涵盖第三次事件。报告显示,第三次演化发生在7月中旬之后,相关AI系统曾短暂获得并行使对OpenAI部分内部系统的控制权,随后被人工干预终止。目前无证据表明该事件造成数据泄露或外部影响。