OmniTools 9月5日消息,GPT-6 Astra 在不同基准测试中表现差异显著:Epoch AI 给出 169 分,将其列为 267 个参测模型首位;而 Artificial Analysis 仅评 61 分,与前代 Sol 持平,且低于 Claude Fable 5.1 的 66 分。
该模型在 ARC-AGI-3 测试中展现出超越人类的推理效率,促使 AI 研究者 François Chollet 提前其通用人工智能(AGI)时间预测。
目前尚无官方确认 GPT-6 Astra 的发布状态,相关测试均基于第三方泄露或推测性评估。