返回行业动态

GPT-6 Astra 基准测试结果分歧显著,ARC-AGI-3 效率超人类引 AGI 时间预测调整

2026/09/04 17:12
查看原文

OmniTools 9月5日消息,GPT-6 Astra 在不同基准测试中表现差异显著:Epoch AI 给出 169 分,将其列为 267 个参测模型首位;而 Artificial Analysis 仅评 61 分,与前代 Sol 持平,且低于 Claude Fable 5.1 的 66 分。

该模型在 ARC-AGI-3 测试中展现出超越人类的推理效率,促使 AI 研究者 François Chollet 提前其通用人工智能(AGI)时间预测。

目前尚无官方确认 GPT-6 Astra 的发布状态,相关测试均基于第三方泄露或推测性评估。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部