返回行业动态

Artificial Analysis 评测 Grok 4.7:智能体知识工作跻身前沿,编码代理得分升至 56

2026/09/21 20:22
查看原文

OmniTools 9月22日消息,Artificial Analysis 发布 Grok 4.7 评测,该模型在 Intelligence Index 综合指标中得分为 46,较前代 Grok 4.6 提升 2 分;在 AA-Briefcase 知识工作基准测试中获得 1657 Elo,较前代提升 111 分。该模型在编码代理任务中得分达 56,智能体知识工作能力进入当前主流大模型前列。其 AA-Briefcase 表现仅次于 Claude Opus 5 和 Claude Fable 5.1。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部