返回行业动态

英伟达研究:在长周期任务中,AI智能体的“驾驭框架”比底层模型更关键

2026/08/21 19:45
查看原文

OmniTools 8月22日消息,英伟达最新研究指出,在长周期任务中,决定AI智能体表现的关键因素并非底层大模型,而是其外部“驾驭框架”(harness)。该框架负责记忆管理、上下文维护、反馈处理及工具调用等能力。

研究团队在ARC-AGI-3交互式推理基准测试中,为Claude Opus 5模型配备定制化驾驭框架(含监督组件),使其得分从30%提升至100%;未加框架时该模型得分为30%,已是所有参测模型中的最高分。该框架被命名为Agentic Variation Operators(AVO),属实验性技术,非商业化产品。

英伟达强调,智能体系统由模型、驾驭框架、运行时环境及技能库共同构成;仅将智能体视作模型API是一种常见误解。同期,Databricks亦发现不同驾驭框架可使相同模型的推理成本相差达两倍。研究进一步支持开放驾驭框架对可控性、安全性与性能优化的重要性。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部