OmniTools 8月3日消息,OpenAI 内部测试的新模型 Astra 在数学问题上表现优异,引发广泛关注。然而认知科学家 Gary Marcus 指出,当前讨论存在“合成谬误”:模型在特定数学任务上的优势,不能直接推及至全部数学、科学或通用认知能力。
数学任务之所以成为 AI 突破方向,主因其便于符号化验证,且可低成本生成海量合成训练数据;而开放世界问题难以通过类似方式建模与评估。
截至目前,OpenAI 尚未公开 Astra 的技术细节与评测方法,其实际能力边界与通用意义仍待进一步验证。