OmniTools 8月13日消息,一位AI领域作者在完成一本关于RLHF的教科书后指出,当前大语言模型在长篇非虚构写作方面进展趋于停滞。GPT 4.5与Kimi K2等被视作写作能力较强的模型,其表现已显陈旧。 相比之下,模型在编程、数学等任务上的能力已接近人类顶尖水平。然而,在整章内容的逻辑组织、结构连贯性及事实一致性方面,仍频繁出现混乱与错误。 作者认为,该瓶颈制约了大语言模型自主推进开放科学问题的能力。