OmniTools 8月19日消息,最新评测显示,智能体记忆功能并非简单叠加越多越好,其注入方式与剂量需依据模型自身能力进行校准。强参数量模型如 DeepSeek-V3.2(671B MoE)采用完整指南集注入,任务完成率提升 9.5 个百分点;而中等规模模型如 gpt-oss-120b(117B MoE)则在精选检索策略下表现更优,任务完成率提升 16.1 个百分点,且仅增加 5% 推理 token 消耗。该方法无需修改模型权重或依赖人工标注,通过从智能体历史交互轨迹中蒸馏结构化指南,并于推理阶段动态注入实现。