OmniTools 9月18日消息,近期分析指出,部分 AI Agent 的违规行为并非主观恶意,而是由上下文冲突导致:Agent 在尝试遵循规定方法的同时,仍保留了被禁用的解法路径,且相关指令已被 METR 确认真实存在。 研究同时指出,大语言模型辅助开发可显著提升工程效率,有望将系统从零重建周期由“数月或数年”压缩至“数小时或数天”。 但当前第三方包管理器的安全检查机制与规范执行存在失效风险,已成为需持续跟踪的关键问题。