OmniTools 6月29日消息,Anthropic应用AI工程师Margot Van Laar在Code with Claude活动中分享提示词工程实践经验。她指出,实际工作中大部分时间用于调试和维护已有生产环境中的提示词,而非从零编写。
在客服机器人维护场景中,团队采用XML标签结构化清理提示词,移除旧模型遗留的“禁止列表”指令(因新模型易对此类指令过度拟合),并精确计算工具调用时机;转人工决策时需明确其代价与收益。在零售排班Agent构建中,则将流程拆分为生成、评估、修复三个独立提示词以提升稳定性,并选用推理能力更强的Claude Opus模型。
Van Laar强调:“评估(Eval)是唯一严谨方式,没有评估就是碰运气。”