OmniTools 8月26日消息,Anthropic宣布启动一项总额500万美元的资助计划,支持独立研究人员开展人工智能对用户福祉影响的评估研究。该计划将提供资金、模型访问权限及技术支援,重点资助构建开源评估工具与基准的项目。
资助对象需完全独立开展研究,并将成果以开源形式发布,供全行业开发者使用。Anthropic强调,当前AI在心理健康支持、陪伴对话等场景中的应用日益广泛,但缺乏统一、严谨的福祉影响评估标准,尤其在多轮对话中识别风险演变、适配个体语境等方面仍存挑战。
Anthropic同步发布了福祉评估方法论指南,提出五项核心要求:明确定义测量目标与判定标准;纳入临床及领域专家参与设计与验证;同时测试防护不足与过度干预两类风险;基于真实多轮交互场景构建测试用例;评估人员需经真实专家校准。申请截止日期为9月21日,初筛结果将于10月5日前通知。