资助对人工智能对福祉影响的更佳评估
Anthropic 宣布启动一项价值 500 万美元的资助计划,旨在支持独立研究人员开展关于人工智能对用户福祉影响的研究。该计划将为获奖者提供直接资金、模型访问权限及技术支援,用于构建开源评估项目,帮助 AI 行业衡量模型对使用者的具体影响。获奖者将完全独立工作,并将研究成果以开源形式发布。鉴于 AI 系统已成为人们工作、学习和情感支持的重要伙伴,但行业在制定模型行为标准及评估福祉方面仍面临挑战,特别是需要更多上下文信息才能准确判断回应是否恰当或有害。Anthropic 希望通过资助独立评估和基准测试,邀请临床医生、心理学家等专家参与这一关键领域的发展。申请指南由安全团队提供,截止日期为 9 月 21 日,最终提案提交者将于 10 月 5 日前获通知。