Funding better evaluations of AI’s impact on wellbeing
内容摘要
Anthropic宣布推出一项价值500万美元的资助计划,旨在资助关于人工智能模型如何影响用户福祉的独立研究。该计划将向构建开源评估和基准的受资助者提供资金、模型访问权限和技术支持。由于评估福祉需要深入的上下文理解以及应对心理健康危机或饮食失调等复杂场景,该计划旨在吸引临床和主题专家参与。受资助者将独立运作并公开发表其研究成果,以帮助更广泛的人工智能行业建立更好的安全标准。
(来源:Anthropic)