Anthropic推出500万美元资助计划用于AI用户福祉研究
开发Claude语言模型的AI研究公司Anthropic宣布了一项500万美元的资助计划,用于资助独立研究,研究AI系统如何影响用户福祉。这项计划在2026年8月25日发布的公司博客文章中进行了详细说明,将为开发开源评估工具的开发者提供资金支持、访问Anthropic的AI模型以及技术资源。申请截止日期为9月21日,入围候选人将在10月5日前收到通知。
随着AI系统在工作、教育甚至情感支持中变得日益重要,建立这些模型如何与用户互动的强大标准的需求也在增长。Anthropic的资助计划旨在通过资助创建工具和基准来填补这一空白,这些工具和基准可以评估像Claude这样的AI系统对用户的细微影响,特别是在心理健康危机等敏感情境下。这项研究结果将公开发表,从而使更广泛的AI社区能够采用和改进这些标准。
根据Anthropic的说法,评估AI交互中的福祉具有独特的挑战性。与评估输出的准确性不同,福祉评估需要情境敏感的方法。例如,在一个情境下看似适当的AI回复——比如关于饮食的建议——如果用户有饮食失调的历史,可能会带来有害的影响。Anthropic的安全团队制定了严格的福祉评估标准,强调临床专家的参与、真实世界场景测试以及对风险和保护措施的评估。
该公司将这一计划视为其对AI安全性、可解释性和负责任发展的更广泛承诺的一部分。Anthropic由前OpenAI高管于2021年创立,自成立以来迅速成为AI领域的领军者,与OpenAI的ChatGPT、Google Gemini以及Meta的Llama模型展开竞争。其估值在2026年5月完成的65亿美元H轮融资后飙升至9650亿美元,反映出Claude及相关企业解决方案的巨大需求。
随着行业应对生成式AI对社会的影响,Anthropic也在面对日益严格的审查。今年早些时候,该公司启动了一项名为“直面尖锐问题”的计划,公开回应公众对AI的担忧。这项最新的资助计划延续了这一精神,旨在吸引心理学家、临床医生及其他领域专家的外部观点,以塑造行业标准。
对于有兴趣申请的人,Anthropic提供了有关什么是严格评估以及常见陷阱的详细指导。公司鼓励提出针对真实世界用例的提案,特别是多轮对话中风险可能随着时间积累的情境。最终目标是创建伴随AI模型进化的基准,以确保它们始终与用户福祉保持一致。
随着Anthropic加强IPO前活动及潜在收购的讨论,这项资助计划突显了其对长期信任与安全的关注。尽管目前没有公开市场指标衡量Anthropic,但其类似的战略举措继续将其定位为负责任AI开发的领导者,这一立场可能在预计的IPO期间对投资者产生强烈共鸣。