Anthropic评估人工智能在监控和武器开发中的风险
2026年9月10日,Anthropic的Frontier Red Team发布了一份详细评估报告,探讨了高级人工智能模型如何被利用以产生国家安全风险,重点关注战术情报定位和常规武器开发。报告突出了人工智能能力的主要进展,这些进展可能推动监控、精准定位以及自主武器工程的发展。同时,报告强调了部署安全措施以缓解这些风险的紧迫性。
Red Team进行了模拟军事和情报任务的受控评估。例如,人工智能模型被测试用于根据照片和社交媒体帖子进行地理定位、跨平台关联数字身份,甚至在模拟环境中编写无人机导航和有效载荷投递的软件。值得注意的是,Anthropic的Mythos Preview和Opus 5模型在图像地理定位任务中表现出接近超人水平的表现,中位误差低至37公里,在某些情况下甚至超越了精英人类基准。
在监控任务中,模型在关联数字身份和分类个体方面表现出令人担忧的能力。通过使用模仿社交媒体活动的合成数据集,Mythos Preview在将多个账户关联到同一人身上表现出色,即使在具有挑战性的条件下亦是如此。这可能显著降低寻求进行大规模监控或定向攻击的行为者的成本和技术门槛。
在武器领域,评估展示了人工智能如何自动化无人机的导航和引导任务。表现最好的模型Opus 5成功编写并优化了飞行控制软件,使无人机能够在随机干扰GPS的环境中导航并攻击目标。尽管这些模型仅在沙盒模拟中运行,结果仍然强调了向现实世界应用发展的趋势,特别是随着恶意行为者不断改进这些能力。
开源权重模型虽然不如Mythos和Opus等专有系统先进,但也展示了令人担忧的能力。Anthropic的报告警告称,此类模型正在缩小性能差距,引发了关于敏感人工智能技术民主化的疑问。这些发现呼应了Anthropic在2026年7月关于人工智能控制无人机的试点研究以及其更广泛的《负责任扩展政策》评估中提出的担忧。
Anthropic已实施新的安全措施,包括分类器以阻止其模型在监控和武器开发中的滥用。然而,报告还呼吁建立更强的监管和政策框架。报告建议,各国政府和开发者需要解决人工智能系统赋权低资源群体以获取此前仅国家级行为者可用工具所带来的风险。
报告还提出了更广泛的地缘政治担忧。Anthropic的首席执行官最近警告称,威权政权可能会利用人工智能进行军事和监控,特别是在这些模型秘密训练时。今天发布的评估提醒人们人工智能在国家安全背景下能力的快速提升,这对防御方和对手都有深远影响。
展望未来,Anthropic计划将其评估扩展到其他领域,例如太空和水下战争。公司强调,随着人工智能模型的持续进步,需要进行持续监控和反复优化安全措施。对于政策制定者和人工智能开发者来说,挑战将是在防止敏感应用中滥用的同时平衡创新与强有力的控制。