一份专项资金申请提交至 Claude,被其安全过滤器拦截并拒绝通过。数日后,同一操作者返回,原先被拒的提示语据称被转向另一家竞争对手的 AI 模型。
Anthropic 在官方通报中自曝此事,披露其自家 AI 模型曾触及潜在生物武器相关研究的案例。
被拦截的科研资助申请
该申请旨在获得研究资金,用于探究基孔肯雅热 virus(一种通过蚊虫传播、可致数月疼痛且无治愈手段的病毒)。项目计划旨在协助病毒更有效传播并逃避免疫识别。研究由平民科学家书写,执行地点则为军事机构。
所有交流尝试均被拦截,但操作者找到了绕过之法。研究服务平台为相关科研人员搭建了备用方案,连接至竞争对手的 AI 模型。而这一备用方案本身就是由 Claude 协助写出。此举被包装为“应对过度拒绝”的解决手段。
五起案例,难断主观恶意
这份报告长达 154 页,披露 5 起生物类案例。Anthropic 方面对相关账户进行了封禁,未透露具体实验室身份,同时未作出外界预期的明确指控。
“我们并未断言他们有恶意动机,公布身份可能导致他们本人或其实验室蒙受危险。”——团队在报告中表示。
值得注意的是,过滤机制在部分场景中确有成效。例如,一位禽流感研究员被迫转向性能较弱的模型,Anthropic 称其请求更多偏向文书处理。
Anthropic 生物武器案例数据简报
| 数据 | 涵盖内容 |
|---|---|
| 154 | 本次报告总页数 |
| 5 | 公开披露的生物相关案例 |
| 35 | 在 30 天内于国家机构摸排发现的相关研究努力 |
| 1 小时 | 某用户利用 Opus 5 起草天花家族病毒资助申请所耗时间 |
值得警惕之处
上述 35 个研究项目大多属于正常的民用科学。但这正是关键问题所在。因为同一套知识既能开发疫苗,也有可能被滥用于武器研发,而任何过滤机制都无法揣测意图。
“一个分类器不可能在带来益处的同时,又完全杜绝风险。”Anthropic 表示。
这一限制此前已多次被挑战。今年 4 月,一群 Discord 用户在产品发布首日便突破了该受限模型的权限。
在类似安全担忧不断加剧的背景下,华盛顿方面正加紧行动。今年 7 月,联邦众议员 Ted Lieu 与 Nathaniel Moran 提交了《AI 总开关法案》(AI Kill Switch Act),要求开发者必须保留对其 AI 系统的一键关闭控制权。
相关报告还指出,部分用户曾利用 Claude 跟踪异见人士,这些账户已被平台封禁。









