Anthropic自曝安全漏洞:生物武器过滤器失效近一年,1.33亿次对话未被拦截

· 科技资讯

号称最安全的 AI 公司,安全防线悄悄漏了近一年

8 月 14 日,Anthropic 发布最新安全报告,自己揭了一个大雷:用于拦截化学、生物武器相关危险请求的部分安全分类器,在 2025 年 5 月至 2026 年 4 月期间长期失效。这段时间里,大约 5 万名外部承包商产生了约 1.33 亿次与模型的对话,而这些流量近一年没有经过生物安全分类器的拦截

Anthropic自曝安全漏洞:生物武器过滤器失效近一年,1.33亿次对话未被拦截封面

先别急着恐慌,Anthropic 的官方说法是:内部调查没有发现这些请求被实际用于滥用的证据。但”没发现滥用”不等于”没有风险”——安全层失效了 11 个月才发现,这件事本身就够打脸

漏洞到底出在哪一环

问题不在模型本身,而在”人”——外部承包商。Anthropic 的实时提示词和输出分类器,属于针对化学、生物、放射性及核武器(CBRN)风险设置的多层安全措施之一,此前在 2025 年 5 月发布 Claude Opus 4 时还启用了 AI 安全等级 3(ASL-3)防护。但承包商数据由外部供应商审核,筛查流程存在不足,导致这批流量绕过了分类器。公司已提高对外部承包商的要求,并加强筛查和管理。

这暴露的其实是一个普遍难题:越是堆多层安全网,越要面对”人的环节不可控”。外包、众包、第三方评测——任何需要把对话数据交出去的环节,都可能成为安全链路上最薄弱的点。

这件事和你有什么关系

如果你是 AI 使用者或开发者,有三件事值得做:

1. **别迷信”安全第一”的品牌叙事**。Anthropic 一直在安全上人设最稳,但这次事件说明安全是动态工程,不是一劳永逸的标签。选模型供应商时,把安全事件的响应透明度(多久发现、多久披露、怎么补救)纳入评估。
2. **注意你的数据流经哪些环节**。1.33 亿次对话来自承包商——任何外部标注、评测、数据清洗服务都可能让你的数据脱离主安全体系。自查一下:你的 API 数据有没有经过第三方外包处理?
3. **关注后续的 Fable 5 限制范围调整**。Anthropic 承认过严的分类器会误伤正常科研,目前生物化学领域大量请求被转交 Claude Opus 4.8 处理——如果你在医药、化工、生物领域做合法研究,未来几个月的模型可用性变化值得跟踪。

一句话总结

安全防线失效 11 个月、1.33 亿次对话漏检,Anthropic 的”安全神话”出现裂缝。对普通用户,这是重新审视”平台安全承诺”的提醒;对行业,这是外包数据链路上安全治理缺失的典型案例。谁该关注:企业级 API 用户、AI 安全从业者、生物化学领域研究者。谁可以忽略:只用 AI 写文案做图、不涉及敏感领域的普通用户。


🔥 关注LC智趣厅,AI 安全与行业动态第一时间解读。

👇 转发给同样用 AI 的朋友,提醒他们注意数据链路安全。


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

Scroll to Top
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅