跳到主内容
精选75BeInCrypto 中文(RSS)加密货币多源精选 ×16

Anthropic测评:Fable 5安全风险非独有,将重新上线

Anthropic测评显示Fable 5安全风险不独特

原文

Anthropic 表示,内部测试确认 Claude Fable 5 并未带来独特的网络安全风险;与此同时,Claude Mythos 5 将于 7 月 2 日在全球范围内同步回归。

这一声明伴随 Fable 5 全球重新上线发布,标志着该产品因美国出口管制于 6 月 12 日起暂停服务的 18 天暂时划上句号。Anthropic 对比测试了多款竞品大模型,以评估出口限制背后的实际威胁。

Anthropic 为何暂停 Fable 5?

Fable 5 和 Mythos 5 均于 6 月 9 日上线,二者底层模型一致。Fable 5 面向公众开放,而 Mythos 5 则仅授权少数受信任的 Project Glasswing 合作伙伴使用,专注于防御性网络安全场景。

此前,美国政府启动出口管制,源于亚马逊研究团队发现能够绕过 Fable 5 防护机制的新方法。这一技术手段让模型得以识别出软件漏洞,甚至在某些情况下可演示利用方式。

Claude Fable 5 will be available again globally tomorrow.

After a series of productive conversations with the US government, we're redeploying the model with a new set of classifiers to target and block more cybersecurity tasks. In the near term, some routine tasks like coding…

— Anthropic (@AnthropicAI) July 1, 2026

Anthropic 的测试结果显示,Claude Opus 4.8、GPT-5.5 及 Kimi K2.7 等主流模型,同样能够检测出亚马逊报告所提及的那些安全漏洞,且均能复现实验中完成的唯一一次漏洞利用演示。

这一发现表明,相关监管指令本质上针对的是全行业普遍存在的安全短板,而非 Fable 模型独有的威胁。尽管如此,Anthropic 仍对防护机制优化升级,强化了模型分类器,使其可拦截此类攻击手法——同时,这也导致普通代码编写和调试请求被误判为风险的概率更高。

安全防护机制实际如何运行?

Fable 5 推出时,集成了 Anthropic 历史上最严格的安全保障。其分类器不仅拦截明显有害请求,对于存在轻微风险的操作也会阻断处理。Anthropic 表示,亚马逊报告事件后特训的新一代分类器,能在 99% 以上的案例中阻止相关绕过行为,被拦截的请求将自动转由 Opus 4.8 处理。

但这种高安全裕度也带来副作用。Anthropic 承认,模型对无害的代码开发与调试请求识别更为严格,误判比率上升,公司将持续优化算法以降低误报。与之不同,安全限制更少的 Mythos 5 仅面向 6 月 26 日已获政府批准的机构用户重新开放。

Anthropic 的调研结果也带来一个更值得深思的问题——既然能力弱于 Fable 5 的旧有模型同样能完成被禁用的操作,那么,监管机构未来对新一代前沿大模型又将如何设立审核与安全“红线”?

The post Anthropic测评显示Fable 5安全风险不独特 appeared first on BeInCrypto Chinese.

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源
B.AI 恢复 Claude Fable 5 API 服务,支持双渠道接入
ChainCatcher 链捕手(Telegram)原文
Anthropic Mythos:AI双刃剑挑战网络安全
Crypto Briefing(RSS)原文
Anthropic全球重新上线Claude Fable 5
WatcherGuru(Telegram)原文

相似阅读

另一事件,读法相近