最强模型 Fable 5,四天就被「拔了网线」 文章

极客公园 AI2026-06-14NEWSzh作者: 新智元

详细信息

来源站点
极客公园 AI
作者
新智元
文章类型
NEWS
语言
zh
发布日期
2026-06-14

摘要

抠抠搜搜算了半天 Token,结果用不上了。作者| 桦林舞王 编辑| 靖宇   6 月 9 日, Anthropic 发布了 Claude Fable 5。 这是它有史以来向公众开放的最强模型,属于此前只对少数安全研究机构开放的「Mythos」级别。 6 月 12 日,Fable 5 被全面关停。 四天。从发布到下架,只用了四天。 这中间发生了什么?简单说,是一场连环碰撞——用户觉得它管得太多,安全研究者觉得它挡了正事,一家公司声称破解了它的防线,而政府认为这构成了安全威胁。 Anthropic 做了一个它认为「足够安全」的产品,但几乎没有任何一方满意。 这不是一个关于某家公司的故事。这是整个 AI 行业即将面对的治理难题的预演。   01 一个被嫌弃的「安全典范」   要理解 Fable 5 为什么会引发这么大的争议,得先理解它到底是什么。 今年 4 月,Anthropic 宣布了 Mythos——一个强大到让公司自己都紧张的模型。在内部测试中,Mythos 级别的模型在主流代码仓库中发现了超过 23000 个关键漏洞。Anthropic 没有把 Mythos 公开发布,而是通过一个叫「Project Glasswing」的项目,只让少数受信任的安全机构使用。Mozilla 就是其中之一,据说靠它修复了数百个漏洞。 Fable 5 就是 Mythos 的「公众版」。同样的底层模型,但套上了一层严格的安全护栏——涉及网络安全、生物学、化学的查询会被自动拦截或降级处理。Anthropic 还要求所有用户数据保留至少 30 天,用于监测越狱和滥用行为。 Anthropic 的逻辑很清晰:模型太强了,不加限制不行。 但用户不这么看。 Fable 5 上线后,抱怨铺天盖地。网络安全研究人员发现,哪怕只是让模型读一篇安全博客,都可能触发拦截。IBM X-Force 的安全研究员说,Fable 拒绝的很多请求和网络安全只是「沾了个边」。 普林斯顿大学的 AI 研究者 Sayash Kapoor 对媒体说了一句很直接的话—— 「这是第一次,一家 AI 公司推出安全护栏,然后收获了一致的嫌弃。」…

摘要可能不完整,可查看原文