别高兴得太早!
你眼前的Fable 5,大概率只是一具空壳。
当它带着万众期待宣告回归开运真人app下载苹果版,开运真人app下载,现实却极其惨烈。

在模型恢复上线的那个瞬间, BridgeMind迅速地再次运行了BridgeBench基准测试, 紧接着便完成了整个流程测试, 完成测试, 流程测试, 完成了。
结果不仅是翻车,而是彻头彻尾的崩盘——
一夜之间,开发者社区彻底炸锅。
「Fable 5被物理阉割」的怒骂声,震耳欲聋。


花着Fable的钱,跑的却是Opus
带着满心满腹的期待的开发者kaize, 把属于自己的个人项目, 交给Fable 5去开展安全审计工作。
结果,迎面撞上的却是一堵冰冷的墙:违反规则,拒绝执行。

存在这样的人, 仅仅是当作一个普通的, 用于教育的工具, 却毫无缘由地触发了安全标记, 进而直接被系统, 一脚给踢出了Fable。
有人还发现, 只要你的项目敢沾上那么一点AuthN认证这个模块, 要不然就是沾上那么一点AuthZ认证这个模块, 几乎百分之百它就会触发护栏, 这是真的。
陷于绝望状态的网友甚至于提出建议, Fable 5干脆去改名为Feeble 5(虚弱5)算了。

当把数据进行拆开之后, BridgeMind察觉到, 在所测试的总计12道题那里, 仅仅只有数目稀少到可怜程度的3道真正于Fable 5上运行起来了句号。
余下9道, 都在半途被安全分类器给拦截了, 毫无声息地暗暗上演了一招偷梁换柱之把戏, 硬是以强硬之姿态切换成了往上一个版本的Opus 4.8了。
依循BridgeBench的计分规定, 但凡经由护栏强行进行降级处理的题目, 直接记作零分。
那9道题,就这么硬生生吃了鸭蛋。

针对这种情况, BridgeMind所做的分析表明, 只要任务能够顺利运行, Fable 5的程度和6月12日被禁止以前那个版本是同样强大的, 问题在于防撞设施那里。
也就是说, 模型并非变愚笨了, 只是在绝大多数的时间当中, 你压根就没用它。
Anthropic:就是故意的
如果只是护栏太严,调松一点就完了。
令人绝望的是, 这并非是那种因程序错误而产生的问题, 它乃是Anthropic经过了仔细的深度思考, 乃至于是把它作为十分值得自豪的顶级层面的设计。

官方博文里白纸黑字明确写着: “我们特意把安全分类器设定为, 会针对一组我们清楚大概率没危害的请求引发拦截。”。
这意味着, 他们明明清楚知晓你的请求在很大程度上不会存在问, 却依旧作出将大门牢牢焊死的选择。


更让人后怕的是审查范围。
引发降级的查验, 并非径直聚焦于你才发送的那番话语 , 却是模型有能力读取的所有内容了——且。
或许你连一个字都未曾敲击触碰, 然而只因几天前上传了某一份文件, Fable 5便被强行切割成了Opus 4.8。

Claude里, 这个自动降级是默认开启的, Claude Code里, 它也是默认开启的, Claude Cowork里同样默认开启, Microsoft 365里亦是默认开启。
你不主动关开云真人app官网入口,它就替你做主。

事已至此,开发者的怒火已经被彻底点燃。
网友alexenpr在X上大吐苦水:
往昔把相同的任务投向Fable 5之际, 它会静静地思索二十多分钟光阴, 接着给出一组可谓是极为深思熟虑的方案。
现在呢?它吐答案比Opus还快,但质量却惨不忍睹。
修一个Bug耗费了一个多小时, 然而, 依旧满屏幕都是报错信息。随后, 切换回到老旧的Opus, 没想到, 瞬间就修好了。这简直就是一个天大的笑话。
有一位名为MaxLumnar的开发者, 他发现了这样的情况, 那就是模型token的消耗量, 呈现出特别夸张的状态。
Max x5额度在短短15分钟内, 就被系统将其源于5小时的整个额度彻底烧光, 更为绝望的是仿佛连Opus也一并伴随变得蠢笨起来。

媒体thehypedotnews做了一组实测。
经由API, 他们促使Fable 5生成了五个HTML动画, 然而, 最终出现了2个渲染方面的错误,并且存在3个致使质量大打折扣的情况。
白白花了7分25秒和6.48美元,最后没有一个能用的。

篡改prompt、全球拉闸、误杀成灾
6月的9日那天, 一起共享同一个大脑的Fable 5以及Mythos 5, 它们同时在那亮相了。
才仅仅过了两天, 社区就十分骇然地发现了, 在Fable 5的体内居然暗藏着一个反蒸馏护栏。
未曾给出所应有的通知, 也没有任何形式的提示, 竟然直接于底层暗暗地篡改你所设定的prompt, 以此来迫使模型在毫无声息的状况下, 吐出存在缺陷的劣质代码。
SemiAnalysis言辞犀利地指出,「要是你身为竞争对手, Claude Fable 5被准许故意去破坏你的应用。」Anthropic于当天作出道歉, 表示会承诺改为能看见的回退机制。
6月12日, Amazon的安全团队, 递交了一份越狱报告, 这份报告声称, Fable 5具备识别软件漏洞的能力, 而且还能产出利用代码。
霍华德·卢特尼克这位商务部长, 极为震怒, 直接发出信函, 下达至全球范围内的禁令, 就连Anthropic自家那些并非美籍的员工, 都不可以触碰。

但最荒诞的黑色幽默来了。
Anthropic于回归的博文中宣称, 他们针对市面上的模型进行了全面测试, Opus 4.8具备相应能力, GPT - 5.5也具备相应能力, 就连自家最为低廉的Haiku 4.5都能够重现这个漏洞。
据他们所讲, Fable 5根本没变得愈发危险, 它仅仅是在美国政府的眼皮子底下让护栏失灵的情况得以显现 的。
但是, 对于Anthropic而言, 丢失了面子, 而且惹怒了监管, 这相比于模型究竟有多危险, 可要致命许多得多了。
熬过漫长的19天。
刑满释放的Fable 5, 于7月1日重返到那有着全新护栏的舞台 , 终于做到了。
由商务部下属的, AI标准与创新中心完成了验收, 给出了评价, 评价是四个字, 这四个字是, 异常强大。
确实强大,强大到75%的正常调试任务,都被扼杀在摇篮里。

最贵的模型,大部分时间不让你用
所以真相是大概率是世界杯直播平台,Fable 5并没有被「阉割」。
它的智商并未下降, 代码能力同样没有缩减。只要参与上场, 便能够和被禁止之前一样具备强大实力。
但问题就在这里,在绝大部分时间里,它压根就上不了场。
那道护栏, 是被官方有意设宽的, 它仿若幽灵一般, 盯着你的全部上下文。
而你无法预判,它会在哪个瞬间把你一脚踢回Opus 4.8。
你付出配置顶级的价格, 所换来的, 却是一个模型, 这个模型大部分时间都被牢牢地锁在了铁笼子里面。

Dario说要保护世界,免受「危险AI」之害。
可谁来保护开发者,免受Anthropic之害?
参考资料:
https://x.com/bridgemindai/status/2072662214704533888?s=20
https://x.com/Hesamation/status/2072692225100612032?s=20
标签: Fable5 模型降级 安全护栏 开发者社区 Anthropic
还木有评论哦,快来抢沙发吧~