Claude Opus 5.5已在内测 据传可打败gpt-6-sol

摘要:

Anthropic这回,怕不是憋了个大的?所有人都在等Opus 5.2,结果最新线报来了:下一代版本号直接飙到5.5!今天一早,开发者Lyra扒出猛料,代号为“claude-wafer-eap”的Claude Opus 5.5已经在偷偷内测了。据说动作快的话,这周二就会突然砸出来。


摆明了,Opus 5.5就是冲着GPT-6去的,据传性能直接把Astra踩在脚下。

更狠的是跟着曝光的定价单:百万Token输入只要4美元,百万Token输出20美元。


这还没完,他们顺手还亮了另一张王牌,Claude Fable 5.2也在暗中铺路。

就在两天前,外媒爆出,A/在IPO之前必须扔个重磅模型出来,重新稳住市场信心。

现在看,这两张底牌一掀,好戏才刚开场。



Claude连跳两级直升5.5

或暴击GPT-6 Astra

如今,GPT-6还没捂热,Anthropic一刀就要砍过来了。

而这一切,偏偏发生在GPT-6 Sol、Gemini 4 Pro同周扎堆“灰测”的节骨眼上。

三家挤在同一个赛道,Anthropic选择用最粗暴的方式抢头条:跳级、降价、偷跑,一气呵成。

最先爆出Claude Opus 5.5的开发者Lyra,还透露了另一个细节,5.5可以打败gpt-6-sol。


但更耐人寻味的,是这次跳级背后的动作:

7月24日,Claude Opus 5正式发布。在此之后,还短暂出现过一个5.2的测试checkpoint,现在又跳去5.5。

Anthropic根本没打算做常规迭代,这次从一开始,就是奔着放大招去的。

真正上手测过的老哥Harshith说了句大实话,“Opus 5.5这波直接赢麻了,比之前的Fable 5.1和Astra都要顶”。

他反手就让5.5搓了个Waymo无人车的3D模型,结果还原度高得吓人——

连捷豹的车标、顶上的激光雷达传感器这些小细节,全生成的明明白白。


更重要的是,成本仅要Opus 5的一半。

至于消耗的 Token,可以感受下这恐怖的产出量:输入才1.4k,输出了整整532k,缓存更是跑了41.2M读取+1.7M写入。

性能暴涨的同时,价格直接腰斩。


开发者Veee也下场凑了个热闹,让Opus 5.5基于Three.js写了一个网页端3D汽车展示器。

从渲染质量和交互上看,Opus 5.5做得比较扎实。


再来看个更硬核的测试,它甚至能“一把过”,直接输出一个3D交互式“瓦力机器人”控制台。

无论在UI布局、机械绑定,还是IP还原度上,都展现出了极强的专业度。

除此之外,不少参与内测的开发者反馈,这个新checkpoint的解题直觉、深层代码重构能力和长程多步骤规划表现,已经明显拉开了与现款Opus 5的代差。

性能狂飙,价格打骨折

伴随5.5版本消息流出的,还有一组未经官方确认的API价格。

按目前流传的口径,Opus 5.5的定价预计为——

每百万Token输入4美元、输出20美元。对比现役Opus 5的5美元/25美元,降价幅度约20%。

更关键的是,缓存机制的大幅优化。缓存读取降至每百万Token 0.2美元,缓存写入为5美元。



0.2美元的缓存读取单价,意味着企业构建长时间、长上下文的自主Agent系统的开销,将暴跌一个数量级。

这个价格策略意味着一件事:Anthropic正在把顶级模型从“奢侈品”变成“日用品” 。

Fable 5.2

也在暗中发力了

Opus之外,Fable这条线也有了新动静。

开发者Pankaj Kumar刚刚放出了Fable 5.2的尝鲜体验。

按他的说法,官方似乎正把5.1的悄悄切到5.2上,而自己碰巧拿到了这趟内测的“早鸟票”。

上手之后,他给出的评价相当高,Fable 5.2的3D生成能力不仅追平了Astra,甚至大有反超的势头——

不需要详细的prompt,就能准确分析你想要什么。


他试着用Fable 5.2建了个“悬崖别墅”的3D场景,无论是打光、材质反射还是氛围感,细节都挑不出毛病。

更夸张的是,它还能直接用Three.js一把梭生成完整的小游戏。

而且这模型的前端审美极其在线,配色、排版字体、界面布局挑不出一点毛病,完成度直接把前几代甩开了几条街。


下面这段演示,做了一张极其完整的爆炸拆解渲染图,把分层的光学模组、透明部件、精密内部硬件和光影细节层层剥开。

最终呈现的整图构图精致度,令人意外。


另一位开发者Chetaslua测试中,没喂任何现成素材,没开MCP插件,甚至不需要任何灵感草图,Fable 5.2纯靠原生JS硬写出一个“微缩世界”。

下面这只超可爱的Claude吉祥物,完全都是用纯代码一笔笔渲染出来的。



来自网友的同款测试。

Fable 5.2搭出了一个完整的、能跑能动的小型JS系统——

几十种完全不同的头部建模、面部微表情、动态效果、控制面板和交互逻辑,全在一次生成里严丝合缝地跑了起来。


最后再来看一组正面对决的实测,Fable 5.2和Astra到底谁更能打?大家直接看图感受:


一边用Opus 5.5夯实企业级基础设施,一边用Fable 5.2把控创意与前端开发。

Anthropic这套双管齐下的“组合拳”,节奏卡得异常精准。

硅谷三巨头激战

本周开打

如今,大模型圈的节奏,彻底被带飞了。

眼下的AI竞技场,早已不是某一家独领风骚的独角戏。

这轮技术大换代之所以让所有人坐不住,主要是Anthropic、OpenAI和Google步调出奇地一致,把战火引向了同一个关键战场。

三家神仙打架的技术路线图,也彻底摊在台面上了。

OpenAI:Astra抬高上限,坐等日常利器GPT-6 Sol

OpenAI之前放出的GPT-6 Astra,确实把科学推理和Ai智商拔到了新天花板。

但那高昂的Token推理开销,注定它只是个供在神坛上“屠龙刀”,普通工程师日常搬砖根本不敢敞开用。

也正因如此,最近大家在OpenAI API接口里扒出的gpt-6-sol,瞬间成了全圈子最翘首以盼的狠角色。


Anthropic:嘴上喊着降速,背地里掏出新版本

要论整出这一轮好戏的最大反差,非Anthropic掌门人Dario Amodei莫属。

就在上周,达里奥还在万字长文里大声疾呼,“AI狂飙太快了,行业需要降速”。

结果背地里,直接把Opus 5.2扔进了“回收站”,连跨两级掏出了Opus 5.5,准备周二突袭。

更狠的是这次的“价格自杀式冲锋”,以百万Token 4美元的骨折价,把顶配智力直接砸向OpenAI的腹地。


Google:鸽了四个月,就看Gemini 4 Pro了

Google这边,也是不能再等了。Gemini 3.5 Pro进化程度,连Flash也不及,内部直接取消发布。

Gemini 4 Pro,也就成为了“全村唯一的希望”。

在Arena实测中,4 Pro以代号“gemini-3.8-flash”出现,各项指标完全碾压。


Logan Kilpatrick更是直言,Gemini 4将是Google迄今为止规模最大的预训练项目,目标是“让Google重回巅峰”。

回头来看,“御三家”真正的神仙大决战,就在眼皮子底下这几天了。

Anthropic这次挥刀,既是砍向GPT-6,也是砍向自己的IPO焦虑。

跳级、降价、偷跑,明眼人都看得出来:在OpenAI开发者大会之前,把开发者的钱包份额抢回来。


本周二的硅谷,注定又将迎来一个不眠之夜。

查看评论
created by ceallan