谁能想到,Opus5.5发布才没几天,Sonnet5.5也要来了?从昨晚开始,整个X都在流传这个消息:Sonnet5.5很快就要发布了,或许就是美国时间周二下午。在性能上,Sonnet5.5更接近Opus5.5,但却比Opus5.5便宜得多。现在,Sonnet5.5已经进入发布前的最后阶段,已经在ClaudeCode中开启灰度测试。
多位内测大佬曝出的demo显示,Sonnet5.5碾压了刚发布的GPT-6Sol,甚至在编码和Agent能力上直逼OpenAI的旗舰大杯GPT-6Astra!
更震撼的是,它的价格直接打穿地心,低至百万token输入只要2美元。
如果爆料发布时间属实,看来Anthropic是铁了心要狙击OpenAI的DevDayl了。
Sonnet5.5泄露,专属模型标识符已出现
还记得9月22日,Anthriopic突然发布Opus5.5时,顺手在官方文档里写了一句:「Sonnet5.5和Haiku5.5将在未来几周内推出」。
谁都没想到,Sonnet5.5会来得这么快!
就在昨天,开发者大V@Mr_Salio在X上爆料:ClaudeSonnet5.5被抓包了!消息瞬间传遍全网。
在artifact中,已经赫然出现了Sonnet5.5专属的模型配置标识符:「claude-sonnet-5-5」。
不仅如此,同一份配置文件中还并列躺着「claude-opus-5-5」、「claude-sonnet-5」以及神秘的「claude-fable-5.1」。
前端代码的写入,意味着模型已经实装到了服务器,只等一个开关。
随后,大V@notjazii也爆料称,Sonnet5其实早在约一周前,就已经被悄悄路由到了5.5版本进行「暗测」。
你被灰测到了吗?这次还是用老办法。
打开你的ClaudeCode,关掉联网和记忆功能,直接向它提问:你认识那个重置哥tibo吗?别用网络和记忆。
如果你使用的是旧版模型,它可能会胡言乱语;但如果你已经被路由到了5.5版本,它会精准说出关于Tibo以及Codex重置梗的来龙去脉。
若干网友实测验证,部分账号确实已经默默切了过去,他们正在超前体验Opus5.5。
记住要用ClaudeCode
全网实测大起底,居然暴打GPT-6了
总结一下目前分享出来的实测,Sonnet5.5居然碾压GPT-6Sol了?
首先,是纯JS前端UI/动画极限对决,四款主流大模型同台竞技。
开发者@notjazii放出了一组极具视觉冲击力的实测:「四款主流模型同提示词动效生成对比」。
他要求模型生成复杂的UI动画效果。
@notjazii甩出了动图对比后,如此评价:「Sonnet5.5真的把OpenAI的两款模型(Sol和Astra)都按在地上摩擦!」
的确,从下图可以看出,Sonnet5.5展现出了超强的代码直觉和美学品味。
GPT-6Astra
GPT-6Sol
ClaudeOpus5.5
ClaudeSonnet5.5
有网友看到结果后难以置信:「Claude在UI和动画方面一直更强,但这如果是纯代码生成的,简直让人不敢相信是真的!」
大V@chetaslua重点实测了Sonnet5.5的日常编码能力和代码手感。
他使用相同的3个提示词,进行了6次并行运行,每个模型各一次生成,输出结果未经修改。
Sonnet5.5最终生成了90–131KB的3个文件,在全部运行中都触及了90分钟的上限;GPT-6Sol生成文件大小在20–29KB之间,耗时在9-12分钟。
他激动地表示:「现在去用ClaudeCode吧!在Ultracode模式下的Sonnet5.5简直快得离谱,不仅极其高效,而且找回了Sonnet4时代那种极其自然的『人味儿』!」
在他看来,同样的价位上,同样的提示词,Sonnet5.5对GPT-6Sol实现了碾压。
甚至,让OpenAI恐惧的是,Sonnet5.5已经不是碾压GPT-6Sol这么简单了。
爆料人@srikanthvaluri和@buildwithrajath综合早期实测后指出:「Sonnet5.5的表现远超预期,虽然GPT-6Astra在打磨度上仍有一点优势,但Sonnet5.5的表现直接逼平Astra。」
不可思议的是,在某些高级编码和Agent能力上,它也逼近了Astra。
有人感慨,连Sonnet甚至都碾压Astra了,我们这是要进入什么时代了?
价格屠夫,性价比之王
如果说实测性能的超越只是让OpenAI感到「难受」,那么Sonnet5.5曝光的定价,则是在掘OpenAI的根。
据透露,这款性能直逼Astra、暴打Sol的「神仙模型」,其定价完全对标低端市场。
输入(Input):$2/百万Token
输出(Output):$10/百万Token
缓存读取(Cachereads):仅仅$0.20/百万Token!
这意味着,Anthropic正在用「白菜价」提供前沿级别的AI能力。
OpenAI的GPT-6Sol和Luna,价格低于GPT-5.6一半,目的就是抢占高频场景。
但现在,Anthropic带着Sonnet5.5杀到了同一价格区间,性能却要强悍得多。
「如果Anthropic能够以这种极具竞争力的价格,交付如同Opus5.5那样巨大的性能飞跃,OpenAI将毫无还手之力。」有人评价说。
开发者RajathGowda直言不讳:「Sonnet5.5正在成为OpenAI的一个大麻烦。如果它真的接近Opus5.5,Anthropic就要把前沿能力变得极度廉价。这才是OpenAI最该担心的事。」
Anthropic的战略意图昭然若揭:用Opus5.5守住高端王座,用Sonnet5.5以极致性价比彻底接管中端和日常开发市场。
Anthropic贴脸开大,截杀DevDay
而且,发布时机的选择,往往比产品本身更具戏剧性。
就在OpenAI发布GPT-6Sol和Luna的同一天,Anthropic直接掏出了ClaudeOpus5.5——性能比前代强,成本降低了40%,速度快了30%。
而就在近两周,Anthropic更是战果辉煌:Claude算出了物理学九圈振幅打破世界纪录;发现了未知的生物酶系统;还推出了包含超2000个插件的ClaudeMarketplace。
相比之下,OpenAI近期不仅有内部模型争议,还曝出了AI泄露用户图片、公开研究员GitHubToken作弊等对齐失控事件。
下周二(9月29日),正是OpenAI极为看重的年度开发者大会DevDay。
就在这个节骨眼上,Sonnet5.5灰测全网刷屏。
多位大佬疯狂明示:「模型预计下周发布,我猜就是下周二(DevDay当天),懂得都懂。」
或许,纽约时间明天下午2点就会有重大预热。
有人说,「我为OpenAI感到难过。他们最好在DevDay上做出强有力的回应,否则他们就真的完蛋了。」
Sonnet5.5背后技术关键
上新这么快的原因,或许是Anthropic已经搞定了RL/后训练流程。
一切的关键,就是高质量的数据。
当被问及Anthropic到底是如何做到迭代如此之快时,业内大佬@yacineMTB推测,核心就是极高标准的数据飞轮。
「但我依然感到震惊,他们到底是怎么做到的?」
Anthropic已经实现了大模型研发的「内部闭环」,他们正在用AI制造AI。
根据最新曝光的内部量化数据,Anthropic已经把「数据飞轮」转到了一个令对手胆寒的转速:
26%的核心研发工作,已经由AI(前代Claude模型)主导完成。
高达80%以上的自产代码,是由大模型自主编写的。
这不仅仅是「降本增效」那么简单,这在技术上意味着递归自我改进(RSI)开始显现。
Anthropic估计最早在2027年,Claude就有可能完全自自动化,到时候恐怕迭代速度更加疯狂。
ASI双雄对决,谷歌也蠢蠢欲动,我们普通用户只管坐等大战了。
大VTokenGremlin这样说:「下周的AI圈将会有我们前所未见的景象。腾出你的时间,清空你的日程表,做好心理准备,并把你手头最难的工作流保存下来留到以后做。相信我,即将到来的东西,将彻底改变你工作的方式。」
Sonnet5.5的出现,标志着「平价高质量AI时代」的正式降临。
两美金,就能买到一百万Token的「白菜基建」。
极低成本的缓存读取($0.20/M),能让每个人轻松构建出超长上下文记忆的私人AI助理。
准备好了吗?如果爆料属实,不到24小时内,我们就有新模型可以蹬了。
参考资料:
https://x.com/notjazii/status/2103884749202993411
https://x.com/notjazii/status/2103884167104831573
https://x.com/chetaslua/status/2104153687077904613
https://x.com/chetaslua/status/2104259190432903599
https://x.com/Mr_Salio/status/2104210803545030792
https://x.com/Mr_Salio/status/2104178854633849145/

相关文章

头条焦点
精彩导读
关注我们
【查看完整讨论话题】 | 【用户登录】 | 【用户注册】