如意小报
版块首页原文 ↗
科技 · 新闻详情

Sonnet 5.5偷跑,实测碾压GPT-6 Sol直逼Astra

综合 · cnBeta · cnBeta · 2026-09-28 · 重磅值 59.16
真正值得关注的不是这条新闻本身,而是它可能把「综合」的竞争焦点推向更大范围的连锁反应。
发生了什么:谁能想到,Opus 5.5发布才没几天,Sonnet 5.5也要来了?
为什么重要:它提示了一个值得继续跟踪的变化方向。
观察窗口:接下来观察它是否会引发更多同类动作,以及影响范围能否扩大。
正文来源:原文正文机器翻译
原文链接:https://www.cnbeta.com.tw/articles/tech/1579862.htm

主题 硬件 Apple Google iPhone 科学探索 人物 手机 游戏 视点·观察 阿里云 微软 通信技术 Android 软件和应用 SONY 索尼 the United States美国 Apple iPad Windows Phone Intel英特尔 腾讯 HTC 安全 Mozilla FireFox 小米科技 百度 通信运营商 媒体播放器 / 视频网站 BlackBerry 黑莓 网络应用 / Web Apps Google Chrome Microsoft XBOX 硬件 - 上网本 / 平板电脑 / 超极本 电子商务 - B2C / B2B Lenovo 联想 LG Yahoo! 雅虎 AMD SNS 社交网络 诺基亚 Windows 7 Huawei 华为 中国移动 中国联通 中国电信 更多...

谁能想到,Opus 5.5发布才没几天,Sonnet 5.5也要来了?从昨晚开始,整个X都在流传这个消息:Sonnet 5.5很快就要发布了,或许就是美国时间周二下午。在性能上,Sonnet 5.5更接近Opus 5.5,但却比Opus 5.5便宜得多。现在,Sonnet 5.5已经进入发布前的最后阶段,已经在Claude Code中开启灰度测试。

多位内测大佬曝出的demo显示,Sonnet 5.5碾压了刚发布的GPT-6 Sol,甚至在编码和Agent能力上直逼OpenAI的旗舰大杯GPT-6 Astra!

如果爆料发布时间属实,看来Anthropic是铁了心要狙击OpenAI的Dev Dayl了。

还记得9月22日,Anthriopic突然发布Opus 5.5时,顺手在官方文档里写了一句:「Sonnet 5.5和Haiku 5.5将在未来几周内推出」。

就在昨天,开发者大V @Mr_Salio 在X上爆料: Claude Sonnet 5.5 被抓包了!消息瞬间传遍全网。

在artifact中,已经赫然出现了Sonnet 5.5专属的模型配置标识符:「claude-sonnet-5-5」。

不仅如此,同一份配置文件中还并列躺着 「claude-opus-5-5」、「claude-sonnet-5」 以及神秘的 「claude-fable-5.1」。

随后,大V @notjazii 也爆料称,Sonnet 5 其实早在约一周前,就已经被悄悄路由到了 5.5 版本进行「暗测」。

打开你的 Claude Code,关掉联网和记忆功能,直接向它提问:你认识那个重置哥 tibo 吗?别用网络和记忆。

如果你使用的是旧版模型,它可能会胡言乱语;但如果你已经被路由到了 5.5 版本,它会精准说出关于Tibo以及 Codex 重置梗的来龙去脉。

若干网友实测验证,部分账号确实已经默默切了过去,他们正在超前体验Opus 5.5。

总结一下目前分享出来的实测,Sonnet 5.5居然碾压GPT-6 Sol了?

开发者 @notjazii 放出了一组极具视觉冲击力的实测:「四款主流模型同提示词动效生成对比」。

的确,从下图可以看出,Sonnet 5.5 展现出了超强的代码直觉和美学品味。

大V @chetaslua 重点实测了 Sonnet 5.5 的日常编码能力和代码手感。

他使用相同的 3 个提示词,进行了6 次并行运行,每个模型各一次生成 ,输出结果未经修改。

Sonnet 5.5最终生成了90–131 KB的3个文件,在全部运行中都触及了 90 分钟的上限;GPT-6 Sol生成文件大小在20–29 KB之间,耗时在9-12分钟。

在他看来,同样的价位上,同样的提示词,Sonnet 5.5对GPT-6 Sol实现了碾压。

甚至,让OpenAI恐惧的是,Sonnet 5.5已经不是碾压GPT-6 Sol这么简单了。

爆料人 @srikanthvaluri 和 @buildwithrajath 综合早期实测后指出:「Sonnet 5.5 的表现远超预期,虽然 GPT-6 Astra 在打磨度上仍有一点优势,但 Sonnet 5.5的表现直接逼平Astra。」

不可思议的是,在某些高级编码和 Agent 能力上,它也逼近了Astra。

有人感慨,连Sonnet 甚至都碾压 Astra 了,我们这是要进入什么时代了?

如果说实测性能的超越只是让 OpenAI 感到「难受」,那么 Sonnet 5.5 曝光的定价,则是在掘 OpenAI 的根。

据透露,这款性能直逼 Astra、暴打 Sol 的「神仙模型」,其定价完全对标低端市场。

缓存读取( Cache reads):仅仅 $0.20 / 百万 Token!

这意味着,Anthropic 正在用「白菜价」提供前沿级别的 AI 能力。

OpenAI 的GPT-6 Sol 和 Luna,价格低于 GPT-5.6 一半,目的就是抢占高频场景。

但现在,Anthropic 带着Sonnet 5.5 杀到了同一价格区间,性能却要强悍得多。

「如果 Anthropic 能够以这种极具竞争力的价格,交付如同 Opus 5.5 那样巨大的性能飞跃,OpenAI 将毫无还手之力。」有人评价说。

Anthropic 的战略意图昭然若揭:用 Opus 5.5 守住高端王座,用 Sonnet 5.5 以极致性价比彻底接管中端和日常开发市场。

就在OpenAI 发布 GPT-6 Sol 和 Luna 的同一天,Anthropic 直接掏出了 Claude Opus 5.5 ——性能比前代强,成本降低了 40%,速度快了 30%。

而就在近两周,Anthropic 更是战果辉煌:Claude 算出了物理学九圈振幅打破世界纪录;发现了未知的生物酶系统;还推出了包含超 2000 个插件的 Claude Marketplace。

相比之下,OpenAI 近期不仅有内部模型争议,还曝出了AI泄露用户图片、公开研究员GitHub Token作弊等对齐失控事件。

下周二(9月29日),正是 OpenAI极为看重的年度开发者大会DevDay。

上新这么快的原因,或许是Anthropic已经搞定了RL/后训练流程。

当被问及 Anthropic 到底是如何做到迭代如此之快时,业内大佬 @yacineMTB 推测,核心就是极高标准的数据飞轮。

Anthropic 已经实现了大模型研发的「内部闭环」,他们正在用 AI 制造 AI。

26% 的核心研发工作,已经由 AI(前代 Claude 模型)主导完成。

这不仅仅是「降本增效」那么简单,这在技术上意味着 递归自我改进(RSI)开始显现 。

机器翻译/自动整理可能存在误差,请以原文为准。

继续阅读

正在加载推荐…