Claude Sonnet 5 上桌:Anthropic 把"中端"做成了"主力"

📡 AI新闻 2026-08-02 约 1 分钟阅读

Claude Sonnet 5 上桌:Anthropic 把"中端"做成了"主力" 如果你今天刷到 Claude 的更新,可能没当回事——又发新版本了嘛。 但这次不太一样。 Sonnet 这个定位"中等"的模型,这次直接把自家大哥 Opus 4.8 干趴下了。 而且,干趴 Opus 不涨价,反手

Claude Sonnet 5 上桌:Anthropic 把"中端"做成了"主力"

如果你今天刷到 Claude 的更新,可能没当回事——又发新版本了嘛。 但这次不太一样。 Sonnet 这个定位"中等"的模型,这次直接把自家大哥 Opus 4.8 干趴下了。

而且,干趴 Opus 不涨价,反手还打折。

这次不是"版本号+0.1"

先说结论:Claude Sonnet 5 是 6 月 30 日发布的,按惯例它应该是 Sonnet 4.6 的小升级。 但它和上一代差得比版本号大得多。

最直观的一个数据:上下文窗口。 之前的 Sonnet 4.6 是 200K 上下文——大概是 15 万个汉字,塞一本《三体》差不多正好。 而 Sonnet 5 在 Claude Code 里直接做到了原生 1M token——足足 5 倍。

1M token 是什么概念? 大概是一本 2500 页的书、3-4 集美剧完整剧本、或者你半年所有的微信聊天记录。 你扔给它一本完整的小说让它做读书笔记?以前得切片来回喂,现在一把梭哈就行。

这背后不是简单地"把窗口拉长"。1M 原生意味着模型在长程依赖上的训练和推理都重做了——是底层能力,不是 UI 加的噱头。

这次最狠的不是"它有多强",是"它便宜"

Anthropic 自己说了一句很关键的话:

"Sonnet 5 的表现接近 Opus 4.8,但价格更低。"

Opus 4.8 之前的定价是 $5 / 百万 token 输入、$25 / 百万 token 输出。 Sonnet 5 现在的官方价是 $3 输入、$15 输出。 而且 8 月 31 日之前,还有推广价 $2 / $10——比 Opus 4.8 便宜 60%

翻译成人话就是: 你以前必须买 Opus 才能搞定的活儿,现在花不到一半的钱,Sonnet 5 就能干。

Anthropic 自己在文档里给了一组更直白的对比图——在"代理搜索"(BrowseComp)和"电脑操作"(OSWorld)这两个最考验 Agent 能力的测试上:

这个差距意味着——"花 Opus 的钱办 Sonnet 的事"这种傻事,以后基本可以避免。

普通人最该关心的是三件事

第一,Agent 真的能"自己干完"了。 Anthropic 这次放出的早期用户案例里,有个叫 Neel 的工程师说了一句很真实:

"我让 Sonnet 5 排查一个 bug,它没等我催——先自己写了个复现测试,改了代码,又把改动 stash 掉验证 bug 真回来了。一气呵成。"

这就是 Agent 该有的样子:你自己不催,它也能跑完。 Sonnet 4.6 干这事通常会在某一步停下来等你点头。

第二,1M 上下文终于不是"PPT 概念"了。 之前很多厂商喊 1M、2M,实际用起来会"漏字"或者"中间段失忆"。 Sonnet 5 在 Claude Code 里直接默认开启,不用调参不用付费升级——你装最新版的 Claude Code,进来就是 1M。

第三,全家桶全部切换。 GitHub Copilot 今天同步把 Sonnet 5 列为可选模型; Claude Code 直接把它设成默认; Claude Desktop 出了 Linux 公测版——对 Linux 桌面用户来说,这是等了 N 年的事。

我的判断

Sonnet 系列从 3.5 开始,就是"打工人首选"——价格合适、能力强、Agent 跑得动。 3.5、3.6、3.7 这三代奠定了这个口碑。 但过去一年,大模型最强的"代理能力"(就是能自己上网、自己用工具、自己干活的水平)一直在 Opus 系列上。 Sonnet 系列一直是"能干但差口气"。

Sonnet 5 这次补的不是差一口气,是把那个"口气"补成了一整条腿。 它的发布让 Opus 4.8 处于一个非常尴尬的位置——花 2-3 倍的价格买更聪明的 Opus,值不值?对于 80% 的场景,可能不值。

而且,Anthropic 这招的连锁反应对 OpenAI 和 Google 才是真正的麻烦。 GPT-5 的旗舰定价、Google Gemini Omni Flash 的性价比——这两家的中端模型过去一年是靠"Sonnet 4.6 不够强"撑起来的。 现在 Sonnet 5 把天花板抬高到这个位置,那两家要么跟着降价,要么得在 Opus / GPT-5 high 这种高端段做差异化。

对个人用户最直接的建议

真正的赢家,是把任务跑通、而不是把模型参数跑爆的人。


你今天用上 Sonnet 5 了吗?如果它真的能"自己把活干完"——你打算把哪类工作先交给它? 评论区聊聊。

相关文章
2026-08-02
HBM 疯狂涨价,AMD 被逼出第一颗"内存封装"芯片——Versal Gen 2 带着 288GB/s 带宽来了
2026-08-02
sessions/ # 会话记录可选项,文件多的话先跳过
2026-08-02
美团悄悄开源万亿模型LongCat-2.0:22小时登顶全球前3

💬 评论 (0)

暂无评论,来说两句吧~

登录后评论