Sonnet5最佳工作模型正式上线直接可用
时间:2026-07-24 | 作者:实验室老王 | 阅读:0Anthropic 的账号还好吗?Claude 新模型 Sonnet 5 来了。快速测试了一轮,确实有点东西。
最近业内都在讨论 Opus 4.8 降智的问题。现在看来,背后有推手——所有资源都给 Sonnet 5 让步了。
翻了一遍官方博客,结论很清晰:Sonnet 5 走的是“物美价廉”路线,目标就是成为最适合日常工作的模型。
先说物美
一步到位的大版本迭代。对于正在用 Sonnet 4.6 的用户来说,这次升级是一次大版本迭代。Sonnet 5 在推理、工具使用、编码和知识工作方面的改进非常显著,各项参数几乎都在向 Opus 4.8 看齐。
能扛各种活儿的模型。Sonnet 5 在编程、智能体开发、知识处理等方面,每一项都有肉眼可见的提升。智能体编程能力的进步尤其突出。知识工作方面的表现甚至已经超过了 Opus 4.8。
分界线被推远。标准配置保留了 100 万上下文窗口。思考模式从原来的扩展式改成了自适应式,这个变化是为了更好地处理复杂长任务。从测试结果来看,Sonnet 5 和 Sonnet 4.6 之间最大的区别,就是“能做的事和不能做的事”之间的分界线被明显推远了。很多之前 Sonnet 4.6 会直接摆烂的任务,到 Sonnet 5 这里都能顺利完成。
再说价廉
物美是一条线,价廉则是另一条线。说实话,在国内用惯了国产模型的各种低价,要说 Claude 便宜,听起来确实有点扯。但横向对比国外顶级模型,Sonnet 5 这套定价确实很有竞争力。
| 模型 | 输入 | 缓存输入 | 输出 | 备注 |
|---|---|---|---|---|
| Claude Sonnet 5 | $2 | $0.20 | $10 | 2026 年 8 月 31 日前优惠价 |
| Claude Sonnet 5 | $3 | $0.30 | $15 | 2026 年 9 月 1 日起 |
| Claude Opus 4.8 | $5 | $0.50 | $25 | Anthropic 高端旗舰档 |
| GPT-5.5 | $5 | $0.50 | $30 | 短上下文价格 |
| GPT-5.5 长上下文 | $10 | $1.00 | $45 | OpenAI 单独长上下文档 |
| Gemini 3.1 Pro Preview ≤200k | $2 | $0.20 | $12 | 标准档 |
| Gemini 3.1 Pro Preview >200k | $4 | $0.40 | $18 | 超过 200k 输入后涨价 |
对照表格来看:Opus 4.8 的输入是 5 美元、输出是 25 美元。Sonnet 5 是输入 3 美元、输出 15 美元,优惠期间更是降到 2 美元和 10 美元。在海外顶级模型这个档位里,这个价格确实是最低的了。
和国产模型比当然还是贵。但想想接近 Opus 4.8 的能力,价格打到六折——这个性价比就很有意思了。
所有人都能用
全平台同步推送。相比某些平台一会儿上线一会儿封禁一会儿要求认证的操作,Sonnet 5 的发布要干脆得多——手机、电脑、网页端即刻可用。无论你是 Pro 用户还是免费用户,都能立刻用上。
前提是账号还在、能用。
做个小测试
测试项目很多,但考虑到时间与 token 消耗,这次只选了一个比较有代表性的题目:“天文机械表”。
这个题目的难度不小,考验的是模型的综合能力。最近拿它测了一批模型,国产模型几乎全军覆没,没有一个能完全做完所有功能。之前只有 Opus 4.8 接近满分。
完整题目如下:
用单个 HTML 文件实现一只机械腕表风格的天文时钟,纯原生实现,不许使用任何库、框架或 CDN。要求:1. 主表盘读取本地系统时间,秒针平滑扫秒,使用 requestAnimationFrame 驱动,且长时间运行不得累积漂移;切到其他标签页再切回来时,指针必须立即校准到正确时间。2. 包含一个月相小表盘,根据当前日期计算并显示月相连续变化,公式需要自行实现,精度要求误差控制在 1 天内。3. 包含一个可用的计时码表,通过子表盘指针显示,支持开始、暂停、继续、归零与计圈(lap),按钮在任意顺序点击都不能出现状态错误。4. 日期窗显示当前日期,正确处理大小月与闰年。5. 包含昼夜 / 日出日落指示,用户可在三到四个预设城市之间切换,并根据经纬度现场计算当地日出日落时刻。6. 页面需要响应式,并尊重 prefers-reduced-motion:开启时秒针改为跳秒并关闭装饰动画;同时为各表盘补充 ARIA 标注。7. 整体视觉要像一只真实的高级腕表,而不是普通练习作业。只输出最终代码,不要解释。
测试说明:
这是一个面向前沿模型的**长规格前端综合题**。与普通模拟时钟不同,它故意把数学推导、动画工程、状态机正确性、无障碍适配与高级审美堆叠在同一题中,观察模型是否会在实现过程中静默漏需求。题目的核心目标不是“做一个能转的表盘”,而是要求模型在**闭卷推导**与**高约束实现**之间保持稳定。月相算法、日出日落计算、后台切回后的时间校准,以及计时码表的开始 / 暂停 / 继续 / 归零 / 计圈边界行为,都是高频失分点。工程要求:主表盘必须使用 **requestAnimationFrame** 驱动平滑扫秒,不能依赖会累积漂移的定时器;切换后台标签页后,返回前台时指针必须立即与系统时间重新对齐。设计要求:页面必须保持单文件、纯原生、响应式,同时尊重 **prefers-reduced-motion**,为关键表盘与控件补齐 ARIA 标注,并在整体视觉上呈现出真实机械天文腕表的精致感,而不是普通练习作业。
直接在 Claude 桌面版的 Chat 功能里测。思考强度选择了中等(Medium),上面还有 High、Extra、Max 三个更高的档位。
结果出来了:
几乎又是全对。时钟显示正常,地区切换联动正常,秒表的开始、暂停、重置、计圈全部正常。月相也应该是正确的——当前月亮几乎被完全点亮,十五的月亮十六圆,现在刚十七。
Sonnet 5 在这个题目上的表现,和 Opus 4.8 几乎一样。而且这还只是用了中档思考强度,当时测 Opus 4.8 跑的是高档。事实证明,这类复杂任务对 Claude 最新系列来说,中档就够了。除了它家的模型之外,其他模型几乎都无法全部做对这道题。
Sonnet 5 的思维能力这么强,复杂编程都不在话下。日常办公自然是游刃有余。再配合 Cowork 功能,几乎就是一套完整的办公方案。
现在市面上各种 Work 工具层出不穷,但最关键的还是底层模型和 Harness 的调教。从这个角度看,Claude 在这方面确实是鼻祖级的存在。
总结下来:Sonnet 5 已经成为 Claude 系列中最具性价比、最适合日常工作的模型,完全可以扛起编程工作。真正智能的标志是什么?是这道题它没见过,但能做对。目前大部分模型只擅长应试教育,而 Claude 系列确实展现出了一点真智能。
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 迅捷路由器怎么调信号最强,设置时要注意什么?
- 时间:2026-08-27
-
- vivo浏览器怎么卸不掉?原因和解决方法在这里
- 时间:2026-08-27
-
- OPPO R11s黑屏了,怎么强制恢复出厂设置?
- 时间:2026-08-27
-
- 飞利浦显示器包装盒有生产日期和保修期吗?怎么看?
- 时间:2026-08-27
-
- 联想新平板开机必须联网吗?怎么做?
- 时间:2026-08-27
-
- 平板横竖屏切换设置与问题解决
- 时间:2026-08-27
-
- 移动电源容量怎么测?要准备哪些工具?
- 时间:2026-08-27
-
- 荣耀90 Pro防水吗?防水级别多少?怎么用才安全
- 时间:2026-08-27
精选合集
更多大家都在玩
大家都在看
更多-
- 2026年9月17日小鸡庄园答案
- 时间:2026-09-16
-
- 蚂蚁庄园今日答案2026年9月17日
- 时间:2026-09-16
-
- 蚂蚁庄园小课堂今日最新答案2026年9月17日
- 时间:2026-09-16
-
- 蚂蚁庄园小鸡答题今日答案2026年9月17日
- 时间:2026-09-16
-
- 褪黑素主要由人体哪个器官分泌 蚂蚁庄园今日答案9.17
- 时间:2026-09-16
-
- 蚂蚁庄园今天答题答案2026年9月17日
- 时间:2026-09-16
-
- 蚂蚁庄园答题今日答案2026年9月17日
- 时间:2026-09-16
-
- 研学旅游指导师的核心服务对象是 蚂蚁新村今日答案2026.9.16
- 时间:2026-09-16