Claude Sonnet 5发布:史上最智能Sonnet,免费用户默认可用,Agent编码逼近Opus

· 科技资讯

🔥 关注 → 星标,不错过 AI 前沿

Claude Sonnet 5 来了。它不是在追赶——它在用便宜一半的价格,做接近 Anthropic 最强模型的事。而且,它现在是所有免费用户的默认模型。这意味着地球上任何一个人,打开 Claude 就能用到三个月前还需要每月 $20 订阅才能触及的智能水平。

cover-1-sonnet5.png

🔥 最智能的 Sonnet,免费用户也能用

6月30日发布,7月1日起成为所有 Claude Free 和 Pro 用户的默认模型。“史上最 agentic 的 Sonnet”——这是 Anthropic 自己给的定位。

“它能制定计划、使用浏览器和终端等工具,并以几个月前还需要更大更贵模型才能达到的水平自主运行。”

价格是最大的杀手锏:API 输入 $2/百万 token,输出 $10/百万 token(优惠价至8月31日,之后涨至 $3/$15)。对比 Opus 4.8 动辄 $15/$75 的定价,Sonnet 5 用不到 1/7 的成本实现了接近旗舰的性能。TechCrunch 的评价一针见血——”一种更便宜的运行 Agent 的方式”。

🔥 跑分说话:逼近 Opus,碾压旧版

数字不会撒谎。Agentic 编码(SWE-bench Pro 等效):63.2%(Sonnet 4.6 仅 58.1%,Opus 4.8 为 69.2%,差距仅 6 个百分点)。桌面自动化(OSWorld-Verified):81.2%,甚至高于人类专家基准 72.4%——AI 在操作电脑这件事上已经比大多数人类更靠谱。终端工程(Terminal-Bench 2.1):80.4%,比旧版暴增 20.7 个百分点,这是 Agent 开发者感受最强烈的提升。

在 GDPval-AA v2 上,Sonnet 5 首次在某个基准上超越了旗舰 Opus 4.8——这是 Anthropic 历史上中端模型第一次跨过旗舰线。

🔥 迁移不是无痛的:三大破坏性变更

升级 Sonnet 5 不是换个 model ID 就行了。Anthropic 明确列出了三个 breaking change:1)自适应思考始终开启,effort 默认 “high”,response 格式、token 消耗和延迟与旧版完全不同。2)temperature 和 top_p 参数被彻底移除——传入这些参数会直接报错,静默破坏依赖温度控制的 Agent 循环。3)新分词器对同样文本产出多 1.0–1.35 倍 token——基于 token 的预算体系必须重新校准。

Cursor 联合创始人 Sualeh Asif 的反馈是积极的:使用 Sonnet 5 的 Agent 能”保持计划、遵循约定、高效交付清晰的多步修改”。Zapier 高级工程师 Daniel Shepard 的 Salesforce 自动化以前会中途卡住,现在端到端完成,无一遗漏。

🔥 竞争格局:这不是价格战

当 OpenAI 在优化推理成本、Google 在推 Gemini Spark 桌面自动化时,Anthropic 选择了一条不同的路径——把最先进的 Agent 能力下放到中端价位,并让免费用户直接触碰。这不是价格战。这是一场能力民主化的闪电战。免费用户今天拿到的模型,编码能力已经超过了三个月前的付费旗舰版本。

Anthropic 还同步发布了 Claude Loops 指南——定义了四种 Agent 循环模式(基于回合、基于目标、基于时间、主动式),推荐使用 SKILL.md 文件做自我验证。这意味着 Sonnet 5 的 Agent 能力有完整的工程方法论支撑,不只是跑分好看。

👇 关注我,不错过每一次 AI 模型的代际跃迁


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

滚动至顶部
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅