Claude Sonnet 5发布:Anthropic最强Agent模型登场,AI编程门槛再降

· 科技资讯

2026年7月1日,Anthropic正式将Claude Sonnet 5设为所有Free和Pro用户的默认模型。这款被官方称为”有史以来最强的Agent Sonnet”的新模型,以接近Opus 4.8的性能和远低于Sonnet 4.6的价格,搅动了整个AI应用市场。

Claude Sonnet 5发布:Anthropic最强Agent模型登场,AI编程门槛再降封面

从基准测试看,Sonnet 5在终端Agent任务上比Sonnet 4.6提升了20.7个百分点——这是开发者最关心的Agent能力指标。OSWorld桌面自动化测试得分81.2%,甚至超过了人类专家的72.4%。BrowseComp 25网页搜索Agent测试达到84.7%。在SWE-bench等效编程测试中,Sonnet 5达到了63.2%,已经接近Opus 4.8的69.2%。

但对开发者来说,Sonnet 5带来了三个重大变化。首先,自适应思考模式默认开启——模型可以自己决定是否需要深度推理。这意味着API响应格式、token消耗和延迟都会发生变化,开发者需要重新评估集成逻辑。其次,temperature和top_p采样参数被移除,这意味着生成结果的随机性控制不再可调。第三,新tokenizer产生的token比旧版多1.0到1.35倍,按token计费的预算需要重新计算。

定价方面同样体现了Anthropic”降本增效”的策略。推广期API价格为每百万token输入2美元、输出10美元,将持续到8月31日。标准价格从9月1日起生效,输入3美元、输出15美元——与Sonnet 4.6名义价格相同,但实际效率更高。

Cursor联合创始人Sualeh Asif在社交平台上分享了实际体验:”Agent能按计划执行,遵循编码规范,以合理的成本交付干净的多步代码变更。”Zapier平台反馈称,复杂的Salesforce自动化任务现在能端到端完成,不再中途卡住。这些来自生产环境的正面反馈,进一步夯实了Sonnet 5作为企业级Agent工具的地位。

从行业格局看,Sonnet 5的发布传递了一个明确信号:AI模型的竞争正从”谁的参数更大”转向”谁能做好Agent”。2026年无疑是AI Agent的爆发年,而Sonnet 5为这场变革提供了一个成本可控、能力可靠的基础设施级选项。对于正在构建AI Agent应用的团队来说,现在正是入场的最佳时机。


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

滚动至顶部
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅