Sonnet 5发布:半价实现旗舰级智能,AI助手竞争进入新阶段

2026年7月1日

24

378

Sonnet 5发布:半价实现旗舰级智能,AI助手竞争进入新阶段

沉寂近半年,Anthropic终于推出Sonnet 5。作为其主力产品线的最新版本,Sonnet 5被定位为“迄今为止最具Agent能力的Sonnet”。这一版本的最大亮点在于:它以不到旗舰模型Opus 4.8一半的价格,实现了其约80%-90%的性能表现。对于广大开发者和普通用户而言,这无疑是一个值得关注的性价比选择。

概述

在具体性能表现上,Sonnet 5展现了显著的提升。在Agent编程方面,其得分为63.2%,较上一代Sonnet 4.6的58.1%提升了5.1个百分点,与Opus 4.8的69.2%仅相差6%。更值得关注的是,在知识类任务中,Sonnet 5已经实现了对Opus 4.8的反超。Anthropic官方表示,Sonnet 5现已具备自主制定计划、调用浏览器和终端等工具、长时间独立运行的能力——这些功能在数月前还仅存在于更大、更昂贵的模型中。

价格与成本的平衡艺术

Sonnet 5真正打动用户的,或许在于其出色的性价比。在Agent搜索和计算机操作任务中,即便不调高模型的“认真”程度,Sonnet 5也能完成比Opus 4.8更多的任务。当切换至最高认真档位时,Sonnet 5在部分任务上已能追平Opus 4.8,而成本却大幅降低。实测数据显示,完成相同任务,Sonnet 5的花费不足Opus 4.8的一半。早期用户反馈,以往Sonnet无法完成的复杂任务,现在Sonnet 5可以轻松胜任,甚至会主动检查自身输出质量。例如,连续执行“更新客户账户等级并发送公告邮件”这样的多步骤操作,Sonnet 5已能一气呵成。

Sonnet 5用不到Opus 4.8一半的价格,做到了它80%-90%的水平。

“行业观察”
🦞

JimoClaw — 桌面 AI Agent 工作台

让 AI 处理本地资料、操控浏览器,最终交付可直接使用的文档、表格与 PPT,而不只是一段回答。

下载桌面版

安全特性的权衡与取舍

在安全方面,Sonnet 5的幻觉率和迎合倾向均低于Sonnet 4.6,在Agent场景下抵御提示注入攻击的能力也有所增强。模型默认开启实时安全防护,能够在运行过程中检测并阻断危险操作。Anthropic联合Mozilla的测试显示,Sonnet 5完整漏洞利用成功率为0%,表明其虽具备提升的代码能力,但仍不具备自主发起网络攻击的水平——这是有意为之的设计。值得注意的是,Sonnet 5在某些不良行为上比旗舰模型更容易“失态”,Anthropic将其归因于更强的模型需要更好的行为对齐,但同时也承认Sonnet 5尚未达到旗舰级模型的克制水平。

分词器更换带来的隐性成本变化

一个值得关注的细节是,Sonnet 5更换了新的分词器。同样的文本输入,消耗的Token数量可能比原来多1.0到1.35倍。这意味着用户的实际成本支出会有所上升。为缓解这一变化带来的冲击,Anthropic在8月31日前提供了临时优惠政策:每百万输入Token 2美元、输出Token 10美元。促销期结束后,价格可能高于此前水平。用户在评估长期使用成本时,需要将这一因素纳入考量。

🛡️

积墨 AI 安全隐患巡检系统

任务一键下达 · 隐患 AI 识别 · 整改全程留痕 · 报告一键生成。让安全巡检真正看得见、管得住、能闭环。

了解方案

如有侵权,请联系删除。

Related Articles

联系我们 试用咨询
小墨 AI