Anthropic发布Sonnet 5.5:提速30%,主打更省钱的日常办公助手

科技/AI
Anthropic发布中端模型Sonnet 5.5,官方称其速度比上一代快约30%,token消耗明显更低,适合写代码与处理办公文档。在智能体编程基准上它优于Opus 5.5,可并行调度多个子智能体;网络能力被认为与Opus 5相当,首次适用Fable、Opus同级的防护措施。新版Haiku将在数周内发布。
Anthropic发布Sonnet 5.5:提速30%,主打更省钱的日常办公助手

Anthropic发布了中端模型Sonnet 5.5,官方称它比上一代更快,也更便宜,定位是日常办公与写代码的干活助手。上一代Sonnet 5大约三个月前面世,当时打的是低成本智能体部署这张牌。

Sonnet 5.5这次的核心卖点其实只有一个词:速度。官方称它比上一代快约30%,同时token消耗速度明显下降。

经常调用大模型的人会发现,这两项指标直接决定账单。响应快意味着等待缩短,token消耗低意味着同样的活儿花更少的钱。

三个月前的Sonnet 5走的是另一条路,主打把智能体跑得更便宜,让企业在可控成本内完成自动化任务。5.5把重心挪回了效率本身。

在Anthropic的模型梯队里,Sonnet排在Opus之下,算力投入更克制,长处是灵活,能用更低的成本承接那些不需要顶配模型的任务。

官方基准显示,Sonnet 5.5在智能体编程上的表现好于Opus 5.5。原因并不神秘:它能同时拉起多个子智能体,而不至于很快撞上成本上限。

这一点比跑分更贴近真实处境。多数团队不是用不起最强模型,而是承受不了无上限地反复调用它。

Anthropic表示,Sonnet 5.5在网络攻防方面的能力与Opus 5“相当”。正因如此,它成为首个适用Fable、Opus同级网络安全防护措施的Sonnet模型。

把防护门槛按能力划、而不是按产品线划,是这家公司近年的做法。中端模型一旦摸到高端模型的能力线,便宜的入口就有可能变成便宜的缺口。

Anthropic还计划在未来数周内推出Haiku的新版本,这是它体量最小的模型,主打轻量与低价。官方没有给出具体日期。

三档模型各有分工:Opus啃最难的题,Sonnet扛日常和智能体,Haiku处理高频、简单的调用。这种组合在价格战里比单点性能更实用。

过去一年,几家头部实验室的新模型几乎没有断过档。就在上周,OpenAI一次性放出多个模型,其中包括中端和低价定位的Sol、Luna的增强版本。

Meta也宣布了一款新模型,称它将驱动智能眼镜即将上线的一项功能。模型正在走出聊天窗口,钻进眼镜、办公软件和代码编辑器里。

把这几件事摆在一起看,竞争的重心已经不在谁更聪明。各家旗舰的实力差距收窄到普通用户难以分辨之后,决定采购的是每百万token多少钱、一个任务跑多久、失败要重试几次。

行业讨论的焦点也在位移,从“模型会不会写诗”转向“模型能不能替我把活干完”。智能体正是这个转向的产物,也是成本最容易失控的地方。

Anthropic把速度和token消耗放在最前面,盯的是企业账单而不是排行榜。并行子智能体尤其如此——任务被拆开,调用次数成倍增加,谁能压住单次成本,谁就能拿到长期订单。

我还记得自己第一次接付费API做小工具,是给一份报表写自动摘要。额度按量计费,跑一次就盯着后台的数字看,心跟着跳。那会儿不敢让模型自己循环,一段提示词改十几遍,就为了少调用两轮。后来听说有人专职写提示词,靠手感和经验吃饭,我还羡慕过。如今Sonnet 5.5说自己快了30%、token烧得更慢,还能一个模型拉起好几路智能体干活,你说,那些当年靠抠字眼、算额度吃饭的人,接下来还能干什么?

企业下一轮选型要回答的问题,或许不再是哪个模型最强,而是哪个模型能最便宜地把一天的工作跑完。Anthropic把Sonnet 5.5摆在中间那一格,押的就是这种务实。