9月29日,Anthropic甩出中端新模型Claude Sonnet 5.5。定位不高,成绩却吓人:多项基准测试逼近甚至反超自家旗舰Opus 5.5。编程能力尤其猛,代码生成与理解两项直接压过更贵的Opus,成为Anthropic目前代码能力最强的模型。知识问答、跨领域推理也没落下。阿莫迪嘴上喊着减速,脚底下的油门倒是踩得挺狠。
价格更狠。Sonnet 5.5的API价格直接腰斩,半价买到旗舰级体验。开发者省下的是真金白银,同行感受到的是压力。中端打旗舰,这一刀落得够准。
但半价只是表象。真正的变化藏在Agent Runtime里:Tool Call少三成,Shell Run接近减半,任务迭代次数降到3.6次。任务几步就能做完,不靠多问多试硬堆迭代。效率提升的核心在这儿,不在跑分。
这组数字意味着更短的调用链路、更低的延迟、更少的token消耗。Agent跑起来更快,也更便宜。Sonnet 5.5把Agent的工作方式也改了一遍,降价只是其中一项。加上智能水平还压过GPT-6 Astra,这一手给得很满。
说好的减速没来,又是一轮加速。中端反超旗舰的剧情,今年恐怕还会接着上演。