今日凌晨,Anthropic正式发布Claude 5.5系列第二款模型Claude Sonnet 5.5,主打”快速、高性价比”。官方数据显示,相比上一代Sonnet 5,新模型生成速度提升超过30%,单任务成本最高降低30%,并在多项基准测试中逼近甚至反超旗舰Opus 5.5,被业界视为中端大模型的一次越级表现。
一半价格,逼近旗舰性能
定价方面,Sonnet 5.5与上代保持一致:每百万输入token 2美元、输出token 10美元、缓存读取0.2美元,约为Opus 5.5价格的一半。但在Artificial Analysis的AI分析指数上,它拿下56分,仅次于Opus 5.5的58分,Claude系列包揽榜单前三席。Anthropic还晒出成绩单:这是首个仅通过屏幕截图就能通关《口袋妖怪红》游戏的Sonnet模型,官方演示中复原一个魔方仅耗时10秒、花费0.11美元。

编程是最大亮点
在智能体编程基准FrontierCode的高投入档位下,Sonnet 5.5得分比同档位Sonnet 5高出约10分,单任务成本却仅为后者的约1/15;在基于Cursor真实编程会话的CursorBench测试中,它的最高分与Opus 5.5差距仅约2分。在主动编程领域,Sonnet 5.5甚至反超旗舰Opus 5.5。覆盖44个职业、9大行业的GDPval-AA知识工作基准上,它的得分与Opus 5.5几乎持平,比Sonnet 5高出约400分;长周期知识工作场景中,性能明显优于Sonnet 5和GPT-6 Sol。
安全机制首次下沉
网络安全能力已与Opus 5相当,Sonnet 5.5也因此成为首款配备网络安全防护与回退机制的Sonnet模型:高风险网络任务会自动降级交由Sonnet 5处理,常规软件开发中的漏洞查找与修复不受影响。它还是Sonnet系列首款内置安全分类器、可抵御模型蒸馏提取攻击的型号。官方在约1850个场景下开展自动化行为审计,对齐性、抗滥用能力与诚实度等大部分指标均较上代提升或持平。
开发者实测:效果惊艳,账单也不便宜
早期开发者实测中,Sonnet 5.5生成的落叶动画、城市模拟器效果明显优于Sonnet 5,但成本同样水涨船高:有开发者用它制作一款射击游戏花费177美元、耗时49分钟;生成城市模拟器消耗38万输出token、花费9.23美元。也有测试者反馈,新模型能够将工具调用合并在一起,从而减少操作步骤、压低开销。

如何控制成本
Anthropic建议通过调节投入档位平衡成本与质量:低档响应更快、消耗更少,适合常规事务处理;高档则让模型进行更长时间的推理、对输出做更全面的自检核验。Claude Code与Anthropic官方应用默认使用中等档位,开发者平台则默认高档,开发者可按任务复杂度灵活切换。
目前Sonnet 5.5已全平台上线,包括AWS、谷歌云以及微软Azure,开发者可在Claude平台通过模型标识符claude-sonnet-5-5接入使用。Anthropic还透露,专为高并发和成本敏感应用设计的Claude Haiku 5.5将在未来几周发布。对企业和开发者而言,中端模型与旗舰模型的差距快速收窄,意味着”主力模型扛日常、旗舰模型攻难题”的分层调用架构,正在成为更理性的AI落地选择。






