大模型价格战又有新动静。10月7日,Anthropic发布新一代入门级模型Claude Haiku 5.5,输入价格降到每百万Token 0.10美元,输出价格0.50美元,只有上一代Haiku 4.5的十分之一。更让行业意外的是,价格砍到脚踝的同时,它在多个基准测试中反超了OpenAI的GPT-6 Luna,被开发者戏称为”越级打怪”。
便宜到什么程度
用数字来感受一下这次降价力度:Haiku 4.5的API调用成本是Haiku 5.5的10倍,直接暴降90%;对于超过10万Token的大请求,价格虽有上浮,但整体运行成本仍比前代低约75%。
这个价位与OpenAI上个月发布的GPT-6 Luna基本持平。两家头部公司一前一后降价,背后是同一个逻辑——大模型正在从”奢侈品”变成”基础设施”。企业用户如今更关心的是实实在在的任务成本:花同样的钱,能不能干更多的活。

性能一点没缩水
便宜不代表凑合。在OSWorld 2.1离线子集测试中,Haiku 5.5的电脑操作成功率高达72.4%,而前代Haiku 4.5只有15.7%,差距接近五倍。知识工作测试GDPval-AA v2.1中,Haiku 5.5拿到1620分,是前代的两倍多,也超过了GPT-6 Luna的1437分。
这次Haiku系列还第一次支持可调节的推理强度,同时把上下文窗口拉到了100万Token。以前小模型像快餐,便宜但口味固定;如今用户可以按预算和任务难度自由选择档位——简单的活儿跑高速省钱,复杂的任务切到高强度档认真处理。对开发者来说,这意味着同一个模型既能当”快枪手”,也能在关键时刻”认真起来”,处理长文档、多轮复杂任务也不再捉襟见肘。
全线调价背后的布局
除了Haiku 5.5,Anthropic还把旗舰模型Sonnet 5.5的缓存读取价格下调了一半,据称能让多数智能体任务的整体成本再降约两成。这种”分工协作”的思路很清晰:最强的Opus啃硬骨头,Sonnet处理常规任务,Haiku负责量大、价低、讲究速度的活儿,甚至可以作为子智能体给大模型打下手。

目前Haiku 5.5已同步上架Claude官方平台以及AWS、谷歌云、微软Azure等主流云服务,开发者可以立即上手。Anthropic还给Max和Team订阅用户送出了每月额外的API额度,意图明显——吸引更多开发者把应用真正跑起来。对独立开发者和中小团队来说,低至0.1美元的输入成本,意味着做原型验证和批量任务的试错门槛被大幅压低。
大模型进入”一分钱时代”
从OpenAI到Anthropic,头部厂商接连降价,意味着AI能力的使用门槛正被一次次拉低。对普通企业和开发者来说,这是实实在在的利好:以前因为成本不敢用的场景,现在可以放手去试。下一轮价格战由谁引爆还不确定,但可以确定的是,模型能力会继续卷,价格还会继续降。你现在用API跑过哪些AI应用?有没有被成本劝退过?欢迎在评论区分享你的看法。



