注意:两款轻量级大模型同价开打,实际调用暗藏五倍差价
注意两款轻量级大模型同价开打实际调用暗藏五倍差价科技圈里两家最针锋相对的死对头很少在任何事情上达成一致。但在2026年10月7日一张刚刚贴出来的价目表让整个行业揉了揉眼睛Anthropic正式发布了旗下最小、最轻的模型Claude Haiku 5.5。翻开官方报价单在短文本输入档位上输入每百万单位0.10美元输出每百万单位0.50美元。这个数字奇妙就奇妙在它和一周多前OpenAI为自己的轻量级模型GPT-6 Luna定下的价格分毫不差精确到了美分。两家顶尖实验室在同一条赛道上贴身肉搏最终落子在完全相同的一串数字上。这绝不是什么心有灵犀的巧合而是两台庞大的商业机器各自算尽了算力、电力和损耗之后齐刷刷撞上了同一个行业的地板价。一、为什么要把价格卡死在分毫不差的0.1美元把视线拉回半年前普通用户打开网页跟大模型聊天对每次问答花了几厘钱根本没有感知。但到了2026年秋天整个产业的玩法彻底变了。模型不再只是陪人打字解闷的聊天框而是被装进企业的自动化软件里像流水线工人一样在后台没日没夜地做分类、读表格、压缩长文档。当一段程序每天要自动调用同一个模型几十万次甚至上千万次的时候小数点后面哪怕只差千分之一美元堆到月底都是一张能让财务总监跳脚的账单。根据OpenAI此前公布的一组内部数据按对外接口价格折算他们自己研发人员每天消耗的用量中位数就已经超过600美元处于高频前列的重度使用者一天甚至能花掉7000美元。这笔钱烧得实在太猛了以至于企业采购时的逻辑非常简单粗暴谁能把后台高频跑腿的成本压下来谁就能把流水线上的订单抢走。在Haiku 5.5发布之前上一代的Haiku 4.5输入每百万单位还要收1.00美元输出要收5.00美元。Anthropic这一刀砍下去极其凶狠把短文本的输入价格直接切掉了九成降到0.10美元整体平均运行成本据官方测算比前代低了大约75%。这一记重拳显然是有备而来。在官方发布稿里Anthropic甚至反常地把对手GPT-6 Luna的各项评测跑分直接并排印在了自己的官方对照表格里。在考察知识工作能力的GDPval评测中Haiku 5.5拿下了1620分压过Luna的1437分在电脑屏幕操作测试里它以72.4%的完成率明显高于Luna的48.9%在多学科深度推理测试中即便不给任何辅助工具它也跑出了45.9%的成绩。Anthropic把价码压到和对方一模一样潜台词却写在脸上拿同样的钱我的干活水平更高。二、纸面同价的背后怎么会出现三倍账单如果你以为既然单价一模一样换用哪个模型月底掏的钱都差不多那可就大错特错了。很多急着尝鲜的技术团队在接上接口跑完测试后突然发现账单的数字完全对不上。独立评测机构Artificial Analysis在跟踪实测后指出了其中的秘密Haiku 5.5实在太爱说话了。在模型的智能指数测试中两家都开到最高档位的推理力度Haiku 5.5的综合智能得分达到了43分稳坐轻量级小模型的第一把交椅比Luna的38分确实高出一截。但为了多拿这5分Haiku 5.5每完成一个标准基准任务平均要呼哧呼哧往外吐出大约162000个输出基本单位而对面的Luna完成同样难度的任务只要大约50000个单位就交卷了。大模型收费的大头全在输出端。每百万单位0.50美元的单价虽然看着完全一致但因为Haiku 5.5生成的废话是对方的三倍算下来每跑完一个完整任务它的真实花销大约是0.21美元而Luna只需要0.07美元。换句话说纸面上的标签价格打成了平手但在真实运转的系统里Anthropic的模型直接跑出了三倍的实际账单。除了爱长篇大论暗处还藏着另一个让账单变厚的细节。Haiku 5.5换上了一套全新的分词编码规则在处理同一段人类文字时它切分出来的计算单位往往比旧规矩多出大约30%。再加上测试发现它在最高推理档位下为了把分数从41分抠到43分消耗的计算单位居然暴涨了1.8倍。这种极端冗长的表达习惯直接把它的资源效率推到了黄金平衡线的下方。追求极致聪明和追求省钱在这张看似便宜的价目表后暗暗打起了一场激烈的拉锯战。三、悬崖式的阶梯计费专坑跑长途的智能体如果说说话啰嗦还只是让成本慢慢变厚那么价目表里写在括号里的一行小字才真正算得上让开发者心惊肉跳的陡坡。Anthropic标出的那个极具诱惑力的0.10美元输入和0.50美元输出前头带着一个死死卡住的门槛单次输入的提示词长度必须在十万个基本单位以内。只要你递给模型的文本稍微长了那么一点点哪怕只多了一个字变成十万零一个单位整个收费标准立刻原地拔高5倍输入跳到0.50美元输出跳到2.50美元。这是一道直上直下的悬崖而不是缓缓抬升的斜坡。拿一次包含十五万单位输入加两千单位输出的请求来算如果按Luna的标准系统依然安稳地留在基础档位上一百万次请求只需要一万六千美元但在Haiku 5.5这里因为迈过了那道门槛整单直接翻到了八万美元结结实实差出了整整5倍。Luna的基础低价一口气撑到了二十七万两千个单位才开始调价而Haiku 5.5在刚刚进入中长篇幅时就已经亮出了加价的招牌。在真实的商业开发中这种设计往往成了最危险的陷阱。现在的软件很少只跟模型做单轮的一问一答而是把小模型当成子代理派它去查资料、调取数据库、读取网页截图。在海外社区的实测反馈中很多开发者发现一个原本看起来极短的小任务随着模型一次次读取本地文件、反复整理上一步的工具结果当后台连续调用到第20次左右时滚雪球般的历史记录就会悄无声息地撞破十万单位的红线。一旦破线后续每一次自动化运转都在以原价5倍的速度疯狂扣款。Anthropic自己对此心知肚明。他们在发布当天给出了一个关键动作把更大一号的主力模型Sonnet 5.5的缓存读取价格直接腰斩从0.20美元砍到0.10美元同时把Haiku 5.5同步铺货到了亚马逊云、谷歌云和微软云的合规机房里。意图其实已经摆在明面上Haiku 5.5被牢牢框定在单次干完就走的短平快跑腿差事里比如切片、提炼摘要、做最初步的筛选而那些需要长线思考、来回折腾十几轮的复杂代理工作用户还是得老老实实买票退回给底盘更稳的Sonnet。在整个大模型行业里大家曾经习惯了看各大厂商比拼谁的参数更大、谁能写出更惊艳的代码。但Haiku 5.5与GPT-6 Luna的这次撞车释放出了一个完全不同的信号当顶尖实验室把价格精确咬死在同一个分币上技术竞赛的重心就已经从象牙塔里的跑分转到了现实世界里的算盘。谁能在极其微薄的利润空间里把单位成本抠到极致谁能在企业软件每天数以亿次的默默调用中不被替换谁才算真正立住了脚跟。这场看似整齐划一的0.1美元定价不是两家公司的握手言和而是一场把算力拧干到最后一滴水后更加残酷的贴身肉搏的起点。