注意:两款轻量级大模型同价开打,实际调用暗藏五倍差价
注意两款轻量级大模型同价开打实际调用暗藏五倍差价科技圈里两家最针锋相对的死对头很少在任何事情上达成一致。但在2026年10月7日一张刚刚贴出来的价目表让整个行业揉了揉眼睛Anthropic正式发布了旗下最小、最轻的模型Claude Haiku 5.5。翻开官方报价单在短文本输入档位上输入每百万单位0.10美元输出每百万单位0.50美元。这个数字奇妙就奇妙在它和一周多前OpenAI为自己的轻量级模型GPT-6 Luna定下的价格分毫不差精确到了美分。两家顶尖实验室在同一条赛道上贴身肉搏最终落子在完全相同的一串数字上。这绝不是什么心有灵犀的巧合而是两台庞大的商业机器各自算尽了算力、电力和损耗之后齐刷刷撞上了同一个行业的地板价。一、为什么要把价格卡死在分毫不差的0.1美元把视线拉回半年前普通用户打开网页跟大模型聊天对每次问答花了几厘钱根本没有感知。但到了2026年秋天整个产业的玩法彻底变了。模型不再只是陪人打字解闷的聊天框而是被装进企业的自动化软件里像流水线工人一样在后台没日没夜地做分类、读表格、压缩长文档。当一段程序每天要自动调用同一个模型几十万次甚至上千万次的时候小数点后面哪怕只差千分之一美元堆到月底都是一张能让财务总监跳脚的账单。根据OpenAI此前公布的一组内部数据按对外接口价格折算他们自己研发人员每天消耗的用量中位数就已经超过600美元处于高频前列的重度使用者一天甚至能花掉7000美元。这笔钱烧得实在太猛了以至于企业采购时的逻辑非常简单粗暴谁能把后台高频跑腿的成本压下来谁就能把流水线上的订单抢走。在Haiku 5.5发布之前上一代的Haiku 4.5输入每百万单位还要收1.00美元输出要收5.00美元。Anthropic这一刀砍下去极其凶狠把短文本的输入价格直接切掉了九成降到0.10美元整体平均运行成本据官方测算比前代低了大约75%。这一记重拳显然是有备而来。在官方发布稿里Anthropic甚至反常地把对手GPT-6 Luna的各项评测跑分直接并排印在了自己的官方对照表格里。在考察知识工作能力的GDPval评测中Haiku 5.5拿下了1620分压过Luna的1437分在电脑屏幕操作测试里它以72.4%的完成率明显高于Luna的48.9%在多学科深度推理测试中即便不给任何辅助工具它也跑出了45.9%的成绩。Anthropic把价码压到和对方一模一样潜台词却写在脸上拿同样的钱我的干活水平更高。二、纸面同价的背后怎么会出现三倍账单如果你以为既然单价一模一样换用哪个模型月底掏的钱都差不多那可就大错特错了。很多急着尝鲜的技术团队在接上接口跑完测试后突然发现账单的数字完全对不上。独立评测机构Artificial Analysis在跟踪实测后指出了其中的秘密Haiku 5.5实在太爱说话了。在模型的智能指数测试中两家都开到最高档位的推理力度Haiku 5.5的综合智能得分达到了43分稳坐轻量级小模型的第一把交椅比Luna的38分确实高出一截。但为了多拿这5分Haiku 5.5每完成一个标准基准任务平均要呼哧呼哧往外吐出大约162000个输出基本单位而对面的Luna完成同样难度的任务只要大约50000个单位就交卷了。大模型收费的大头全在输出端。每百万单位0.50美元的单价虽然看着完全一致但因为Haiku 5.5生成的废话是对方的三倍算下来每跑完一个完整任务它的真实花销大约是0.21美元而Luna只需要0.07美元。换句话说纸面上的标签价格打成了平手但在真实运转的系统里Anthropic的模型直接跑出了三倍的实际账单。除了爱长篇大论暗处还藏着另一个让账单变厚的细节。Haiku 5.5换上了一套全新的分词编码规则在处理同一段人类文字时它切分出来的计算单位往往比旧规矩多出大约30%。再加上测试发现它在最高推理档位下为了把分数从41分抠到43分消耗的计算单位居然暴涨了1.8倍。这种极端冗长的表达习惯直接把它的资源效率推到了黄金平衡线的下方。追求极致聪明和追求省钱在这张看似便宜的价目表后暗暗打起了一场激烈的拉锯战。三、悬崖式的阶梯计费专坑跑长途的智能体如果说说话啰嗦还只是让成本慢慢变厚那么价目表里写在括号里的一行小字才真正算得上让开发者心惊肉跳的陡坡。Anthropic标出的那个极具诱惑力的0.10美元输入和0.50美元输出前头带着一个死死卡住的门槛单次输入的提示词长度必须在十万个基本单位以内。只要你递给模型的文本稍微长了那么一点点哪怕只多了一个字变成十万零一个单位整个收费标准立刻原地拔高5倍输入跳到0.50美元输出跳到2.50美元。这是一道直上直下的悬崖而不是缓缓抬升的斜坡。拿一次包含十五万单位输入加两千单位输出的请求来算如果按Luna的标准系统依然安稳地留在基础档位上一百万次请求只需要一万六千美元但在Haiku 5.5这里因为迈过了那道门槛整单直接翻到了八万美元结结实实差出了整整5倍。Luna的基础低价一口气撑到了二十七万两千个单位才开始调价而Haiku 5.5在刚刚进入中长篇幅时就已经亮出了加价的招牌。在真实的商业开发中这种设计往往成了最危险的陷阱。现在的软件很少只跟模型做单轮的一问一答而是把小模型当成子代理派它去查资料、调取数据库、读取网页截图。在海外社区的实测反馈中很多开发者发现一个原本看起来极短的小任务随着模型一次次读取本地文件、反复整理上一步的工具结果当后台连续调用到第20次左右时滚雪球般的历史记录就会悄无声息地撞破十万单位的红线。一旦破线后续每一次自动化运转都在以原价5倍的速度疯狂扣款。Anthropic自己对此心知肚明。他们在发布当天给出了一个关键动作把更大一号的主力模型Sonnet 5.5的缓存读取价格直接腰斩从0.20美元砍到0.10美元同时把Haiku 5.5同步铺货到了亚马逊云、谷歌云和微软云的合规机房里。意图其实已经摆在明面上Haiku 5.5被牢牢框定在单次干完就走的短平快跑腿差事里比如切片、提炼摘要、做最初步的筛选而那些需要长线思考、来回折腾十几轮的复杂代理工作用户还是得老老实实买票退回给底盘更稳的Sonnet。在整个大模型行业里大家曾经习惯了看各大厂商比拼谁的参数更大、谁能写出更惊艳的代码。但Haiku 5.5与GPT-6 Luna的这次撞车释放出了一个完全不同的信号当顶尖实验室把价格精确咬死在同一个分币上技术竞赛的重心就已经从象牙塔里的跑分转到了现实世界里的算盘。谁能在极其微薄的利润空间里把单位成本抠到极致谁能在企业软件每天数以亿次的默默调用中不被替换谁才算真正立住了脚跟。这场看似整齐划一的0.1美元定价不是两家公司的握手言和而是一场把算力拧干到最后一滴水后更加残酷的贴身肉搏的起点。

相关新闻

同一套顶尖模型做攻防测试,普通人全被拦下而特定机构却能畅通无阻

同一套顶尖模型做攻防测试,普通人全被拦下而特定机构却能畅通无阻

同一套顶尖模型做攻防测试,普通人全被拦下而特定机构却能畅通无阻 平时跟朋友聊起最新的人工智能,大家关心的往往是它能不能写周报、能不能画图、做出来的动画逼不逼真。但如果你把同一套顶尖模型拉到网络安全的世界里,事情会瞬间变得极其诡异…

2026/10/10 20:57:38 阅读更多 →
合约内代码复用:GenLayer Project Boilerplate中内部方法组织的3个原则

合约内代码复用:GenLayer Project Boilerplate中内部方法组织的3个原则

合约内代码复用:GenLayer Project Boilerplate中内部方法组织的3个原则 【免费下载链接】genlayer-project-boilerplate 项目地址: https://gitcode.com/GitHub_Trending/gen/genlayer-project-boilerplate 如果你正在学习 GenLayer 智能合约开发&#xff0…

2026/10/10 20:57:30 阅读更多 →
【保姆级教程】10行代码搞定!零基础用Google ADK创建带Web界面的AI Agent!

【保姆级教程】10行代码搞定!零基础用Google ADK创建带Web界面的AI Agent!

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 20:51:08 阅读更多 →

最新新闻

Rust Web框架实测:Salvo与axum对比,24小时快速开发CRUD接口

Rust Web框架实测:Salvo与axum对比,24小时快速开发CRUD接口

如果你最近在 Rust 里挑 Web 框架,应该会经历一段很具体的纠结期:axum 文档最全、生态最大,actix-web 性能名声在外,Rocket 的宏写法接近魔法。我原来一直偏向 axum,直到上周接了个小需求,要三天内把一个内…

2026/10/10 20:57:40 阅读更多 →
Secure Boot状态不一致:固件启用但Linux显示禁用的原理与诊断

Secure Boot状态不一致:固件启用但Linux显示禁用的原理与诊断

1. 现象本身不是Bug,而是两套独立状态系统的自然结果你刚进BIOS/UEFI设置界面,一眼就看到Secure Boot选项旁边清清楚楚标着「已启用」——绿色对勾、高亮文字、甚至还有个锁形图标。你松了口气,重启进Linux系统,随手敲下mokutil -…

2026/10/10 20:57:40 阅读更多 →
学习型索引:用轻量神经网络替代B-Tree的原理与实践

学习型索引:用轻量神经网络替代B-Tree的原理与实践

1. 项目概述:当索引本身开始“学习”数据分布你有没有遇到过这样的场景:数据库查一个范围查询,明明只想要100条记录,B-Tree却要从根节点一路遍历到叶子页,反复做磁盘随机IO,最后发现90%的页读进来只是用来跳…

2026/10/10 20:57:40 阅读更多 →
Python实现配电网经济性与可靠性双目标协同优化规划

Python实现配电网经济性与可靠性双目标协同优化规划

搞配电网规划的朋友,应该都体会过经济性和可靠性"打架"的感觉。传统工作流里,这两个维度往往是串行处理:先按年费用最小去定线路和容量,再用N-1准则或可靠性导则去校核,不够就加设备、加大截面,来…

2026/10/10 20:57:40 阅读更多 →
机器学习课程设计:Python垃圾分类系统源码解析与实战避坑指南

机器学习课程设计:Python垃圾分类系统源码解析与实战避坑指南

简介:这份Python垃圾分类系统课程设计源码包,面向机器学习课程设计学生及垃圾分类入门开发者,提供一套从模型训练到界面演示的完整个人大作业方案。项目基于TensorFlow 2.3,核心包括MobileNet模型训练脚本、窗口端垃圾分类测试程序…

2026/10/10 20:57:40 阅读更多 →
共聚焦显微镜与激光共聚焦有什么区别?选型与实操全解析

共聚焦显微镜与激光共聚焦有什么区别?选型与实操全解析

直接抛一个问题:你实验室里那台写着“共聚焦显微镜”的仪器,和你师弟论文里写的“激光共聚焦显微镜”,到底是不是同一个东西?如果只是名称长了三个字,为什么采购单上价格能差出一倍?很多刚接触显微成像的同…

2026/10/10 20:56:40 阅读更多 →

日新闻

卫星轨道分类全解析:从LEO到GEO的选型逻辑与工程实践

卫星轨道分类全解析:从LEO到GEO的选型逻辑与工程实践

1. 从“卫星轨道分类”这个标题说起:为什么值得花时间搞懂第一次接触“卫星轨道分类”这个概念,很多人会觉得它离自己很远——不就是天上的星星怎么转吗?但如果你正在做航天任务规划、遥感数据接收、星座设计,甚至只是准备一场航天…

2026/10/10 0:00:39 阅读更多 →
Spring AOP 核心原理与实战:从概念到日志切面落地

Spring AOP 核心原理与实战:从概念到日志切面落地

1. 从一个真实痛点说起:为什么你的代码里到处都是重复逻辑刚入行那会儿,我写过一个用户管理模块,注册、登录、改密码、注销四个接口。每个接口里都塞了几乎一样的日志打印、参数校验、事务开启和提交。当时觉得没什么,能跑就行。直…

2026/10/10 0:00:40 阅读更多 →
Python招聘数据采集与分析可视化:从采集清洗到薪资技能城市可视化全链路

Python招聘数据采集与分析可视化:从采集清洗到薪资技能城市可视化全链路

简介:这是一套面向计算机相关专业学生与项目实战学习者的Python数据采集与分析可视化完整项目,以Boss直聘岗位数据为对象,适合用作毕业设计、课程设计或期末大作业。资源包共38个文件,约246KB,以13个py源码文件为核心&…

2026/10/10 0:00:40 阅读更多 →

周新闻

KT148A语音芯片外挂8002D功放的工程实践指南

KT148A语音芯片外挂8002D功放的工程实践指南

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 11:14:25 阅读更多 →
LLC谐振变换器增益公式推导:从FHA等效到完整归一化表达式

LLC谐振变换器增益公式推导:从FHA等效到完整归一化表达式

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 1:36:08 阅读更多 →
ARM架构深度解析:从RISC设计理念到交叉编译实战

ARM架构深度解析:从RISC设计理念到交叉编译实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 11:14:58 阅读更多 →

月新闻

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 5:23:50 阅读更多 →
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/9 21:32:20 阅读更多 →
黑夜航拍船只数据集训练YOLOV5模型全流程解析

黑夜航拍船只数据集训练YOLOV5模型全流程解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 10:38:42 阅读更多 →