关于ZAKER Skills GEO服务 合作
钛媒体 24分钟前

硅谷大模型不装了:Claude 卷价格,GPT 学豆包

文 | AIX 财经(AIXcaijing),作者|王璐,编辑|魏佳

过去两年,说起大模型的 " 价格屠夫 ",没人会想到 Claude。

DeepSeek 把百万 tokens 的价格打到几毛钱,逼着国内厂商一轮轮跟降,让 " 大模型用不起 " 成了旧闻,便宜也几乎成了国产模型的集体人设。Claude 则一直站在价格表的另一头,上一代 Haiku 4.5 每百万 tokens 输入 1 美元、输出 5 美元,在不少开发者眼里,属于好用但不便宜的那一档。

10 月 8 日凌晨,位置换过来了。Anthropic 推出了一款主打日常简单任务、走低价路线的轻量级模型 Claude Haiku 5.5,10 万 tokens 以内的请求每百万 tokens 输入 0.10 美元、输出 0.50 美元,单价只有上一代的 1/10,甚至比国内同为小模型的 DeepSeek-V4.1-Flash 还便宜。

几乎同一时间,OpenAI 宣布 GPT-6 全量上线,付费用户可使用 GPT-6 Sol,免费用户也能用上 GPT-6 Luna。有网友调侃,OpenAI 这是要 " 变豆包 " 了。

一家降到地板价,一家直接免费,海外两大巨头同时对价格动了手。它们图什么?0.1 美元的 Claude、免费的 GPT 真的好用吗?当便宜不再是国产大模型的专属,DeepSeek 们手里还剩什么牌?

01.Claude 比 DeepSeek 还便宜,是真的

本轮模型厂商的价格战重心,集中在小模型身上。

旗舰模型通常承担着模型厂商的品牌与技术上限,定价不宜大改。而小模型以有限的推理成本承接高并发、轻量化任务,是争夺开发者的入口,也最适合拿来打价格战。

小模型中,当前最具可比性的三个样本是 DeepSeek-V4.1-Flash、Claude Haiku 5.5 与 GPT-6 Luna。AI 软件工程师覃相告诉「AIX 财经」,三者在设计理念、目标场景与成本结构上高度相似,适合直接对比。

先看定价。

API 方面,Claude Haiku 5.5 与 GPT-6 Luna 同价:输入在 10 万以内,每百万 tokens 输入 0.10 美元、输出 0.50 美元。横向对比 DeepSeek-V4.1-Flash,两家海外厂商在输入与输出端均价格更低,即便以后者五折后的非高峰档计算,结论依然成立。

GPT-6 Luna 在此基础上更进一步,OpenAI 已将其下放至 ChatGPT 免费层,C 端用户可零成本使用。

需要说明的是,Haiku 5.5 的低价有一个前提,每次发送的内容不超过 10 万 tokens。超过这条线,输入输出价格均涨为原来的五倍(0.50/2.50 美元)。DeepSeek-V4.1-Flash 则是一百万 tokens 容量内统一计价,不分长短。

如果同一份材料要反复使用,DeepSeek-V4.1-Flash 的缓存价 0.003 美元也低于 Haiku 5.5 的 0.01 美元。

我们以一份 4 万 tokens 的产品文档为例,置顶后连续追问,每轮新增提问 500tokens、回答 300tokens,均按非高峰价计算。

第一轮,文档要写入缓存。按 Anthropic 的缓存写入价(保留 5 分钟为 0.125 美元 / 百万 tokens),加上回答,Claude 合计约 0.52 美分;DeepSeek 无写入溢价,约 0.63 美分。Claude 花费更低。

从第二轮起,双方的文档部分都进入缓存价,这时 DeepSeek 更便宜。同样一轮,Haiku5.5 约 0.06 美分,DeepSeek 约 0.04 美分,每轮便宜约 0.02 美分。首轮攒下的优势,追问几轮就被追平了。

也就是说,如果是轻度使用,随手问几次,Claude 是便宜的。如果是重度复用,把文档当知识库反复查,DeepSeek 的缓存价会更有优势。

账算清楚了,剩下的问题是:这么便宜,好用吗?

Haiku 5.5 的定位是执行层模型,摘要、压缩、分类、数据库查询,以及作为大模型的子代理执行子任务,均在其设计范围内。按 Anthropic 公布的基准,其各项维度的表现均强于同级别的 GPT-6 Luna。

DeepSeek-V4.1-Flash 的发布基准则集中在另一个方向,DeepSWE v1.1(多文件软件工程)74.2、Terminal-Bench 2.1(终端任务)90.6,官方称在其选定的 Agent 基准上超过了自家上一代旗舰 V4-Pro。

需要注意的是,这些成绩都是厂商自报,DeepSeek 的成绩基于最高推理强度,两家用的也不是同一套测试,三家之间目前没有可以直接横向比较的官方数据。但大模型从业者云中江树做过简单任务的实测,他的感受是,三家小模型水平相似,拉不开差距,能感知的差别在复杂指令上。

综合现有信息,可以下一个结论,三家小模型能力差距不大,均能胜任其目标场景。价格上,在 " 短上下文、API 裸价 " 口径下,Haiku 5.5 与 Luna的价格确实降至DeepSeek 之下,且 Luna 对 C 端免费。

值得一提的是,Anthropic 为这一低价设定的适用范围,恰好是其过往请求分布的主体,按官方口径,约 90% 的 Haiku 请求发送内容不超过 10 万 tokens。也就是说,绝大多数日常用量都落在优惠区里,0.10 美元是 Anthropic 算过账的入口价。至于入口之外从哪里赚钱,就要从它的整张价格表来找答案。

02. 把价格打到 0,图啥?

同一张价格表上,一家公司最便宜和最贵的模型,跨度巨大。OpenAI 的 GPT-6 分三档,最贵的 Astra 输入 10 美元,比 Luna 贵出百倍。Anthropic 也类似,旗舰 Fable 5.1 输入 10 美元,主力档 Opus 5.5 输入 4 美元,均比 Haiku 5.5 高出不少。0.1 美元与 10 美元之间,卖的是不同的东西。

先看 Anthropic。

第一笔是入门价,不求赚钱。覃相的判断是,小模型这一档大概率是微利或保本,但它不是亏钱引流的工具,而是整个商业生态的流量引擎与生态构建抓手。单次调用可以不赚钱,但只要调用量足够大、开发者足够多,用户就留在这个生态里,后面订阅、长文、企业服务这些更贵的收入,才有机会发生。0.1 美元 / 百万 tokens 的输入价格,买的是这张入场券。

第二笔才是收入。入门价让出去的部分,要靠更贵的档位赚回来。Haiku 5.5 超 10 万 tokens 后,输出价涨为原来的五倍;Opus 一档的输入单价是 Haiku 低价档的 40 倍,承接的是长文档、复杂任务这些账单膨胀的场景。

同一天,Anthropic 还宣布 Sonnet5.5 的缓存读取价从 0.20 美元砍至 0.10 美元。这一刀 " 砍下去 ",主要是为了留存,Claude Code 等 Agent 应用中,系统提示、工具定义与历史上下文每轮均需重复读取,缓存读取占输入的大头。对靠它写代码的团队来说,Agent 每跑一轮,这些固定内容都要重新读一遍,一个月下来,缓存读取往往超过新增内容本身。这次砍的正是账单里占比最大的那块。低价吸进来的新客要接住,已在付费的老客也要留住。

Anthropic 敢这么降,是因为它的基本盘不在 token 差价上。它的收入主要是 Claude Code 带动的开发者订阅与企业席位,入门档就算不赚钱,也能用存量账户补回来。

OpenAI 的账,算法不同。

它是真免费,但有条件。ChatGPT 的免费版从来都有,过去跑的是上一代模型,旗舰升级、免费层接旧型号。而这一次,免费用户拿到的是与旗舰同代发布的 Luna,免费与付费的代际差被抹平了。但成本是可控的,免费层有次数限制,跑的又是小模型,成本压在低位,却能拉来用户。同时,Luna API 照收 0.10 美元的输入价,说明免费只限于 C 端,免费用户消耗的算力,OpenAI 可以记在获客成本里。

这套分层定价,已经成了海外大模型公司的共识。Google 动手最早,旗舰 Gemini 3.1 Pro(输入 2 美元、输出 12 美元),小模型是 Flash 家族,免费端为 Flash-Lite。也正因为有这套多层结构托底,各家才不怕 0.1 美元的 API 不赚钱。

国内的情况不太一样。" 国内旗舰虽然也不是完全不收钱,GLM、Kimi 这些也卖会员(每月几十块),但付费渗透率很低,撑不起营收主体。C 端订阅只是零花钱,主要收入是 API 与 ToB。" 覃相表示。

对 Anthropic 和 OpenAI 来说,0.1 美元是门槛,门槛后面还有别的收入。但到了国内厂商这里,能不能也成 " 门槛 ",取决于除了裸价之外,它们手里还有没有别的牌。

03. 海外低价潮下,国内头部模型怎么接?

综合几位从业者的判断,牌有没有,要分国内、海外两个市场来看。

在国内,影响有限。价格只是用户决策的一个因素,海外低价能夺走的,主要是价格敏感型用户。

多位从业者表示,DeepSeek 在国内的地位短时间内不会被动摇,原因有三点。一是中文语境的优势;二是 Claude 在中国境内未提供服务,接入不稳定,实际使用成本远高于官网标价;三是国内企业大量需求是私有化部署与微调定制,这是闭源模型进不来的市场。云中江树的体验是,在国内,综合使用成本更低的仍然是 DeepSeek。

国内其他几家大模型厂商的处境各不相同,短期来看,各有各的壁垒。

千问同走开源路线,是 Hugging Face 上衍生模型数量最多的开源家族之一,微调、部署的工具链最为成熟,开发者生态是它的护城河。豆包背靠字节的流量与广告变现体系,靠 C 端免费做到国内用户规模最大的 AI 原生应用,免费对它来说本就是获客手段。Kimi 押注长上下文,能读长文档的心智在国内仍属独一份,但如何把这份心智变成收入,是它自己的待解题。智谱深耕 ToB,政企客户与私有化交付构成基本盘,海外闭源厂商降价挤不进这个领域。

但在海外,压力是真的。

Haiku 5.5 会分流一部分原本倾向 DeepSeek 的开发者。覃相的判断代表了一部分受访者的看法,它确实带来了压力,但可能没那么大,因为海外同样存在大量私有化部署与定制化需求,开源生态(如 DeepSeek 开放权重)能承接这部分需求,这是闭源 API 给不了的护城河。

那么接下来怎么接?从业者的答案类似:拼价格意义不大,更重要的是补结构。

一方面是补分层,建立旗舰 + 小模型 + 免费端的三层结构,让旗舰敢于定价、小模型走量、免费端做渗透;另一方面是放大开源。闭源低价不可避免,但开源生态、私有化部署、定制化服务,是国内厂商手里唯一不依赖裸价的牌。

但国内厂商真要照搬三层结构,也有几个卡点。

首先是 C 端很难收费。在国内,免费已经是用户的默认预期,谁先收费,谁就可能先流失用户。海外用户为软件订阅付费的习惯更成熟,国内厂商要在先免费铺开之后再收费,难度大得多。

其次是缺少一个能撑起订阅的产品。Anthropic 敢在小模型上让利,背后有 Claude Code 带来的开发者订阅和企业席位兜底。国内各家的编程工具和会员产品还在起步阶段,订阅收入还托不住入门价的补贴。

各家离补齐的距离也不一样。

豆包底子最好,C 端渗透已经基本完成,且已经在推行会员订阅;Kimi 缺在独立的轻量模型,7 月它用开源旗舰 K3 打了一轮技术牌,但当对手都在不断降价,缺乏低价独立小模型的产品线,可能将大批开发者拒之门外。值得注意的是,小模型并不需要独立的研发线,行业通行的做法是旗舰蒸馏,边际成本远低于一次旗舰迭代,Kimi 缺的并非能力,而是优先级排序。

DeepSeek 的 API 这一层最完整,Flash 档、非高峰半价、开源权重都在,缺的是给 C 端讲一个收费的故事;智谱是另一种情况,免费端有清言、订阅有会员和 Coding Plan、B 端有私有化部署,三层都具备,但清言的用户规模与豆包、DeepSeek 存在明显差距,三者之间没有形成有效协同。

海外厂商敢把 0.1 美元当门槛,是因为门槛后面还有订阅、缓存、工具与企业服务这几份收入。如今小模型变成入口,token 差价不再是利润主体,国内厂商真正要补的,是门槛背后那套收钱的结构。

* 题图由 AI 生成。

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容