开源模型把价格压了下来,Anthropic 和 OpenAI 现在只能拼成本
Opus 5.5 和 GPT-6 的 Sol、Luna 两个版本,带来的不是能力上的突破,而是更低的价格。逼它们降价的是开放权重模型的竞争,其中就包括以 MIT 许可证发布的 DeepSeek V4.1 Flash。

论点:MIT 许可证加上推理优化,让价格而不是跑分成了主战场。对用户是好消息,对靠稀缺访问权撑起来的商业模式是坏消息。
Anthropic 和 OpenAI 这次发布新模型,Opus 5.5 以及 GPT-6 的 Sol 和 Luna 两个版本,用的都是同一句话:更快、更便宜。不是“聪明一个数量级”,也不是“更接近 AGI”,就是更便宜。开源模型已经开始划定价格上限。超过这条线,付费访问就得靠功能立足,不能只靠它存在本身。这股竞争越来越难忽视。
最好的证据是 DeepSeek V4.1 Flash。模型 2026 年 9 月 10 日发布,MoE 架构,5520 亿参数,其中 prefill 阶段激活 80 亿,解码阶段激活 160 亿。它原生支持最大 384 token 的图像,键值缓存每 token 占用 890 字节,比上一代 V4 少大约四倍,上下文长度达到一百万 token。这一切都在 MIT 许可证之下。MIT 许可证意味着,任何运营商都能在自己的基础设施上部署这个模型,不用谈判,不用付费,也不用征求许可。
还有一层优化,不改变模型权重就能压低成本。中国团队是石科技展示了 Meta-Infer 引擎。它只做软件优化,不碰硬件,就把 DeepSeek 的推理吞吐量提高了近七倍。据称,一块半 6000D 级加速器能超过一块 B300。这家公司管理着超过 2 万 PFLOPS 的算力和十个计算中心。瓶颈在硬件抽象层:运营商一旦用上通用内核,吞吐量就会掉一个数量级。这是工程投入,回报算的是钱,不是榜单上的分数。
商业规模也印证了这个方向。DeepSeek 的年化收入将突破 10 亿美元,几个月前还不到 5 亿。公司同时进行第二轮 75 亿美元融资,目标估值 5000 亿元人民币,并筹备在上海上市。公司把超过 70% 的算力用于训练新模型,留给现有模型服务的不到 30%。管理层称,提高 API 价格并没有让客户流失。这描绘的是一家不必靠价格取胜的供应商,因为它靠开放权重取胜。
对市场的影响很明确:最贵的模型默认被选中的时代结束了。组织开始把模型当成资产组合来用:日常大批量任务用便宜的开源权重,一小部分关键工作用昂贵的前沿模型。付费供应商只有两种回应方式:再降一次价,或者提供开放权重给不了的功能,比如审计、保证或集成。“更贵是因为更好”不再是理由,这是这个行业多年来最健康的变化。
资料来源
4- 01DeepSeek-V4.1-Flash — model cardEN
- 02New Anthropic, OpenAI models make same promise: a little more for a lot less moneyEN
- 03纯软件优化,DeepSeek 推理吞吐提升近 7 倍ZH
- 04曝 DeepSeek 确定 75 亿美元第二轮融资,年化营收突破 10 亿美元ZH
本文所有数字与引语均来自下列来源,未添加来源之外的内容。
本内容由编辑部在人工智能辅助下制作完成。
评论
0- 还没有评论——来说两句吧。