跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

开源模型把价格压了下来,Anthropic 和 OpenAI 现在只能拼成本

Opus 5.5 和 GPT-6 的 Sol、Luna 两个版本,带来的不是能力上的突破,而是更低的价格。逼它们降价的是开放权重模型的竞争,其中就包括以 MIT 许可证发布的 DeepSeek V4.1 Flash。

评论观点刘凯文发布: 2026年9月26日5 分钟阅读资料来源 4
开源模型把价格压了下来,Anthropic 和 OpenAI 现在只能拼成本

论点:MIT 许可证加上推理优化,让价格而不是跑分成了主战场。对用户是好消息,对靠稀缺访问权撑起来的商业模式是坏消息。

Anthropic 和 OpenAI 这次发布新模型,Opus 5.5 以及 GPT-6 的 Sol 和 Luna 两个版本,用的都是同一句话:更快、更便宜。不是“聪明一个数量级”,也不是“更接近 AGI”,就是更便宜。开源模型已经开始划定价格上限。超过这条线,付费访问就得靠功能立足,不能只靠它存在本身。这股竞争越来越难忽视。

最好的证据是 DeepSeek V4.1 Flash。模型 2026 年 9 月 10 日发布,MoE 架构,5520 亿参数,其中 prefill 阶段激活 80 亿,解码阶段激活 160 亿。它原生支持最大 384 token 的图像,键值缓存每 token 占用 890 字节,比上一代 V4 少大约四倍,上下文长度达到一百万 token。这一切都在 MIT 许可证之下。MIT 许可证意味着,任何运营商都能在自己的基础设施上部署这个模型,不用谈判,不用付费,也不用征求许可。

还有一层优化,不改变模型权重就能压低成本。中国团队是石科技展示了 Meta-Infer 引擎。它只做软件优化,不碰硬件,就把 DeepSeek 的推理吞吐量提高了近七倍。据称,一块半 6000D 级加速器能超过一块 B300。这家公司管理着超过 2 万 PFLOPS 的算力和十个计算中心。瓶颈在硬件抽象层:运营商一旦用上通用内核,吞吐量就会掉一个数量级。这是工程投入,回报算的是钱,不是榜单上的分数。

商业规模也印证了这个方向。DeepSeek 的年化收入将突破 10 亿美元,几个月前还不到 5 亿。公司同时进行第二轮 75 亿美元融资,目标估值 5000 亿元人民币,并筹备在上海上市。公司把超过 70% 的算力用于训练新模型,留给现有模型服务的不到 30%。管理层称,提高 API 价格并没有让客户流失。这描绘的是一家不必靠价格取胜的供应商,因为它靠开放权重取胜。

对市场的影响很明确:最贵的模型默认被选中的时代结束了。组织开始把模型当成资产组合来用:日常大批量任务用便宜的开源权重,一小部分关键工作用昂贵的前沿模型。付费供应商只有两种回应方式:再降一次价,或者提供开放权重给不了的功能,比如审计、保证或集成。“更贵是因为更好”不再是理由,这是这个行业多年来最健康的变化。

评论 0

资料来源

4
  1. 01DeepSeek-V4.1-Flash — model cardEN
  2. 02New Anthropic, OpenAI models make same promise: a little more for a lot less moneyEN
  3. 03纯软件优化,DeepSeek 推理吞吐提升近 7 倍ZH
  4. 04曝 DeepSeek 确定 75 亿美元第二轮融资,年化营收突破 10 亿美元ZH

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

刘凯文

刘凯文

评论与观点

刘凯文负责FLASH24评论版块,写作时以公开裁判文书和统计数据为主,对任何未注明来源的论据一律退回。他逐条核对判决书中的案号、法条与时间线,并与原始统计口径交叉比对,发现数字对不上就暂缓发稿。他常与法律学者和一线律师通话,赶上大案宣判或司法解释出台便连夜成稿,同时比对不同法院的同类判决。私下他读思想史,也爱翻判决书,习惯把观念争论还原到具体案情里。他坚持一条:事实不清、出处不明,宁可不写。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。