跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

Opus 5.5 与 GPT-6 Sol:模型之战打到价目表上

Anthropic 把 Opus 5.5 降价 20%,缓存读取降价 60%。OpenAI 用 Sol 和 Luna 回应。DeepSeek 在中国下调 flash 价格。

商业分析吴静怡发布: 2026年9月25日5 分钟阅读资料来源 3
Opus 5.5 与 GPT-6 Sol:模型之战打到价目表上

Anthropic 和 OpenAI 的新模型在能力上没带来突破,带来的是降价。价格现在是竞争的主战场。Opus 5.5 是 Anthropic 主力模型的最新版本,用于编程和复杂的知识工作。每百万输入 token 收费 4 美元,每百万输出 token 收费 20 美元,比 Opus 5 便宜 20%。缓存读取在智能体任务和编程里占成本的大头,价格降到每百万 token 0.20 美元,降幅 60%。模型的回答速度也快了 30% 以上。

Anthropic 称,在典型任务和默认设置下,节省可达 40%,因为完成同一个任务,模型消耗的 token 更少。网络安全和生物学等“高风险”领域是例外:这些领域的请求可能被自动转给较旧的模型。

OpenAI 用 GPT-6 Sol 和 Luna 回应,两者是 GPT-6 系列里更轻的版本。Sol 面向日常任务,质量尚可,成本更低。Luna 更小、更便宜。这些公司不只彼此竞争,还要和开源模型竞争。越来越多的企业用模型路由,把昂贵的前沿模型用得更少。

在中国,同样的机制体现在 DeepSeek 的价目表上。从 9 月 10 日北京时间 12 点起,flash 模型按新价格计费:非高峰时段命中缓存的输入从每百万 token 0.05 元降到 0.02 元,降幅 60%;未命中的输入从 1.5 元降到 1 元,降三分之一;输出从 4.5 元降到 4 元,约降 11%。高峰时段的价格是非高峰时段的两倍。

这次降价耐人寻味,因为 8 月 17 日 DeepSeek 刚推出高峰定价,把非高峰时段的输出价格从 2 元提高到 4.5 元,高峰时段提高到 9 元,涨幅分别为 125% 和 350%。一个多月后,公司发现降价并不会损失收入。9 月 19 日它进一步说明,中国的周末和法定节假日全天按非高峰价格计费,对不少团队来说账单更低。

对用户来说,最重要的不是价格水平,而是变化的方向。顶级模型降价,改变的不只是实验室的账本,还有所有在其上构建产品的人:一年前还是实验的东西,今天已经能塞进小团队的预算。价格战并不意味着模型会一直便宜下去,供应商会把成本转移到较弱的版本和高峰时段上。能把负载挪到非高峰窗口的人,今天为同等用量付的钱比一年前任何人都少。

评论 0

资料来源

3
  1. 01New Anthropic, OpenAI models: a little more for a lot lessEN
  2. 02DeepSeek 官宣明日 flash 系列 AI 模型降价ZH
  3. 03DeepSeek:调休上班的周末、法定节假日全天均按空闲时段计费ZH

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

吴静怡

吴静怡

经济、商业与世界

吴静怡负责FLASH24的经济、商业与世界报道,聚焦商业、国际与宏观经济,习惯从财报、监管文件和国际机构数据中找线索,对数字异常从不放过。她逐项核对营收、利润与现金流,并对照海关和统计口径确认数据是否一致。她常联系货运与供应链从业者,也会等季度财报和国际组织预测发布,再横向比较不同市场的表现。私下她关注科技公司财报,也骑货运自行车,这让她对物流成本和供应链变化格外敏感。她坚持一条原则:未经交叉验证的数字不发布。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。