Opus 5.5 与 GPT-6 Sol:模型之战打到价目表上
Anthropic 把 Opus 5.5 降价 20%,缓存读取降价 60%。OpenAI 用 Sol 和 Luna 回应。DeepSeek 在中国下调 flash 价格。

Anthropic 和 OpenAI 的新模型在能力上没带来突破,带来的是降价。价格现在是竞争的主战场。Opus 5.5 是 Anthropic 主力模型的最新版本,用于编程和复杂的知识工作。每百万输入 token 收费 4 美元,每百万输出 token 收费 20 美元,比 Opus 5 便宜 20%。缓存读取在智能体任务和编程里占成本的大头,价格降到每百万 token 0.20 美元,降幅 60%。模型的回答速度也快了 30% 以上。
Anthropic 称,在典型任务和默认设置下,节省可达 40%,因为完成同一个任务,模型消耗的 token 更少。网络安全和生物学等“高风险”领域是例外:这些领域的请求可能被自动转给较旧的模型。
OpenAI 用 GPT-6 Sol 和 Luna 回应,两者是 GPT-6 系列里更轻的版本。Sol 面向日常任务,质量尚可,成本更低。Luna 更小、更便宜。这些公司不只彼此竞争,还要和开源模型竞争。越来越多的企业用模型路由,把昂贵的前沿模型用得更少。
在中国,同样的机制体现在 DeepSeek 的价目表上。从 9 月 10 日北京时间 12 点起,flash 模型按新价格计费:非高峰时段命中缓存的输入从每百万 token 0.05 元降到 0.02 元,降幅 60%;未命中的输入从 1.5 元降到 1 元,降三分之一;输出从 4.5 元降到 4 元,约降 11%。高峰时段的价格是非高峰时段的两倍。
这次降价耐人寻味,因为 8 月 17 日 DeepSeek 刚推出高峰定价,把非高峰时段的输出价格从 2 元提高到 4.5 元,高峰时段提高到 9 元,涨幅分别为 125% 和 350%。一个多月后,公司发现降价并不会损失收入。9 月 19 日它进一步说明,中国的周末和法定节假日全天按非高峰价格计费,对不少团队来说账单更低。
对用户来说,最重要的不是价格水平,而是变化的方向。顶级模型降价,改变的不只是实验室的账本,还有所有在其上构建产品的人:一年前还是实验的东西,今天已经能塞进小团队的预算。价格战并不意味着模型会一直便宜下去,供应商会把成本转移到较弱的版本和高峰时段上。能把负载挪到非高峰窗口的人,今天为同等用量付的钱比一年前任何人都少。
资料来源
3- 01New Anthropic, OpenAI models: a little more for a lot lessEN
- 02DeepSeek 官宣明日 flash 系列 AI 模型降价ZH
- 03DeepSeek:调休上班的周末、法定节假日全天均按空闲时段计费ZH
本文所有数字与引语均来自下列来源,未添加来源之外的内容。
本内容由编辑部在人工智能辅助下制作完成。
评论
0- 还没有评论——来说两句吧。