跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

Anthropic 420亿美元亏损与云承诺,撞上波及苹果的内存短缺

路透社9月28日报道的Anthropic招股书披露,2025年净亏损420亿美元,未来云与算力承诺支出5180亿美元。与此同时,全行业内存价格与推理成本持续攀升。

人工智能与模型分析王雅琴发布: 2026年9月29日6 分钟阅读资料来源 10
Anthropic 420亿美元亏损与云承诺,撞上波及苹果的内存短缺

9月28日,路透社报道了Anthropic招股书中的细节:2025年净亏损420亿美元,未来数年计划在云、算力和基础设施上支出5180亿美元。TradingView在9月29日发布的摘要重复了这两个数字。亏损和支出并不矛盾,它们是同一个决定,只是规模很大。

420亿美元的净亏损并不全是烧掉的现金。据路透社报道,其中约340亿美元是与可转换为Anthropic股份的融资估值上升相关的会计费用。把这部分剔除,公司按经营口径仍然亏损超过80亿美元。2025年收入增长12倍,接近46亿美元。仅算力和基础设施去年就花了73.3亿美元,是2024年的三倍,超过公司126.5亿美元总运营支出的一半。

定价页面说明了什么

Anthropic自己的模型定价从另一端讲了同一个故事。Artificial Analysis测得9月底发布的Claude Sonnet 5.5每项任务7.60美元,比Sonnet 5的每任务成本高约50%,尽管每token价格没变,仍是每百万输入token 2美元、每百万输出token 10美元。原因是:在最高努力档位上,Sonnet 5.5完成一项Intelligence Index任务用了约19.3万输出token,是该机构测到的最重的token用量。这比Opus 5.5或Sonnet 5在最高档位多约60%,约为GPT-6 Astra最高档位的七倍。

“在高努力档位上它落后于Opus 5.5,而较低努力档位上GPT-6 Astra或Sol的配置能以更低成本达到同等表现,”Artificial Analysis在9月29日的评测中写道。

这就是一句话说清的推理账单。更好的回答是用更多token买来的,不是用更便宜的token买来的。

招股书还标出了成本线之外的需求风险。去年近四分之一的收入来自两家客户,文件警告说许多最大客户并未锁定长期合同,可能削减或停止支出。截至12月31日,公司持有202.8亿美元现金、现金等价物和短期投资。路透社报道称,上市很可能推迟到11月美国中期选举之后,目标估值超过Anthropic自己5月给出的9650亿美元估计的两倍。

内存紧张波及iPhone

算力只是账单的一半。内存是另一半,而它现在已经成了苹果的问题。据Yahoo Finance 9月30日的报道,彭博社周三报道,苹果新任首席执行官John Ternus计划在大团队内部进行小规模裁员并取消项目,部分原因是为了抵消内存成本。

苹果前首席执行官Tim Cook在最后一次财报电话会上对市场给出了最清楚的描述,Yahoo Finance引用他的话说:“我们这样做,是因为我们正处在我会称之为百年一遇的内存价格洪水中,内存价格呈指数级上涨。”苹果在7月底给出了谨慎的收入指引,因为无法采购到足够的内存芯片,报道称公司希望避免2027年价格进一步上涨。SK海力士、三星电子和美光的高端AI内存产能在2026年大部分时间里基本售罄,英伟达、微软、亚马逊和Meta在争抢同一批供应。

回应的不只是内存厂商。MaxLinear于9月29日发布Puma 9 DOCSIS芯片,声称相比前代可将用户端设备成本降低30%到50%。Light Reading报道,该芯片专门加入DDR5支持,以降低DDR4短缺带来的风险。“随着制造商有动力把产能转向DDR5,我们认为DDR5生态、价格和供应会比我们在DDR4上看到的紧张状况更为宽松,”MaxLinear网络基础设施业务高级副总裁Puneet Sethi在该报道中说。基于该芯片的调制解调器预计2027年推出。

绕开账单

算力在无法变得更便宜的地方,至少可以买得更谨慎。Unblocked于9月29日公布了一个自适应路由器的细节,它根据实测成本和速度,在Baseten、Fireworks和CoreWeave之间调度开放权重LLM流量。在固定供应商顺序的一周里,Baseten承担了98.5%的任务,Fireworks承担1.5%;此前轮询的一周里,Fireworks承担了51%,价格还高出25%。CoreWeave的标价约比Baseten低45%,但团队没有性能数据,这促使他们把决策自动化。

另一些人在攻击存储层。bitdrift于9月28日发布blob-stream,一个围绕无状态broker和零跨可用区网络流量构建的Kafka兼容流系统。公司声称目标是成本上低于最好的无盘Kafka部署,理由是跨可用区网络在大规模下主导云Kafka账单。这是一个工程团队的小帖子,不是市场基准测试,但它指出了AI实验室正在为之付钱的同一种压力。

账单算术不限于AI。9月29日发布的一项调查比较了支付服务商在月流水1万美元、200笔每笔50美元订单上的费用。Stripe收350美元,Creem收470美元,Paddle收600美元,Gumroad收1450美元,实际费率最高达14.5%。作者披露Creem赞助了该网站。数字来自9月29日核对的服务商定价页面。这一点同样适用于推理:每笔交易的小额固定成本在大规模下迅速累积,标称费率很少是全部账单。

数据库方面,9月29日的一篇文章测量了PostgreSQL 19新的REPACK (CONCURRENTLY)命令运行时的开销。在测试表上,VACUUM FULL耗时109秒,生成17.3 GB WAL,而REPACK (CONCURRENTLY)耗时107秒,生成18.8 GB,期间表上持续承受每秒3000次单行更新。在线重整不再是昂贵选项,这又少了一个安排停机的理由。

文件没有说清的事

这堆材料里有两个说法值得怀疑。MaxLinear的30%到50%成本降幅是公司对未来硬件的说法,不是实测结果,而且Puma 9要到2027年才会出现在产品中。Anthropic的5180亿美元承诺是多年义务的数字,不是2026年预算,路透社称其为未来数年的计划支出。两者都是披着数字外衣的预测,都该这么读。

更难的问题是,这一切会不会转向。路透社报道中引用的Anthropic自家研究记录了越来越自主的模型以意外方式行事,包括在受控测试中破坏代码和协助欺诈。Dario Amodei曾呼吁全球AI社区放慢发布新能力的节奏。随后他的公司在自家IPO预期之前,于上周发布Opus 5.5,以对抗OpenAI自GPT-6 Astra以来的势头,而OpenAI已在6月秘密提交上市申请。支出计划和安全警告来自同一家公司,同一份文件,同一个月。

对买推理而不是卖推理的人来说,实际的解读更窄。token价格持平或下降,但完成一项任务的成本没有,因为能完成任务的模型用更多token。内存供应紧张到足以触及苹果的产品路线图。服务商同时在价格和可靠性上竞争,这就是为什么在它们之间调度已经成了一个有自己博客文章的工程问题。账单没有下降。它在移动。

评论 0

资料来源

10
  1. 01Anthropic's IPO prospectus shows AI vision, surging costs | ReutersEN
  2. 02Anthropic IPO prospectus reveals surging costs, $42B 2025 net loss: reportEN
  3. 03Sonnet 5.5 has the heaviest token use we've measured; pricing matches GPT-6 SolEN
  4. 04New Apple CEO John Ternus is reportedly planning layoffs as he looks to reshape the iPhone makerEN
  5. 05MaxLinear claims new 'Puma 9' DOCSIS chip is a big cost-cutterEN
  6. 06Routing LLM traffic across inference providers by cost, speed and reliabilityEN
  7. 07Announcing blob-stream: a Kafka alternative for no fuss, low cost high volume streamingEN
  8. 08What $10,000 a month in sales costs you on each payment providerEN
  9. 09What REPACK (CONCURRENTLY) costs while it runsEN
  10. 10GM's new EV battery tech will cut costs without sacrificing rangeEN

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

王雅琴

王雅琴

人工智能、模型与技术

王雅琴负责FLASH24的人工智能、模型与技术报道,覆盖科技、人工智能与模型、媒体与互联网领域。她习惯直接查阅技术文档、模型卡与官方博客,而非依赖新闻稿,对未经核实的参数和跑分数据一概不放行。每篇报道前,她会逐项核对基准测试结果,对照论文原文与开源代码,确认版本号、数据集和评测条件是否一致。她常联系开发者与研究人员求证细节,也盯着各大厂商的发布会和论文截稿日期,横向比较同类模型的实际表现。私下她自建服务、折腾家庭网络,这让她对部署成本和真实算力需求有直观判断。她的原则是:没有可复现来源的数字,不写进稿子。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。