跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

阿里巴巴发布真武V900芯片,配套软件栈SAIL开源

在杭州云栖大会上,阿里巴巴发布了真武V900芯片,称其为中国性能最强的AI加速器。次日,子公司平头哥将配套软件栈SAIL的组件开源。

科技新闻林晓雯发布: 2026年9月25日5 分钟阅读资料来源 2
阿里巴巴发布真武V900芯片,配套软件栈SAIL开源

9月22日,杭州云栖大会上,阿里巴巴首席执行官吴泳铭发布了新加速器真武V900。官方称这是中国性能最强的AI芯片,比上一代M890快三倍。一天后,子公司平头哥公布了配套软件栈的开源进展。

开放了哪些内容

这套软件栈名为T-Head SAIL,包括计算框架适配、加速库、工具链和通信库。此次公开的组件有PyTorch-for-sail、sailify、Triton-for-sail、DeepGEMM-for-sail和FlashAttention-for-sail,PCCL和DeepEP-for-sail则宣布即将推出。只开放工具、不开放芯片,用意很明确:开发者不必重写已有模型,就能用上这颗芯片。

官方公布的客户超过650家,覆盖20多个行业,包括蚂蚁、小红书和汽车公司小鹏。小红书开发了能处理负载迁移和算子优化的智能体。ModelScope模型库上有39个量化模型,包括Qwen、DeepSeek和Kimi,截至2026年9月下载量超过348000次。可见竞争优势既取决于开发者社区,也取决于性能。

算力依然紧缺

背后是供给问题。浪潮在AICC 2026上与IDC联合提交的报告估计,全球AI算力需求的覆盖率将从2024年的79%降到2027年预期的71%,2030年回升至77%。到2030年,绝对缺口估计为3809亿美元,接近2024年水平的十倍。报告还预计,全球token消耗到本十年末将以4822%的年复合增长率增长,每年约有4000万亿次推理活动。

同一场大会上,浪潮发布了元脑SD200 Ultra系统,把配置从64颗芯片提升到128颗,扩展内存和存储最高达8TB和64TB,同时发布了HC2000平台。竞争正从单个处理器转向系统:谁能把芯片、软件和分发规模整合起来,谁就能降低被市场排除在外的风险。

评论 0

资料来源

2
  1. 01量子位 — 阿里真武 V900 发布, T-Head SAIL 开源 (Yunqi Conference, Apsara 2026)ZH
  2. 02量子位 — 浪潮 AICC 2026 与 IDC 《2026 中国人工智能计算力发展评估报告》ZH

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

林晓雯

林晓雯

人工智能、模型与技术

林晓雯负责FLASH24的人工智能、模型与技术方向,主要写科技、人工智能与模型、媒体与互联网三个领域。她习惯从论文预印本、开源代码库和厂商技术文档入手,先核对训练数据来源和评测口径,再决定是否落笔。遇到模型跑分,她会自己复现一遍小规模测试,并对照独立第三方榜单,确认数字没有注水。她常联系一线工程师和产品经理,也盯着各大会议截稿日,把不同版本的技术报告放在一起比。业余时间她玩3D打印、折腾老电脑,还关心模型从网络垃圾里学到的偏见问题,这让她对数据清洗格外敏感。她有一条原则:拿不到原始数据的性能宣称,不写。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。