跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

开源大模型的这半年:小米 MiMo、DeepSeek 与 HuggingFace 上的中文模型

小米把一场强化学习训练搬进直播间,MiMo-V2.6-Pro 以 1.02 万亿参数、420 亿激活登上开源榜首;与此同时,DeepSeek 的视觉实验版也以 MIT 许可开源。

人工智能与模型分析王雅琴发布: 2026年9月23日6 分钟阅读资料来源 3
开源大模型的这半年:小米 MiMo、DeepSeek 与 HuggingFace 上的中文模型

过去半年,中文开源大模型的竞争明显加快。9 月 22 日,小米结束了一场持续六天的「炼丹直播」,把大模型强化学习训练直接放在直播间里跑。最终账单定格在 350 万美元,约合 2344 万元人民币。

模型成绩也一并公开。MiMo-V2.6-Pro 有 1.02 万亿参数、420 亿激活,在 Artificial Analysis Intelligence Index 上拿到 46 分,位列开源第一。MiMo 负责人罗福莉称,这是迄今开源模型团队所进行的规模最大的单次强化学习训练之一。她还直言,背后的研究创新与工程挑战超过她曾参与的 DeepSeek-R1。

样本外泛化更值得看。在考察 Coding Agent 的 DeepSWE v1.1 上,Pro 从 58.4 分涨到 72.57 分,Flash 从 48.7 分涨到 65.68 分。只跑 30 个 Step,模型就持续变强,还把能力迁移到了没见过的软件工程任务上。

价格没有跟着能力一起上涨。MiMo-V2.6 沿用上一代的 API 定价,Pro 输入与输出每百万 Token 约 3 元与 6 元,Flash 约 1 元与 2 元。按 Artificial Analysis 的测算,MiMo-V2.6-Pro 完成一项任务平均成本只有 0.13 美元。同期发布的闭源模型 Grok 4.7 在同一指数上同样是 46 分,但其高配版本完成一项任务平均需要 3.74 美元。

开源的清单也在变长。小米开放了模型权重、技术报告、7000 多个 RL 任务环境、端到端训练框架,以及可自由组合的 mini-harness。小米还放出一个蒸馏模型,以 Qwen3.5-9B 为底座,用 MiMo 生成的 77.4B Token 数据完成监督微调。Hugging Face 前研究员关注的是速度:最终 RL 训练启动不到一周,就交出了模型与训练框架。

DeepSeek 这边则在 8 月 31 日把 V4 系列首个多模态模型 DeepSeek-V4-Flash-Vision-Exp 放上 Hugging Face,采用 MIT 许可。公开内容包括模型文件、Tokenizer、Prompt Encoding 参考实现以及最小化 PyTorch 推理实现。环境与生态的双重推动下,中文模型在开源社区的存在感正在变得更强。

评论 0

资料来源

3
  1. 016 天烧光 2000 多万,拿下开源第一!小米史无前例炼丹直播收官ZH
  2. 02DeepSeek-V4-Flash-Vision-Exp 模型已开源ZH
  3. 03DeepSeek-V4.1-Flash 模型卡EN

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

王雅琴

王雅琴

人工智能、模型与技术

王雅琴负责FLASH24的人工智能、模型与技术报道,覆盖科技、人工智能与模型、媒体与互联网领域。她习惯直接查阅技术文档、模型卡与官方博客,而非依赖新闻稿,对未经核实的参数和跑分数据一概不放行。每篇报道前,她会逐项核对基准测试结果,对照论文原文与开源代码,确认版本号、数据集和评测条件是否一致。她常联系开发者与研究人员求证细节,也盯着各大厂商的发布会和论文截稿日期,横向比较同类模型的实际表现。私下她自建服务、折腾家庭网络,这让她对部署成本和真实算力需求有直观判断。她的原则是:没有可复现来源的数字,不写进稿子。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。