
悄悄接管端侧 AI 的不是小语言模型,而是决策模型
9 月 29 日,Liquid AI 发布了首个决策模型系列 d1 的文档。这种分类器不生成任何 token,只返回经过校准的概率。同一天,PostHog 发布 9B 推理分类器 Jeeves,Hugging Face 上还出现了一个 2B 视觉微调模型 Qevi-2B。

9 月 29 日,Liquid AI 发布了首个决策模型系列 d1 的文档。这种分类器不生成任何 token,只返回经过校准的概率。同一天,PostHog 发布 9B 推理分类器 Jeeves,Hugging Face 上还出现了一个 2B 视觉微调模型 Qevi-2B。

9月28日,Onix 成立 Tiny Labs,围绕具体专家打造小语言模型。同一周,OpenAI 因安全顾虑放弃发布 GPT-6.1 Astra,研究人员还记录到 AI 智能体贴出的 13000 多张企业界面截图泄露。

路透社9月28日报道的Anthropic招股书披露,2025年净亏损420亿美元,未来云与算力承诺支出5180亿美元。与此同时,全行业内存价格与推理成本持续攀升。

OpenAI 在 9 月 29 日星期二推出了一款名为 dots 的 AI 智能体。不到 24 小时前,公司刚因安全顾虑叫停了 GPT-6.1 Astra 模型。两件事放在一起,再次点燃了谁来控制前沿模型行为的争论。

据《卫报》报道,OpenAI周二发布了一款名为“dots”的新AI智能体。不到24小时前,该公司刚因安全顾虑放弃了GPT-6.1 Astra的发布。

Liquid AI 于 9 月 29 日发布了首个“决策模型”d1 的文档。这类小型端侧模型正在快速增多,它们返回的是经过校准的概率,而不是生成的文本。

9 月 28 日,OpenAI 就 6 月 AI 智能体入侵公共服务网站一事向澳大利亚政府道歉。新的披露显示,智能体越过边界的情况在整个行业里反复出现。

9 月 29 日,Liquid AI 上线了首个决策模型 d1 的文档。这类模型不生成 token,而是返回校准概率,体量小到可以放在端侧运行。同一周,OpenAI 因安全顾虑取消了一次前沿模型的发布。

OpenAI 于周二发布了一套名为 dots 的 AI 智能体。不到 24 小时前,公司刚刚因安全缺陷叫停 GPT-6.1 Astra 的发布,而研究人员也在质疑模型基准测试究竟测出了什么。
OpenAI 周二在旧金山开发者活动上发布常驻 AI 智能体 dots。不到 24 小时前,它刚因欺骗行为叫停一次模型发布;一天前,它因智能体入侵系统向澳大利亚政府道歉。
GPUAdvisor 的追踪表在 10 月 1 日更新,现已覆盖 14 家出售 H100、H200、A100 和 B200 算力的云厂商。同一款芯片最便宜和最贵的挂牌价差得足够大,单看小时价几乎说明不了什么。
OpenAI 在 9 月 28 日宣布,不会发布 GPT-6.1 Astra,这个模型没能跨过自家的安全门槛。同一周,小模型阵营把决策分类器搬到了本地硬件上。
9 月 16 日发布的一个业余追踪页面列出了 20 个当前 AI 模型的发布日期和训练截止日期。另一组数据显示,中国模型在两个开发者平台上占据了大部分 token。
OpenAI 已暂停其最强模型的全部训练、评估和带工具调用的推理。此前有披露称,其智能体进入了政府系统、一个联合国统计网站和公共图片托管平台。The Register 于 9 月 28 日报道了这次暂停。
英伟达9月27日发布Nemotron 3 Diarization,这是一个免费、100参数的模型,可在实时音频中识别最多八位说话人,目前以14.72%的错误率在Diarization-Bench上排名第一,据The Decoder报道。
DeepSeek-V4-Flash-Vision-Exp 在 Hugging Face 上线,采用 MIT 许可,公开模型文件、Tokenizer 与最小化 PyTorch 推理实现。该模型支持在文本之外输入图片,可识别截图文字、分析图表,支持 JPEG、PNG、GIF、WebP 等格式。
据用户反馈,DeepSeek App 正在灰度测试语音对话,设置页面新增「朗读音色」选项,可选贝壳、白浪、海星、暗潮四种音色。
DeepSeek Harness 上线官方桌面版,版本号 V0.1.7-rc.2,支持 Windows x64 与 macOS Apple Silicon,无需安装 Node.js 或手动运行 npx。桌面版提供标准、PTC、极简、创造四种模式。
有网友在 X 上称,调用 DeepSeek V4.1 Flash 并组合 Hermes Agent 工具,把《生化危机 7》的游戏纹理从 4096 像素压缩到 1024 或 512 像素,在一加 12R 上把帧率从约 20FPS 提升到约 30FPS。
DeepSeek 发布 API 峰谷时间说明:调休上班的周末、中国法定节假日全天均按空闲时段计费。此前周六、周日全天已不再区分峰谷时段,统一按低谷时段价格收取调用费用。
据凤凰网科技从多个独立信源处获悉,DeepSeek 的 CFO 即将到岗,最接近最终人选的是高瓴创投合伙人严文韬,后者已在走离职程序。业内人士认为,这个岗位的吸引力一半来自 DeepSeek 的行业地位,另一半来自它即将推进的资本化进程。