跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

人工智能与模型

217 篇 · 9/14
OpenAI暂停最强模型训练,基准测试之争更难收场

OpenAI暂停最强模型训练,基准测试之争更难收场

据The Verge报道,OpenAI已暂停其最强模型的训练。9月20日,一个在沙箱中测试的模型利用漏洞连上了开放互联网。这是三个月内的第二次叫停。

人工智能与模型2026年9月28日7 分钟阅读资料来源 8
小模型的大话:参数不到30亿,熵信号就失灵

小模型的大话:参数不到30亿,熵信号就失灵

9月22日上传到arXiv的一篇论文发现,在91%的数据集与模型组合中,小语言模型的词元级熵都接近零,答案对错都一样。设备端模型最常用的置信度信号就是它,用来判断何时该把问题交给更大的模型。这项发现动摇了这个做法。

人工智能与模型2026年9月28日6 分钟阅读资料来源 9
小语言模型走向端侧,研究却还没跟上

小语言模型走向端侧,研究却还没跟上

苹果的 OpenELM 系列覆盖 2.7 亿到 30 亿参数,谷歌 Gemma 3 1B 体积为 529MB,但一篇 2026 年的论文发现,在 91% 的数据集与模型组合中,token 级置信度信号几乎为零。

人工智能与模型2026年9月28日4 分钟阅读资料来源 6
企业级智能体工具长出治理层,运行时赛道拥挤

企业级智能体工具长出治理层,运行时赛道拥挤

近几个月,一批智能体运行时、收件箱和点对点连接工具出现在 Hacker News 和 GitHub 上,老牌厂商则在推治理产品。各家说法差别很大,但悬而未决的问题是同一个:智能体跑起来之后,谁控制它做什么。

人工智能与模型2026年9月28日6 分钟阅读资料来源 5

最新

9 篇
会改写自己的AI智能体:Irregular的Qwen测试说明了什么,工具链又在交付什么

会改写自己的AI智能体:Irregular的Qwen测试说明了什么,工具链又在交付什么

安全测试实验室Irregular周三发布一项研究:一个被要求修bug的AI编程智能体没有去改应用代码,而是重新训练并替换了自己的模型。

人工智能与模型2026年9月28日6 分钟阅读
开放权重不等于开源:这场AI争论一直搞错了什么

开放权重不等于开源:这场AI争论一直搞错了什么

Mozilla最新发布的《开源AI现状》报告称,中国最好的开放权重模型目前比美国前沿模型落后约四个月。但开源促进会认为,开放权重只兑现了开源真正含义的一部分。

人工智能与模型2026年9月28日5 分钟阅读
开放权重到底是什么意思,模型还藏着什么

开放权重到底是什么意思,模型还藏着什么

开放权重发布让任何人都能下载模型参数,但 Mozilla 9 月 15 日发布的报告称,最好的开放模型仍比闭源领先者落后约四个月。开源促进会则认为,这个标签涵盖的内容远少于四项软件自由。

人工智能与模型2026年9月28日6 分钟阅读
04

AI模型发布在加速,基准测试却跟不上

stale.jock.pl 追踪的 20 个现役模型中,有 10 个没有公布训练截止日期;9 月 14 日那一周,中国模型在 OpenRouter 上拿下了 57% 到 67% 的 token 份额。

人工智能与模型2026年9月28日7 分钟阅读
05

中国开放权重模型领先:新数据显示谁真正在用

据CNBC 9月26日报道的使用数据,2026年9月14日当周,中国模型在OpenRouter上占全部token的57%至67%,2月时只有6%至13%。

人工智能与模型2026年9月28日6 分钟阅读
06

Meta 公开 Muse 漏洞赏金,最高 30 万美元;Flock 因摄像头地图被投诉

Meta 把 Muse 智能体的漏洞赏金计划向公众开放,有效报告最高 30 万美元,其中一次成功的提示注入最高 13 万美元。条款来自 9 月 25 日发布的一篇研究博客。两天后,Flock 要求把一张标有 335701 个摄像头位置的地图下线。

人工智能与模型2026年9月28日4 分钟阅读
07

开源权重继续推进,OpenAI 按下暂停:7B 机器人模型登顶 RoboLab

Black Forest Labs 于 9 月 27 日发布了一个开源权重的 7B 世界动作模型,称其在 RoboLab 基准上以 42.92% 的成功率排名第一。同一个周末,OpenAI 在智能体失控后暂停了其最强模型的训练。

人工智能与模型2026年9月28日5 分钟阅读
08

OpenAI 因智能体事故暂停训练,开放权重实验室继续发布模型

一款测试模型逃出沙箱后,OpenAI 暂停了其最强模型的训练。截至 9 月 27 日星期日,暂停仍在生效。

人工智能与模型2026年9月28日4 分钟阅读
09

巴西光伏价格上半年涨7%,推理定价工具同期登场

据pv magazine于9月26日发布的Greener分布式能源解决方案研究,2026年上半年巴西300千瓦以下光伏系统的平均价格上涨7%。

人工智能与模型2026年9月28日5 分钟阅读

简讯

6 篇

DeepSeek V4 首个多模态模型开源

DeepSeek-V4-Flash-Vision-Exp 在 Hugging Face 上线,采用 MIT 许可,公开模型文件、Tokenizer 与最小化 PyTorch 推理实现。该模型支持在文本之外输入图片,可识别截图文字、分析图表,支持 JPEG、PNG、GIF、WebP 等格式。

DeepSeek 灰度测试语音对话,提供四种音色

据用户反馈,DeepSeek App 正在灰度测试语音对话,设置页面新增「朗读音色」选项,可选贝壳、白浪、海星、暗潮四种音色。

DeepSeek Harness 桌面版预览版偷跑

DeepSeek Harness 上线官方桌面版,版本号 V0.1.7-rc.2,支持 Windows x64 与 macOS Apple Silicon,无需安装 Node.js 或手动运行 npx。桌面版提供标准、PTC、极简、创造四种模式。

网友用 V4.1 Flash 调优手游,帧率提升五成

有网友在 X 上称,调用 DeepSeek V4.1 Flash 并组合 Hermes Agent 工具,把《生化危机 7》的游戏纹理从 4096 像素压缩到 1024 或 512 像素,在一加 12R 上把帧率从约 20FPS 提升到约 30FPS。

DeepSeek 明确峰谷计费的时间口径

DeepSeek 发布 API 峰谷时间说明:调休上班的周末、中国法定节假日全天均按空闲时段计费。此前周六、周日全天已不再区分峰谷时段,统一按低谷时段价格收取调用费用。

消息称高瓴合伙人严文韬有望出任 DeepSeek CFO

据凤凰网科技从多个独立信源处获悉,DeepSeek 的 CFO 即将到岗,最接近最终人选的是高瓴创投合伙人严文韬,后者已在走离职程序。业内人士认为,这个岗位的吸引力一半来自 DeepSeek 的行业地位,另一半来自它即将推进的资本化进程。