跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

人工智能与模型

217 篇 · 14/14
同一批分数,不同的账:开源模型的评测该怎么读

同一批分数,不同的账:开源模型的评测该怎么读

Artificial Analysis 指数上,小米 MiMo-V2.6-Pro 与闭源模型 Grok 4.7 同为 46 分,但完成一项任务的平均成本相差约 29 倍。分数之外的成本,正在成为新的评测维度。

人工智能与模型2026年9月18日5 分钟阅读资料来源 3
同一批分数,不同的账:开源模型的评测该怎么读

同一批分数,不同的账:开源模型的评测该怎么读

Artificial Analysis 指数上,小米 MiMo-V2.6-Pro 与闭源模型 Grok 4.7 同为 46 分,但完成一项任务的平均成本相差约 29 倍——分数之外的成本,正在成为新的评测维度。

人工智能与模型2026年9月18日5 分钟阅读资料来源 3
访谈:当 AI 学会写算子,工程师还要做什么

访谈:当 AI 学会写算子,工程师还要做什么

DeepSeek V4.1 的算子工程师刘胜写下《我不得不把才华埋葬在昨天》,一天内冲上知乎热榜第一。我们没能约到他本人,只能从他公开的文字里,看一线工程师的真实处境。

人工智能与模型2026年9月17日6 分钟阅读资料来源 2

最新

10 篇
访谈:当 AI 学会写算子,工程师还要做什么

访谈:当 AI 学会写算子,工程师还要做什么

DeepSeek V4.1 的算子工程师刘胜与写下《我不得不把才华埋葬在昨天》,一天内冲上知乎热榜第一;我们据此与他公开的文字,聊了聊 AI 编程时代的岗位变化。

人工智能与模型2026年9月17日6 分钟阅读
中国模型 Mureka V8 测试胜过 Suno V5,宣称开创一种新音乐流派

中国模型 Mureka V8 测试胜过 Suno V5,宣称开创一种新音乐流派

昆仑天工在一家音乐俱乐部发布 Mureka V8,称该模型在音乐人参与的测试中超过 Suno V5。公司首席执行官直接谈的是一种新流派,而不是又一款工具。

人工智能与模型2026年9月16日5 分钟阅读
890 字节一个 Token:读懂 DeepSeek 的 KV Cache 压缩

890 字节一个 Token:读懂 DeepSeek 的 KV Cache 压缩

长上下文的成本往往卡在记忆而不是权重上。DeepSeek V4.1 Flash 把 KV Cache 压到每个 Token 约 890 字节,并把 HBM 需求降到上一代四分之一、SSD 需求降到八分之一。

人工智能与模型2026年9月12日5 分钟阅读
04

890 字节一个 Token:读懂 DeepSeek 的 KV Cache 压缩

长上下文的成本往往卡在记忆而不是权重上。DeepSeek V4.1 Flash 把 KV Cache 压到每个 Token 约 890 字节,并把 HBM 需求降到上一代四分之一、SSD 需求降到八分之一。

人工智能与模型2026年9月12日5 分钟阅读
05

V4 Pro 下线一天后反转:DeepSeek 宣布继续提供 API 调用

原定 9 月 14 日下线的 V4 Pro,在 9 月 11 日被 DeepSeek 宣布继续提供 API 调用,计费方式保持不变;此前官方计划把 V4 Pro 请求全部路由到 V4.1 Flash。

人工智能与模型2026年9月11日4 分钟阅读
06

V4 Pro 下线一天后反转:DeepSeek 宣布继续提供 API 调用

原定 9 月 14 日下线的 V4 Pro,在 9 月 11 日被 DeepSeek 宣布继续提供 API 调用,计费方式保持不变;此前官方计划把 V4 Pro 请求全部路由到 V4.1 Flash。

人工智能与模型2026年9月11日4 分钟阅读
07

DeepSeek V4.1 Flash 正式发布:5520 亿参数、原生多模态、定价下调

北京时间 9 月 10 日,DeepSeek 发布 V4.1 Flash 模型。它采用 5520 亿参数的 MoE 结构,输入阶段只激活 80 亿参数,KV Cache 对 HBM 的需求降到上一代的四分之一。

人工智能与模型2026年9月10日5 分钟阅读
08

DeepSeek V4.1 Flash 正式发布:5520 亿参数、原生多模态、定价下调

北京时间 9 月 10 日,DeepSeek 正式发布 V4.1 Flash 模型,它采用 5520 亿参数的 MoE 新结构,输入只激活 80 亿参数,并把 KV Cache 对 HBM 的需求降到上一代四分之一。

人工智能与模型2026年9月10日5 分钟阅读
09

当 Agent 开始花钱:微信支付 AI 专属卡与国内智能体落地

微信支付 AI 专属卡新增支持接入 DeepSeek Harness 和 OpenClaw,用户授权后可在对话里完成从推荐到支付的全流程,官方强调主账隔离与每笔确认。

人工智能与模型2026年9月1日5 分钟阅读
10

当 Agent 开始花钱:微信支付 AI 专属卡与国内智能体落地

微信支付 AI 专属卡新增支持接入 DeepSeek Harness 和 OpenClaw,用户授权后可在对话里完成从推荐到支付的全流程,官方强调主账隔离与每笔确认。

人工智能与模型2026年9月1日5 分钟阅读

简讯

6 篇

DeepSeek V4 首个多模态模型开源

DeepSeek-V4-Flash-Vision-Exp 在 Hugging Face 上线,采用 MIT 许可,公开模型文件、Tokenizer 与最小化 PyTorch 推理实现。该模型支持在文本之外输入图片,可识别截图文字、分析图表,支持 JPEG、PNG、GIF、WebP 等格式。

DeepSeek 灰度测试语音对话,提供四种音色

据用户反馈,DeepSeek App 正在灰度测试语音对话,设置页面新增「朗读音色」选项,可选贝壳、白浪、海星、暗潮四种音色。

DeepSeek Harness 桌面版预览版偷跑

DeepSeek Harness 上线官方桌面版,版本号 V0.1.7-rc.2,支持 Windows x64 与 macOS Apple Silicon,无需安装 Node.js 或手动运行 npx。桌面版提供标准、PTC、极简、创造四种模式。

网友用 V4.1 Flash 调优手游,帧率提升五成

有网友在 X 上称,调用 DeepSeek V4.1 Flash 并组合 Hermes Agent 工具,把《生化危机 7》的游戏纹理从 4096 像素压缩到 1024 或 512 像素,在一加 12R 上把帧率从约 20FPS 提升到约 30FPS。

DeepSeek 明确峰谷计费的时间口径

DeepSeek 发布 API 峰谷时间说明:调休上班的周末、中国法定节假日全天均按空闲时段计费。此前周六、周日全天已不再区分峰谷时段,统一按低谷时段价格收取调用费用。

消息称高瓴合伙人严文韬有望出任 DeepSeek CFO

据凤凰网科技从多个独立信源处获悉,DeepSeek 的 CFO 即将到岗,最接近最终人选的是高瓴创投合伙人严文韬,后者已在走离职程序。业内人士认为,这个岗位的吸引力一半来自 DeepSeek 的行业地位,另一半来自它即将推进的资本化进程。

页 14 / 14← 上一页1…121314