FLASH24 中文
页 50 / 61最新
17 篇KV cache 每 token 890 字节:DeepSeek 如何压缩注意力内存
模型卡给出的数字是每个 token 890 字节缓存,约为 V4-Flash 的四分之一;HBM 需求也降到上一代的四分之一。
数据中心并网需求超过100吉瓦:电力成了新的瓶颈
2026年至2030年间,面向人工智能的数据中心需要新增超过100吉瓦的算力容量。英国案例说明,卡住项目的不是芯片,是电网。
SophIA 投入 2750 万欧元,把意大利人工智能从研究推向市场
波兰职位空缺率只有0.8%,抢走工作的不是AI,是雇主不再招人
Data Omnibus:用个人数据训练AI,会被一律算作「正当利益」吗
欧洲半导体:地缘政治风险正在变成结构性问题
每平方毫米内存比逻辑芯片更贵:DDR5与HBM的专利战
小鹏robotaxi量产下线,长安已拿到L4测试牌照
ACEA:纯电动车已占欧盟市场21.7%,奇瑞与比亚迪涨幅最大
盖茨要求国会为AI立法,桑德斯提案对超级智能最高判20年
充电功率之争:吉利2.25兆瓦,BYD 1.5兆瓦与2000座充电站
AI 水印规定已经生效,执法还在路上
国家AI:芯片、网络和能源决定谁掌控创新
中国算力用电1700亿千瓦时,首个用电指数出炉
中国开放权重模型的价格优势真实存在,但还不够
美国AI基建投入相当于GDP的3.6%,Oracle发出风险信号
简讯
6 篇DeepSeek V4 首个多模态模型开源
DeepSeek-V4-Flash-Vision-Exp 在 Hugging Face 上线,采用 MIT 许可,公开模型文件、Tokenizer 与最小化 PyTorch 推理实现。该模型支持在文本之外输入图片,可识别截图文字、分析图表,支持 JPEG、PNG、GIF、WebP 等格式。
DeepSeek 灰度测试语音对话,提供四种音色
据用户反馈,DeepSeek App 正在灰度测试语音对话,设置页面新增「朗读音色」选项,可选贝壳、白浪、海星、暗潮四种音色。
DeepSeek Harness 桌面版预览版偷跑
DeepSeek Harness 上线官方桌面版,版本号 V0.1.7-rc.2,支持 Windows x64 与 macOS Apple Silicon,无需安装 Node.js 或手动运行 npx。桌面版提供标准、PTC、极简、创造四种模式。
网友用 V4.1 Flash 调优手游,帧率提升五成
有网友在 X 上称,调用 DeepSeek V4.1 Flash 并组合 Hermes Agent 工具,把《生化危机 7》的游戏纹理从 4096 像素压缩到 1024 或 512 像素,在一加 12R 上把帧率从约 20FPS 提升到约 30FPS。
DeepSeek 明确峰谷计费的时间口径
DeepSeek 发布 API 峰谷时间说明:调休上班的周末、中国法定节假日全天均按空闲时段计费。此前周六、周日全天已不再区分峰谷时段,统一按低谷时段价格收取调用费用。
消息称高瓴合伙人严文韬有望出任 DeepSeek CFO
据凤凰网科技从多个独立信源处获悉,DeepSeek 的 CFO 即将到岗,最接近最终人选的是高瓴创投合伙人严文韬,后者已在走离职程序。业内人士认为,这个岗位的吸引力一半来自 DeepSeek 的行业地位,另一半来自它即将推进的资本化进程。