跳到正文
世界时间EU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

关于人工智能与技术的门户事件 · 分析 · 访谈 · 技术背景

搜索
直播
›

NHL 转向言情有声书,AI 视频生成器追逐同样的注意力

本周,国家冰球联盟(NHL)开始推出言情风格的音频短片。这场营销活动遭到该类型一些畅销书作家的强烈反对,与此同时,AI 视频生成器仍在不断增多。

人工智能与模型新闻王雅琴发布: 2026年10月2日6 分钟阅读资料来源 12
NHL 转向言情有声书,AI 视频生成器追逐同样的注意力

本周,国家冰球联盟(NHL)开始发布关于其球员的短篇言情风格音频故事。一些被联系的作家公开拒绝参与。WIRED 于周五报道了首批内容,这是名为“Hot for Hockey”活动的一部分。该联盟联系了流行的冰球言情作家,为有声书平台撰写并朗读 60 至 90 秒的内容。

这些故事并非言情作品。它们读起来像是旨在销售门票的封底简介。

WIRED 引用了一篇标题为《我随特雷弗·泽格拉斯变得坚韧的那个夏天》的完整文本:“特雷弗·泽格拉斯来到费城,寻求新的开始。但在去年季后赛与匹兹堡激战后,他发现了事情可以变得多么坚韧。经过一个炎热的夏天,费城的帅哥看起来更加坚韧了。”据 WIRED 报道,首批内容还包括卡罗莱纳飓风队的塞巴斯蒂安·阿霍和维加斯金骑士队的杰克·艾歇尔,由《Pucking Wrong》的作者 C.R. Jane 撰写。

并非该类型的所有人都觉得有趣。畅销冰球言情小说作家艾米丽·拉思在 Threads 上表示,联盟曾联系她,她“从未这么快拒绝过提议”,WIRED 报道。拉思称,该活动的幻灯片包含她认为是对该类型的嘲笑的玩笑,以及她声称的 AI 封面渲染图。《D.C. Stars》系列的作者切尔西·库尔托也指出了 AI 图形问题,她写道,她拒绝参与可能最好,因为她的书“可能会严厉批评联盟”。

NHL 发言人乔恩·韦因斯坦告诉 WIRED,该活动是“对当前文化潮流中明显存在之事的俏皮致敬”。他表示,联盟“非常自豪能与该领域的真实冰球作家、插画家和配音演员合作”。

视觉端持续演进

NHL 的故事是一个有用的提醒:AI 生成或 AI 辅助内容如今已成为大型组织营销的常规部分,且受众注意到了这一点。在模型方面,过去一周产生了一系列旨在用于视频和图像工作的发布。

Ideogram 于 10 月 1 日表示,其新的 Ideogram 4.5 模型可以编辑图像的一部分而不改变其余部分。该公司称,GPT-Image 2.5 和 Nano Banana 等领先模型在多次编辑后仍会出现伪影问题。The Decoder 报道,该模型以四种质量等级推出,原生 2K 分辨率下每张图片价格为 0.8 至 22 美分,现已在 Ideogram 平台及其 API 上可用,合作伙伴包括 Picsart、Runway、Pika 和 Leonardo AI。开源权重版本即将发布。

与此同时,Tavus 推出了 Griffin,称之为第一个“人类交互模型”。该系统在处理视频的同时,接收并生成语音、面部表情、语调、手势和停顿。据 The Decoder 报道,在 Tavus 的一项研究中,48% 的参与者在一次一分钟后认为 Griffin 是真人,而此前最高比例为 2%。在 Tavus 描述为独立的 Nvidia 测试中,该测试衡量 AI 在直接音视频对话中给人的真实感,Griffin 得分为 3.83 分,实际人类为 3.92 分,此前最佳 AI 模型为 2.80 分。

据 The Decoder 报道,名为 Griffin-Lite 的预览版向“选定测试者作为研究预览”开放,完整版本承诺在“解决安全顾虑后”推出。Tavus 列举了辅导、练习艰难对话和基于摄像头的技术支持作为可能用途。

语音和决策模型在同一窗口期到来

微软 AI 于 10 月 2 日推出了新的语音模型。据 The Decoder 报道,MAI-Transcribe-2-Streaming 转录 60 种语言,并在仅 100 多毫秒内返回首批部分结果,微软称这能让语音代理在说话人还在句中时做出反应。通过年底的入门价,一小时音频成本为 0.54 美元。两个新的文本转语音模型 MAI-Voice-2.1 和 MAI-Voice-2.1-Flash 以相同声音覆盖 23 种语言,Flash 变体延迟为 150 毫秒,每百万字符 15 美元,而非 22 美元。两者都可以从几秒钟的参考音频中克隆声音。The Decoder 引用的一项测试显示,约 4000 名参与者中的一半认为这些声音属于真人。

决策模型也在迎来自己的时刻。亚马逊云科技(AWS)于 10 月 1 日发布了 Strands Decider 2B,这是一款开源模型,它在预设选项之间进行排序并返回置信度度量,TechCrunch 报道。它由杰出工程师 Marc Brooker 在看到 TypeSafe 的 Jev 后构建,并曾短暂占据该规模模型的 Jevbench 排名榜首。“最初引起我对这类模型兴趣的是,它们可以作为工作流步骤的完美决策者,”Brooker 告诉 TechCrunch。

据 InfoQ 报道,TypeSafe 自己的 Jev 于 10 月 1 日发布,它返回类型化概率决策而非文本,每百万输入 token 0.042 美元,输出免费,32000 token 上下文窗口,引用的端到端延迟为 70ms 至 500ms。Vercel 工程师 Pranit Sharma 发现,安全分类器比其替换的 LLM 快 5 到 18 倍。OpenChamber 对 12759 条发布推文的分析显示,用户报告的速度提升中位数为 7 倍,而标题为 193.6 倍,成本节省中位数为 30 倍,延迟中位数为 76ms。

Cloudflare 于 10 月 1 日以 Clef 和 Clef-flash 回应,这是开源权重的决策模型,也能处理图像和视频,支持 64000 上下文窗口,The Register 报道。Cloudflare 表示 Clef 每百万 token 成本 0.24 美元,几乎是 Jev 价格的六倍。The Register 指出,该公司自报其基准分数,这些分数尚未在官方 Decision Index 上复现。

谷歌于 9 月 30 日发布的 Gemini 4 Argon 正被限制在公司 Fairwind 计划下的一小群经过审核的网络安全的合作伙伴中。“在这个级别安全发布前沿能力需要分阶段的方法,”谷歌首席 AI 架构师 Koray Kavukcuoglu 在 The Guardian 引用的博客文章写道。TechCrunch 报道,谷歌声称 Argon 在多个基准测试中击败了 OpenAI 的 GPT-6 Astra 以及 Anthropic 的 Fable 和 Opus 模型,引用了初创公司 Vals。

在版权方面,据 The Guardian 报道的提交文件,Anthropic 敦促澳大利亚政府考虑在退出模式下对澳大利亚版权作品进行“有条件批准”训练。ABC 和 SBS 提出反对,ABC 警告“澳大利亚新闻行业的蚕食”,并呼吁 AI 公司面临与媒体机构相同的版权、诽谤和隐私规则。

CNBC 报道,OpenAI 表示它破坏了一项始于 7 月初的“对抗性蒸馏”活动,该活动在两天内达到高峰,来自超过 4000 名用户的 16000 个请求,并将核心集群归因于与中国 Moonshot AI 相关的人员。The Register 指出,OpenAI 未说明其哪些模型受到针对,且 Moonshot 未回应置评请求。

评论 0

资料来源

12
  1. 01The NHL Is Releasing Its Own 'Hot' Fanfic. Romance Lovers Hate ItEN
  2. 02Ideogram says its new model can edit part of an image without messing up the restEN
  3. 03Nearly half of test subjects mistook Tavus' AI video avatar for a real person on a one-minute callEN
  4. 04Microsoft AI releases new transcription and text-to-speech models for voice agentsEN
  5. 05Amazon releases its own Jev clone as decision models flood the webEN
  6. 06TypeSafe AI Releases Jev: A Decision-Only Model That Returns Typed Probabilities Instead of TextEN
  7. 07Cloudflare tries to outplay Jev with open-weight Clef modelsEN
  8. 08Google rolls out new Gemini AI model but restricts access over safety concernsEN
  9. 09Google releases Gemini 4 Argon, called its most powerful model yetEN
  10. 10Anthropic pushes for opt-out model for Australian content as ABC warns of 'cannibalisation' of newsEN
  11. 11AI race heats up as OpenAI flags alleged model-copying campaignEN
  12. 12Irony alert: OpenAI whines that Chinese model stole its special IP that it stole from everybody elseEN

本文所有数字与引语均来自下列来源,未添加来源之外的内容。

本内容由编辑部在人工智能辅助下制作完成。

王雅琴

王雅琴

人工智能、模型与技术

王雅琴负责FLASH24的人工智能、模型与技术报道,覆盖科技、人工智能与模型、媒体与互联网领域。她习惯直接查阅技术文档、模型卡与官方博客,而非依赖新闻稿,对未经核实的参数和跑分数据一概不放行。每篇报道前,她会逐项核对基准测试结果,对照论文原文与开源代码,确认版本号、数据集和评测条件是否一致。她常联系开发者与研究人员求证细节,也盯着各大厂商的发布会和论文截稿日期,横向比较同类模型的实际表现。私下她自建服务、折腾家庭网络,这让她对部署成本和真实算力需求有直观判断。她的原则是:没有可复现来源的数字,不写进稿子。

编辑部 →

评论

0
  1. 还没有评论——来说两句吧。

写评论

评论公开展示。我们不发布辱骂、垃圾信息和广告内容。