NHL 转向言情有声书,AI 视频生成器追逐同样的注意力
本周,国家冰球联盟(NHL)开始推出言情风格的音频短片。这场营销活动遭到该类型一些畅销书作家的强烈反对,与此同时,AI 视频生成器仍在不断增多。

本周,国家冰球联盟(NHL)开始发布关于其球员的短篇言情风格音频故事。一些被联系的作家公开拒绝参与。WIRED 于周五报道了首批内容,这是名为“Hot for Hockey”活动的一部分。该联盟联系了流行的冰球言情作家,为有声书平台撰写并朗读 60 至 90 秒的内容。
这些故事并非言情作品。它们读起来像是旨在销售门票的封底简介。
WIRED 引用了一篇标题为《我随特雷弗·泽格拉斯变得坚韧的那个夏天》的完整文本:“特雷弗·泽格拉斯来到费城,寻求新的开始。但在去年季后赛与匹兹堡激战后,他发现了事情可以变得多么坚韧。经过一个炎热的夏天,费城的帅哥看起来更加坚韧了。”据 WIRED 报道,首批内容还包括卡罗莱纳飓风队的塞巴斯蒂安·阿霍和维加斯金骑士队的杰克·艾歇尔,由《Pucking Wrong》的作者 C.R. Jane 撰写。
并非该类型的所有人都觉得有趣。畅销冰球言情小说作家艾米丽·拉思在 Threads 上表示,联盟曾联系她,她“从未这么快拒绝过提议”,WIRED 报道。拉思称,该活动的幻灯片包含她认为是对该类型的嘲笑的玩笑,以及她声称的 AI 封面渲染图。《D.C. Stars》系列的作者切尔西·库尔托也指出了 AI 图形问题,她写道,她拒绝参与可能最好,因为她的书“可能会严厉批评联盟”。
NHL 发言人乔恩·韦因斯坦告诉 WIRED,该活动是“对当前文化潮流中明显存在之事的俏皮致敬”。他表示,联盟“非常自豪能与该领域的真实冰球作家、插画家和配音演员合作”。
视觉端持续演进
NHL 的故事是一个有用的提醒:AI 生成或 AI 辅助内容如今已成为大型组织营销的常规部分,且受众注意到了这一点。在模型方面,过去一周产生了一系列旨在用于视频和图像工作的发布。
Ideogram 于 10 月 1 日表示,其新的 Ideogram 4.5 模型可以编辑图像的一部分而不改变其余部分。该公司称,GPT-Image 2.5 和 Nano Banana 等领先模型在多次编辑后仍会出现伪影问题。The Decoder 报道,该模型以四种质量等级推出,原生 2K 分辨率下每张图片价格为 0.8 至 22 美分,现已在 Ideogram 平台及其 API 上可用,合作伙伴包括 Picsart、Runway、Pika 和 Leonardo AI。开源权重版本即将发布。
与此同时,Tavus 推出了 Griffin,称之为第一个“人类交互模型”。该系统在处理视频的同时,接收并生成语音、面部表情、语调、手势和停顿。据 The Decoder 报道,在 Tavus 的一项研究中,48% 的参与者在一次一分钟后认为 Griffin 是真人,而此前最高比例为 2%。在 Tavus 描述为独立的 Nvidia 测试中,该测试衡量 AI 在直接音视频对话中给人的真实感,Griffin 得分为 3.83 分,实际人类为 3.92 分,此前最佳 AI 模型为 2.80 分。
据 The Decoder 报道,名为 Griffin-Lite 的预览版向“选定测试者作为研究预览”开放,完整版本承诺在“解决安全顾虑后”推出。Tavus 列举了辅导、练习艰难对话和基于摄像头的技术支持作为可能用途。
语音和决策模型在同一窗口期到来
微软 AI 于 10 月 2 日推出了新的语音模型。据 The Decoder 报道,MAI-Transcribe-2-Streaming 转录 60 种语言,并在仅 100 多毫秒内返回首批部分结果,微软称这能让语音代理在说话人还在句中时做出反应。通过年底的入门价,一小时音频成本为 0.54 美元。两个新的文本转语音模型 MAI-Voice-2.1 和 MAI-Voice-2.1-Flash 以相同声音覆盖 23 种语言,Flash 变体延迟为 150 毫秒,每百万字符 15 美元,而非 22 美元。两者都可以从几秒钟的参考音频中克隆声音。The Decoder 引用的一项测试显示,约 4000 名参与者中的一半认为这些声音属于真人。
决策模型也在迎来自己的时刻。亚马逊云科技(AWS)于 10 月 1 日发布了 Strands Decider 2B,这是一款开源模型,它在预设选项之间进行排序并返回置信度度量,TechCrunch 报道。它由杰出工程师 Marc Brooker 在看到 TypeSafe 的 Jev 后构建,并曾短暂占据该规模模型的 Jevbench 排名榜首。“最初引起我对这类模型兴趣的是,它们可以作为工作流步骤的完美决策者,”Brooker 告诉 TechCrunch。
据 InfoQ 报道,TypeSafe 自己的 Jev 于 10 月 1 日发布,它返回类型化概率决策而非文本,每百万输入 token 0.042 美元,输出免费,32000 token 上下文窗口,引用的端到端延迟为 70ms 至 500ms。Vercel 工程师 Pranit Sharma 发现,安全分类器比其替换的 LLM 快 5 到 18 倍。OpenChamber 对 12759 条发布推文的分析显示,用户报告的速度提升中位数为 7 倍,而标题为 193.6 倍,成本节省中位数为 30 倍,延迟中位数为 76ms。
Cloudflare 于 10 月 1 日以 Clef 和 Clef-flash 回应,这是开源权重的决策模型,也能处理图像和视频,支持 64000 上下文窗口,The Register 报道。Cloudflare 表示 Clef 每百万 token 成本 0.24 美元,几乎是 Jev 价格的六倍。The Register 指出,该公司自报其基准分数,这些分数尚未在官方 Decision Index 上复现。
谷歌于 9 月 30 日发布的 Gemini 4 Argon 正被限制在公司 Fairwind 计划下的一小群经过审核的网络安全的合作伙伴中。“在这个级别安全发布前沿能力需要分阶段的方法,”谷歌首席 AI 架构师 Koray Kavukcuoglu 在 The Guardian 引用的博客文章写道。TechCrunch 报道,谷歌声称 Argon 在多个基准测试中击败了 OpenAI 的 GPT-6 Astra 以及 Anthropic 的 Fable 和 Opus 模型,引用了初创公司 Vals。
在版权方面,据 The Guardian 报道的提交文件,Anthropic 敦促澳大利亚政府考虑在退出模式下对澳大利亚版权作品进行“有条件批准”训练。ABC 和 SBS 提出反对,ABC 警告“澳大利亚新闻行业的蚕食”,并呼吁 AI 公司面临与媒体机构相同的版权、诽谤和隐私规则。
CNBC 报道,OpenAI 表示它破坏了一项始于 7 月初的“对抗性蒸馏”活动,该活动在两天内达到高峰,来自超过 4000 名用户的 16000 个请求,并将核心集群归因于与中国 Moonshot AI 相关的人员。The Register 指出,OpenAI 未说明其哪些模型受到针对,且 Moonshot 未回应置评请求。
资料来源
12- 01The NHL Is Releasing Its Own 'Hot' Fanfic. Romance Lovers Hate ItEN
- 02Ideogram says its new model can edit part of an image without messing up the restEN
- 03Nearly half of test subjects mistook Tavus' AI video avatar for a real person on a one-minute callEN
- 04Microsoft AI releases new transcription and text-to-speech models for voice agentsEN
- 05Amazon releases its own Jev clone as decision models flood the webEN
- 06TypeSafe AI Releases Jev: A Decision-Only Model That Returns Typed Probabilities Instead of TextEN
- 07Cloudflare tries to outplay Jev with open-weight Clef modelsEN
- 08Google rolls out new Gemini AI model but restricts access over safety concernsEN
- 09Google releases Gemini 4 Argon, called its most powerful model yetEN
- 10Anthropic pushes for opt-out model for Australian content as ABC warns of 'cannibalisation' of newsEN
- 11AI race heats up as OpenAI flags alleged model-copying campaignEN
- 12Irony alert: OpenAI whines that Chinese model stole its special IP that it stole from everybody elseEN
本文所有数字与引语均来自下列来源,未添加来源之外的内容。
本内容由编辑部在人工智能辅助下制作完成。
评论
0- 还没有评论——来说两句吧。