Qwen 发布新一代实时同声传译模型 Qwen3.8-LiveTranslate,基于 Interleave 架构,在 60 种语言上把平均延迟(LAAL)从 2.8 秒降到 2.3 秒,同时提升忠实度、流畅度和简洁性。新增三项能力:实时说话人区分,可在多人对话中分辨说话人并通过更稳定的音色克隆保留各自声音;双语同步显示,原文与译文同屏;长上下文消歧,借助对话历史澄清人名和术语,保证译名一致。已上线 QwenCloud,模型名为 qwen3.8-livetranslate-flash-realtime,官方博客同步放出。
为什么值得看:60 种语言平均延迟从 2.8 秒压到 2.3 秒,还带说话人区分和音色克隆,做海外短剧配音、访谈字幕、直播同传的可以接 API 跑一周看延迟稳不稳。
Runway 创始人 Cristóbal Valenzuela 列出公司过去 18 天发布的项目:Runway Ruby、Runway Dev MCP、Solaris、GWM Worlds 2、Team Plan、Adobe 插件、Model Licensing、Enhance Frame Rate,以及 Ruby 的 Alpha 通道支持。这是一份官方口径的更新汇总,覆盖模型、开发接口、插件和后期功能多个方向。
为什么值得看:Runway 创始人自己列的 18 天更新清单,Ruby、Dev MCP、Solaris、Adobe 插件、帧率增强都在里面,做后期的可以对着清单查自己漏了哪个。
Pika 官方账号宣布推出全新 Pika,定位为「由创意人士打造、为创意人士服务」的 AI 创意平台,官方描述其特点是简单、全面,并强调输出质量面向严苛标准,同时表示这只是其创意工作 AI 布局的开始。该条推文未给出具体功能、模型版本或上线时间等细节。
为什么值得看:Pika 官方宣布把产品重做成面向创意人的 AI 创作平台,但这条只有定位口号、没有具体功能参数,做视频的可以先记一笔,等官方放出实际能力再上手测。
Runway 上线 Fall 2026 模型合集,官方称是其规模最大的一次模型更新,新增 Fish Audio S2.1 Pro、MiniMax H3 Max、Cartesia Sonic 3.6、Flux Video 放大与编辑,与 Runway 自有模型及其他前沿实验室模型并列可用。音频、视频生成、放大、编辑集中在同一平台内调用。
为什么值得看:Runway 一口气把 Fish Audio S2.1 Pro、MiniMax H3 Max、Cartesia Sonic 3.6 和 Flux 视频放大/编辑塞进同一个平台,做后期和短剧的可以上去跑一遍,看配音、放大、剪辑能不能省掉来回切工具。
作者澜森公开了一段 25 秒纯享版武学招式视频的完整提示词:先锁定丐帮高手的外观、年龄、脸型、胡须、发型、破旧布衣、腰间葫芦、竹杖与整体气质,特效指定为金色、丝缕流动、半透明的东方龙能量质感,并可按秒拆解动作——0-3 秒踏地起势、3-7 秒连招加龙形掌力环绕、7-12 秒腾空隔空连发、12-17 秒高速连招。风格要求顶级真人电影感仙侠武侠,明确排除低质游戏光效、廉价粒子和塑料 CG。
为什么值得看:一份把「丐帮宗师打降龙十八掌」拆到秒的提示词,从角色锁定、金色龙形掌气质感,到 0-17 秒每一段的动作节奏和镜头运动都写死了。做武侠仙侠短片的编导和视觉师可以照着改自己的招式段落。
创作者用 PixVerse 做了一组对照测试:同一模型、同一提示词、同一图像参考下,分别生成「Detailed」和「Super Simple」两版,成片用三个镜头节拍——居中推近、跟随取耳机动作的侧面特写、回到正面拉出。作者先修正了场景本身:早期布景把拥挤的火车处理成一排安静坐着的人,角色行为也过于刻意,于是把动作改成从包里取出耳机而非开场就拿着。结论是细节版动作更僵硬,但作者明确表示这不能证明细节本身导致僵硬,也不代表简单版总是更好。
为什么值得看:作者用同一模型、同一提示词、同一参考图跑出「细节版」和「极简版」两版,发现细节多的那版动作反而更僵硬。做 AI 短片调表演的可以拉片看这个对比。
Meshy 官方展示了一个把《奥德赛》场景装进宝箱的完整案例,流程分三步:先用 GPT-6 Astra 配合 Meshy 生成概念图,再用 Meshy 把概念图转成 3D 模型,最后用 Astra 加 Blender 给场景做动画。这条演示的是概念图到 3D 资产的转换流程,适合做 3D 场景、道具和空间设计的创作者参考。
为什么值得看:Meshy 官方演示了一条从概念图到 3D 模型再到动画的完整流程,做 3D 场景和道具的视觉师可以看看这套串法。
Derrick Choi 用 Astra 制作了一支 87 秒的摩纳哥大奖赛最后一圈影片,包含全部 22 辆 F1 赛车,渲染 2610 帧、4K 30fps。Codex 负责编写构建和动画化 Blender 场景的脚本,并用 Python 生成原创立体声音轨,覆盖引擎转速、换挡、超车和隧道混响,作者提到使用了 High reasoning 模式。
为什么值得看:87 秒、22 辆 F1、2610 帧 4K 30fps,Blender 场景搭建和动画全靠 Codex 写脚本,连引擎转速、换挡、隧道混响的立体声也是 Python 生成的。做三维动画和后期声音的可以拆一下这套自动化流程。
B 站 UP 主「荀洛今天也要努力作人」投稿的 AI 动画短片《全球人类变成自己XP的样子》上集,为 HiShorts! × updream AI 短片大赛动画单元参赛作品,题材为脑洞设定向。
为什么值得看:HiShorts! 与 updream 合办的 AI 短片大赛动画单元参赛作品,题材走脑洞向,做 AI 动画和短片参赛的可以拉片看它的设定呈现方式。
B站 UP 主发布的 AI 复刻长篇,融合正剧《地中鲨鱼》与《影的继承人》两集剧情,配双语字幕。邪恶迪迦娘德语台词选自尼采《查拉图斯特拉如是说》前言,配乐按段落调度:索尔蒂版瓦格纳《纽伦堡的名歌手》用于登场段落,坂本龙一《Dream》配午夜游乐园对白,Toby Fox《Undertale》原声配地下遗迹对白,Boards of Canada《Beware The Friendly Stranger》配林中片段。
为什么值得看:个人创作者把《地中鲨鱼》和《影的继承人》两集剧情揉成一部长篇,德语台词直接引尼采原文,配乐从瓦格纳排到坂本龙一。做 AI 长叙事的可以拉片看它怎么用配乐切段落。
B 站热门 AI 短片《人生反悔局》,主题是当代人的选择焦虑与后悔内耗:主人公从高考志愿开始反复反悔——改专业、辞工作、退房子、回头找初恋,每次回到过去都不带现在的记忆,人生仍按他自己的性格和处境重新展开,躲开土木却撞上 AI 裁员,逃过房贷却困在出租屋。叙事靠「反悔—重来」的循环结构推进,适合编导拆解其重复叙事与情绪递进的处理方式。
为什么值得看:一部把「如果当初」拍成循环叙事的 AI 短片,主人公从高考志愿一路反悔到初恋,做 AI 短剧的可以拉片看它怎么用重复结构撑起情绪。
X 用户 @L0vetodream 转载 B 站 FreeFromStudio 的 iPhone Duo 概念宣传片,片中旁白由 AI 模仿 Jony Ive 的声音完成,配文称「这下味道就对了」。作品属概念广告向短片,看点集中在 AI 语音克隆对特定人物口音、停顿和语调的还原度。做 AI 配音、虚拟代言和仿品牌广告的可以拉片听一遍语气处理。
为什么值得看:用 AI 复刻 Jony Ive 的英式旁白腔调给假想产品配宣传片,做 AI 配音和仿品牌广告的可以拉一遍听语气节奏。