← 全部日报

AIGC 信息日报

2026 年 8 月 25 日 周二

行业与平台

Industry

阿里云 Wan3.0 上线 NadouPro,支持 30 秒原生视频

阿里云 Wan3.0 上线 NadouPro,支持原生 30 秒视频生成、现实级渲染,并新增 Omni-Reference 多模态参考,除文本、图像、音频、视频外,还可输入文档、表格、幻灯片和网页。已开放 Model Studio 与 Qwen Cloud 的 API 接入。对 AI 编导和短剧团队来说,30 秒原生时长意味着单镜头叙事和长镜头调度有了更大空间,多模态参考则能直接提升角色和场景一致性。

视频生成长度直接拉到 30 秒原生,还支持文档、表格、网页等多模态参考,做短剧和长镜头的可以接 API 实测出片稳定性和真实感。

点击打开原文,能否访问取决于网络环境

ElevenLabs CLI v1 发布,API 全进终端

ElevenLabs 发布 CLI v1,将整个 ElevenLabs API 带入终端,开发者可在命令行直接调用语音合成、克隆、转写等全部能力,便于脚本化批量处理。对后期和短剧团队来说,这意味着配音、字幕、音效生成可以串进自动化流程,批量出片效率更高。

做后期和短剧的可以把配音、转写、音效生成全塞进命令行脚本,批量处理不用再开网页,适合搭自动化工作流的团队。

点击打开原文,能否访问取决于网络环境

腾讯上线 OnSolo,面向海外独立创作者的 AI 漫剧一站式工具

腾讯新上线 OnSolo,定位面向海外独立创作者的 AI 原生一站式工具,覆盖短剧、漫剧、动画、互动影游(FMV),支持从一句话灵感直接生成剧本到成片。与面向机构的 WorkRally 共用技术底座,但做了轻量化处理,去掉团队协作和复杂资产管理,主打个人创作者使用,强调角色一致性稳定,无需切换多个工具。

腾讯面向海外独立创作者的新工具,短剧、漫剧、动画、互动影游全覆盖,一句话灵感直接到成片,做漫剧和短剧的个人创作者可以上手试一周,看角色一致性和出片效率。

点击打开原平台查看,能否访问取决于网络环境

Nvidia 洽谈超 300 亿美元估值投资 Perplexity

Nvidia 正洽谈以超 300 亿美元估值投资 AI 搜索公司 Perplexity,较一年前上一轮融资高出逾 50%。Perplexity 年化收入已从 2.5 亿美元增至逾 7.5 亿美元,部分受 AI 智能体"Perplexity Computer"推动,累计融资超 17 亿美元,CEO Aravind Srinivas 正考虑约 2028 年 IPO。

行业资本动态,AI 搜索公司估值一年涨超 50%,对创作工作流影响小,制片人可扫一眼了解资本风向。

点击打开原文

MiniMax M3 与 M2.7 在 GMI Cloud 限时开放

MiniMax 官方宣布 8 月 24 日至 9 月 6 日期间,在 GMI Cloud 平台开放 M3 和 M2.7 模型的无限量使用,同时包含 Speech 2.8 和 Music 3.0。这是限时免费活动,适合创作者在此期间集中测试模型能力或进行批量生成。

做 AI 短剧和视觉的可以趁这两周在 GMI Cloud 白嫖 M3 和 M2.7,跑批量生成和测试工作流,省一笔算力钱。

点击打开原文,能否访问取决于网络环境

Runway 9月30日旧金山黑客松,用API做Agent或创意工作流

Runway 官方宣布将于 9 月 30 日在旧金山 Masonic 举办线下黑客松,与 Runway AI Summit 同期。活动主题是用 Runway API 构建 Agent、应用或创意工作流,为期一天,要求提交可运行的 demo,不设 pitch 环节。

Runway 官方线下黑客松,9月30日旧金山,跟 AI Summit 同场。做工具链整合的可以关注,现场能直接拿 API 搭 Agent 或创意工作流,有 demo 就能去。

点击打开原平台查看,能否访问取决于网络环境

Krea 官方预告全新版本周四纽约发布

Krea 官方账号转发预告,称全新版本即将到来,将于本周四在纽约线下展示所有新功能,并开放私信报名参与。属于发布前预热。

Krea 官方放风要发新版,周四纽约线下演示,做视觉和工具整合的可以蹲一下看有没有新能力。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

MiniMax H3 Max 上线 Magnific,5 秒 480p 片段 5 秒内生成

MiniMax H3 同日在 2 个第三方平台上线可用:Magnific / Max。

MiniMax H3 当天在这 2 个平台都能用上,按手上已开通的账号挑一个直接测,不用等单一渠道。

点击打开原平台查看,能否访问取决于网络环境

OpenRouter 开放图像生成 API

OpenRouter 宣布开放图像生成 API,开发者可通过统一接口调用多家图像生成模型,无需分别对接各家服务。具体支持哪些模型、定价和调用方式需查看官方公告原文。

OpenRouter 开放图像生成 API,做视觉和短剧的可以接进现有工作流,统一调度多家模型,省去来回切换的麻烦。

点击打开原文,能否访问取决于网络环境

Google Flow 音乐翻唱功能升级,接入 Lyria 3.5

Google Flow 官方宣布其最受欢迎的翻唱(Covers)功能升级,接入最新音乐模型 Lyria 3.5。用户可让 Producer agent 对自己创作的歌曲生成翻唱版本,官方邀请用户测试反馈。

做 AI 音乐、配乐和翻唱的后期团队可以试试,让 Producer agent 直接翻唱你做的歌,省掉重新编曲的功夫。

Grok Build 新增 Browser Use 插件,可访问真实浏览器

SpaceXAI 为 Grok Build 推出 Browser Use 插件,赋予 Grok 访问真实浏览器的能力,支持用户自有 Chrome(含现有登录态)或隔离的 Browser Use 云浏览器。对 AIGC 创作者来说,这意味着可以自动化完成素材采集、参考信息抓取、批量数据整理等重复性工作,减少手动切换浏览器的时间成本。

做 AI 短剧和内容整合的可以关注:Grok 能直接操作浏览器了,自动化采集素材、批量抓取参考、跑数据的工作流能省不少手动步骤。

点击打开原平台查看,能否访问取决于网络环境

GPT-5.6 上线 Kiro,主打开发者性价比

OpenAI 官方宣布 GPT-5.6 现已上线 Kiro,面向开发者提供规划、构建、审查、测试软件的能力,主打更好的性价比。这是 Kiro 产品的模型升级,非全新发布。对 AIGC 创作者而言,若其工作流依赖 Kiro 进行自动化脚本或媒体处理,可关注其 API 接入与成本变化。

OpenAI 把 GPT-5.6 塞进 Kiro,主打开发性价比。对创作者来说,如果 Kiro 能串进自动化剪辑或批量生成流程,可以接 API 试一周;纯做内容的不必专门关注。

ChatGPT 移动端上线后台对话功能

ChatGPT 移动应用新增后台对话功能,开启后即使切换其他应用或手机锁屏也能继续聊天。用户 Derrick Choi 还演示了将 iPhone 锁屏小部件改为直接启动语音聊天的用法。该功能面向移动端使用场景,属于通用 AI 助手能力更新,不涉及视频生成或创作工具链。

ChatGPT 移动端新增后台对话,锁屏也能继续语音聊天,做 AI 配音或虚拟角色对话的可以顺手接上,但属于通用功能更新,对创作工作流影响有限。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

中国短剧团队薅韩国AI视频站羊毛,自动化生产经验曝光

韩国AI视频聚合网站被中国短剧团队用程序自动化薅羊毛,损失几十万人民币,提示词、参考图、生成结果自动分享到社区。该团队采用工厂化作业:单次生成即达90%一致性,提示词聚焦最小化重抽和后期剪辑成本;故意破坏角色参考图面部区域以过人脸;将光影与材质比例(金属高光×1.5、皮肤×0.5、布料×0.3)作为锁定画面质感最高优先级;纯文本固定起始结束画面状态实现链式自动传递;以配音驱动叙事节奏,音色性格绑定角色为常量、状态语调为变量。

一线AI自动化短剧实战拆解,从提示词结构到角色一致性、光影锁定、配音驱动节奏,做短剧的可以直接抄这套工厂化作业思路。

点击打开原文,能否访问取决于网络环境

NVIDIA Sol Engine 优化 MiniMax H3 生成提速 27 倍

NVIDIA SANA 团队针对 MiniMax H3 官方介绍 Sol Engine 优化方案:将生成拆分为 4 步低分辨率 H3 草稿 + 3 步 LTX 目标分辨率精修,配合 Sol-Attn 注意力机制,在单张 GB200 上把 10 秒 768p 视频生成延迟从 414 秒降至 14.93 秒,提速约 27 倍。

NVIDIA 团队把 H3 生成从 414 秒压到 14.93 秒,单卡 GB200 跑 768p 视频。做短剧批量出片的可以关注,这速度意味着废片重跑成本大幅下降。该产品的发布我们已在 2026-08-01 报过,这条是官方对已有能力的介绍,不是新上线。

点击打开原文,能否访问取决于网络环境

Magnific 用 Wan 3.0 拍短片:模型稳住镜头,前期定成败

Magnific 官方发布用 Wan 3.0 制作的短片,题材为母子相隔十五年的故事。官方复盘强调模型能稳定完成镜头(the model held the take),但成片质量取决于前期筹备(pre-production held the film)。

官方复盘用 Wan 3.0 拍短片,核心观点是模型能稳住镜头、但成片靠前期筹备。做 AI 短剧的可以拉片看他们怎么用分镜和前期设计兜住模型的不确定性。

点击打开原文,能否访问取决于网络环境

Pika 实测 WAN 3.0 与 Seedance 2.5 同题香水广告对比

Pika 官方账号发布对比实测:用完全相同的输入,分别用 WAN 3.0 和 Seedance 2.5 生成同一支香水广告,产出两支接近成片级别的广告。对比聚焦两个模型在相同提示词下的出片差异,可直接观察两家在广告类场景的镜头语言、光影质感和产品表现力上的处理风格。

同一支香水广告脚本喂给两个模型,看谁出片更接近成片。做广告和短剧的可以拉片对比两家在镜头语言和质感上的差异。

点击打开原平台查看,能否访问取决于网络环境

中国团队用分辨率指令解决 AI 视频首帧变形

针对 AI 视频拼接时首帧微变形、无法自然衔接的问题,中国制作团队采用在 prompt 中指定非标准分辨率(1920x1088 而非 1920x1080)的方式解决。该方法通过微调分辨率参数,减少生成时首帧的细微变形,使两段视频衔接更自然。

做 AI 视频拼接的后期和短剧团队可以记下这个小技巧:首帧对不齐时,在 prompt 里把分辨率从 1920x1080 改成 1920x1088,实测能减少微变形。

点击打开原平台查看,能否访问取决于网络环境

Kling 官方整理 10 个摄影构图技巧

Kling AI 官方博客发布《10 Cinematography Techniques Every Creator Should Know》,从叙事出发讲解构图、镜头、光线、焦点、运动、曝光等基础技巧,强调先定故事再选设备,用框架引导观众注意力。

官方出的摄影基础课,从叙事出发讲构图、镜头、光线怎么选,编导和视觉师可以当分镜参考,短剧团队也能套用。

点击打开原文

Seedance 角色表叠几何网格减少虚假 Face ID

创作者 Ragù 分享 Seedance 角色一致性技巧:在虚构角色的角色表每张脸上叠加几何网格,可减少虚假 Face ID/年龄标记,同时保留结构和一致性,从而减少废片和积分浪费。

做 AI 电影和短剧的可以试一下:角色表每张脸上叠个几何网格,能压住虚假 Face ID/年龄标记,少废片少烧积分,成本敏感团队值得跑一遍。

点击打开原文,能否访问取决于网络环境

创作者实测 WAN 3.0:30 秒原生生成撑起纪录片式长镜头

创作者 @D_studioproject 用 WAN 3.0 测试纪录片风格作品,关注点不在炫技,而在能否维持克制的镜头运动、细微表演和自然质感。关键能力是 30 秒原生生成 + 更强一致性 + 1080p 输出,可在单次生成中构建完整场景,而非围绕短片段设计。该作品通过 Pika API Club 运行 WAN 3.0,作者称该平台运行成本更低。

用 WAN 3.0 实测纪录片风格,核心是 30 秒原生生成 + 更强一致性 + 1080p,一次生成就能搭完整场景,做长叙事和安静镜头的编导可以看看这个思路。

点击打开原平台查看,能否访问取决于网络环境

单张照片翻新房间:GPT Image 2 配 Seedance 2.0 工作流

创作者 AndyAI 分享一条工作流:用 GPT Image 2 将一张老旧待修房间的照片改造成翻新后的效果,再用 Seedance 2.0 生成新房间的电影感漫游镜头,包含前后对比。整个流程由单一工作流全流程完成,适合室内设计可视化、房产展示等场景。

一条把图像生成和视频生成串起来的工作流,做室内设计可视化或产品展示的可以拆开看前后对比和镜头漫游怎么接。

点击打开原平台查看,能否访问取决于网络环境

Kling 官方分享 24 个可落地的短片创意

Kling AI 官方博客发布《24 Short Film Ideas You Can Actually Make》,核心思路是短片创意应基于已有资源(场景、演员、道具、时间)来设计,强调单一核心情境、小卡司、少场景,并给出选题前的自检清单(能否一两句话讲清、是否有现成主场景、是否有一个反转或揭示、结尾能否用画面呈现而非解释)。文章还引用奥斯卡对短片「40 分钟以内」的定义作为参考。

Kling 官方整理的短片选题清单,核心是「用你手头就有的场景、演员、道具拍完」,对预算紧的编导和短剧团队是现成的选题库,挑几个能套进自己工作流的直接用。

点击打开原文

作品与案例

Works

Higgsfield 开源 AI 动画短片,公开全部提示词与素材

Higgsfield 官方发布 AI 动画短片《If You Stop Loving Me, I'll Die》,作为其百万美元全球电影节参赛作品,现已上线并开源全部提示词与素材。短片聚焦 AI 动画中的喜剧表演与节奏控制,是官方示范级案例,可直接拆解学习。

官方开源短片《If You Stop Loving Me, I'll Die》,提示词和素材全公开,做 AI 动画的可以直接拆解喜剧节奏和角色表演怎么用提示词控出来。

点击打开原平台查看,能否访问取决于网络环境

Pika 展示 WAN 3.0 生成 30 秒短片

Pika 官方账号发布一段由 WAN 3.0 生成的 30 秒短片,强调环境质感、角色一致性以及克制的表演呈现。该片段展示了 WAN 3.0 在单次生成中兼顾场景与人物表现的能力。

Pika 官方用 WAN 3.0 生成的一段 30 秒短片,主打环境质感、角色一致性和克制的表演。做 AI 短片的可以点开看下 WAN 3.0 的实际出片水平,重点看角色一致性保持得怎么样。

点击打开原平台查看,能否访问取决于网络环境

AI 短剧《雷斯》第四集上线,OiiOii 平台制作

B 站 AI 短剧系列《雷斯》第四集,由 OiiOii 平台制作,监制徐Toso、动画导演巴巴Boyei、AIGC 生成师旁可PANKO、编剧皓天斯威特。系列围绕角色性别转换的喜剧设定展开,本集雷斯变成御姐。

B 站 AI 短剧系列第四集,用 OiiOii 平台做的,做 AI 短剧的可以拉片看角色一致性和连续叙事怎么处理。

点击打开原平台查看

小红书联动四川博物院推出典藏文物手册

创作者受小红书官方邀请,联动四川博物院制作典藏文物手册,将经典文物收录进 7 本书中,展示包含翻页和 3D 粒子动效,主打沉浸式呈现中华文化之美。

官方合作的文化向 AI 视觉作品,翻页和 3D 粒子动效是看点,做文化类视觉和 KV 的可以拉片看动效和文物呈现方式。

点击打开原平台查看,能否访问取决于网络环境

AI 短剧《这个天师明明超强》第八集日常篇上线

B 站 AI 短剧《这个天师明明超强 却只想躺平》第八集,日常篇,陆明相亲剧情,接第四集剧情,第三个单元剧本仍在创作中,片尾附小剧场。

AI 短剧系列更新,日常篇接第四集剧情,做短剧的可以拉片看系列叙事衔接和日常戏的处理。

点击打开原平台查看

AI 短剧《荣老板翻局篇》更新:红烧肉价格战剧情

B 站作者「墨八分钱」的 AI 短剧《荣老板翻局篇》第十二集,商战题材,讲述对面饭店红烧肉半价竞争、荣老板不降价反而卖两轮的剧情。个人创作者作品,短剧系列连载中。

AI 短剧系列新一集,商战题材,做短剧的可以拉片看剧情节奏和角色一致性处理。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索