← 全部日报

AIGC 信息日报

2026 年 7 月 21 日 周二

行业与平台

Industry

《第九区》导演Neill Blomkamp发布首部完全由AI…

《第九区》导演 Neill Blomkamp 发布 13 分钟科幻恐怖短片《Nightborne》,完全使用 Seedance 2.0 视频生成模型通过文本提示逐帧创作。影片采用纪录片风格,使用了 32 位真实人物的面部和声音(已获授权),人类艺术家负责概念艺术。Blomkamp 表示计划以相同格式拍摄一部长片,并已创立 AI 电影工作室 Barley Studios。

《第九区》导演用 Seedance 2.0 逐帧文本提示做了部 13 分钟科幻恐怖短片,32 位真人授权面部和声音。做 AI 长片和短剧的可以拉片看导演级叙事怎么用纯文本提示撑住 13 分钟,以及真人授权+AI 生成的面部一致性怎么处理。

点击打开原平台查看,能否访问取决于网络环境

昆仑万维发布并开源可交互世界模型 Matrix-Game 3…

昆仑万维在 WAIC 2026 发布并开源可交互世界模型 Matrix-Game 3.5,核心能力包括 Patch Memory 长期记忆与 Warped PRoPE 几何一致性建模,可在单张 GPU 上以 720P 分辨率、约 20FPS 实时生成流式视频。模型已开源,适合需要实时交互式场景生成和长镜头一致性控制的创作场景。

国产可交互世界模型开源,单卡跑 720P 实时流式视频,做 AI 短剧和视觉开发的可以拉下来跑跑看场景一致性表现。

点击打开原文

字节跳动发布 Seed Audio 1.0 音频创作模型:支…

字节跳动 Seed 官方发布音频创作模型 Seed Audio 1.0,在统一框架下联合建模人声、音效和环境声,支持按时间线精准控制声音进场。该模型支持 20+ 语种音频生成,在文本生成音色能力的 AB 主观评测中表现出显著优势,多数场景音频可用率达 90% 以上。目前已在火山方舟体验中心上线。

字节官方发布音频创作模型,支持按时间线精准控制人声、音效和环境声进场,20+语种生成,多数场景音频可用率90%以上。做AI配音、音效设计、后期声音的可以直接上火山方舟体验中心试一轮,看时间线控制精度和语种覆盖能不能替代现有方案。

点击打开原文

Here are the 30,000 songs Sony…

索尼音乐娱乐在纽约法院对 AI 音乐生成器 Udio 提起新诉讼,指控其侵犯超过 3 万首歌曲版权,曲库涵盖猫王《Hound Dog》、碧昂丝《Say My Name》、哈利·斯泰尔斯《As It Was》等。这是继唱片公司起诉 Suno 和 Udio 之后,又一起针对 AI 音乐生成领域的重大版权诉讼。

索尼把 Udio 告了,涉及 3 万首歌的版权,从猫王到碧昂丝。做 AI 音乐和配音的后期团队得关注这个案子的走向,它直接决定你以后能不能合法用 AI 生成带版权的音乐素材。

点击打开原文

开源世界模型Alaya World重构游戏原型成本

开源世界模型 Alaya World 发布,核心能力是将游戏可玩原型的制作成本从「几周多人团队」压缩到「一张图、一条相机轨迹、几句 prompt、一分钟出场景」。关键技术包括显式 3D 空间缓存、压缩帧历史记忆和 Error Bank 误差回灌——后者故意将积累的伪影回灌训练,让模型学会在「脏历史」上继续正确预测。

开源世界模型,把游戏原型制作成本从几周压到一分钟。做短剧和虚拟场景的可以关注 Error Bank 误差回灌这个技术点——模型在脏历史里还能正确预测,对长镜头一致性有参考价值。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools

OpenRouter 上线 Grok Imagine Vid…

xAI 的 Grok Imagine Video 1.5 模型已上线 OpenRouter 平台,支持图生视频,可附加文字提示控制运动、镜头运作,并内置声音和对话设定氛围与物理效果。创作者可通过 OpenRouter API 直接调用,无需本地部署。

Grok 的视频生成模型上了 OpenRouter,支持图生视频+提示词控制镜头和运动,还能内置声音和对话。做视觉和后期的一键接 API 测出片质感,省掉本地部署的麻烦。

点击打开原文,能否访问取决于网络环境

可灵AI新功能:猫咪换脸互动

可灵 AI 官方发布新功能「猫咪换脸互动」,可将视频中的人脸替换为猫脸,并保留表情和动作。官方演示视频展示了猫咪模仿人类表情的趣味效果。该功能目前已在可灵 AI 平台上线,属于轻量级娱乐化功能,非核心创作工具更新。

可灵给视频加了个猫咪换脸互动玩法,视觉师和后期可以当个趣味素材模板收藏,正经创作管线里用上的概率不大。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

家人们!万众期待的 AI 自动化剪辑教程终于来了! 这条视频…

博主 Foe Ally 发布 AI 自动化剪辑教程,演示用 Codex 全程自动处理口播、录屏等素材,AI 自主完成素材理解、内容筛选、笑点识别、剪辑、字幕、贴图和动画。教程附 GitHub 链接,强调无需提前设计脚本,适合 Vlog 和日常内容批量生产。

Codex 自动化剪辑的实操教程,后期和短剧团队可以直接套工作流跑一遍,看 AI 理解素材和找笑点的能力够不够用。

点击打开原平台查看,能否访问取决于网络环境

The AI Media Report: Cost, Spe…

Runway 发布企业客户纵向研究报告,统计数百家大型企业使用 Runway 进行媒体制作的成本与时间节省数据。核心发现:制作成本下降 2-3 个数量级,时间线同步压缩。案例包括:某全国性金融服务品牌电视广告制作成本从 500 万美元降至 3-4 千美元;某家居零售商 80 万美元视觉项目复制成本低于 1 万美元;某咨询公司 30-60 万美元客户活动在 2 天 RFP 窗口内以约 3 千美元完成。

Runway 官方发布的客户成本对比报告,数据来自真实企业案例。做 AI 短剧和广告的制片人可以拿这些数字去跟甲方谈预算——从 500 万到 3 千、80 万到 1 万,降幅是实打实的行业参考。

点击打开原文

GPT image 2

个人创作者 @underwoodxie96 分享用 GPT Image 2.0 生成角色编辑拼贴的 prompt 示例:要求生成 3:4 竖版、4 格拼贴、同一成年女性角色保持面部结构/妆容/发型一致。推文含 prompt 原文和链接。

个人创作者用 GPT Image 2 做角色一致性拼贴的实测,视觉师可以看 prompt 结构和出片效果,判断能不能套进自己的角色设计流程。

点击打开原文,能否访问取决于网络环境

Kimi 3 3D生成惊艳演示,效果绝佳

Berry Xia 发布多个 Demo,展示 Kimi 3 在 3D 生成方面的效果,推文称“真的很绝”。

Kimi 3 的 3D 生成 demo 效果不错,做视觉和美术的可以点开看看生成质量,判断能不能塞进角色或场景资产管线。

点击打开原文,能否访问取决于网络环境

RT @DreamLabLA: How Encore was…

Jacob Russo 在作品《Encore》中结合真人表演与 AI 生成,形成混合制作工作流。使用 iPhone 拍摄实拍素材,再通过 AI 工具进行后期处理和生成,展示了实拍+AI 的混合制作模式,适合预算有限但追求视觉效果的团队参考。

一个真人表演+AI 的混合制作案例,编导和制片可以看看怎么把实拍和 AI 生成揉进一条片子,省掉纯 CG 的预算和周期。

点击打开原平台查看,能否访问取决于网络环境

用 Blender MCP + GPT 5.6 Sol 做出…

创作者 nicekate 用 Blender MCP 协议连接 GPT 5.6 Sol,通过自然语言提示生成 3D 等距视角风格化场景视频,AI 快速出底稿后通过提示精修细节(如屏幕画面、猫毛发等),音乐后配。制作步骤在回复线程中。

Blender MCP + GPT 5.6 Sol 做 3D 等距场景,AI 出底稿再提示精修,做视觉和美术的可以看线程里的具体步骤,适合想用自然语言驱动 3D 场景生成的创作者。

点击打开原平台查看,能否访问取决于网络环境

想起当年手 k 过这个效果,现在用 GPT 5.6 Sol …

开发者 CatsJuice 用 GPT 5.6 Sol 实现文字动效贴纸生成工具,支持自定义富文本和自定义图像上传,已开源并提供在线体验(sticker.oooo.so)。

用 GPT 5.6 Sol 一句话生成文字动效贴纸,还支持自定义富文本和图像上传,已开源可在线体验。做后期和视觉的可以拿来当模板用,省掉手 K 关键帧的功夫。

点击打开原平台查看,能否访问取决于网络环境

什么是短视频社交的最佳视频编辑智能体?它真的有效吗? 我们观…

作者 ben 开源了一个 AI 视频剪辑 Agent 训练数据集,包含 4 条专业剪辑师在 Adobe Premiere Pro 中制作短视频社交内容的完整操作轨迹,共 234 步带标注。每步都配有截图、剪辑师的口头推理、结构化动作描述以及可执行的 Premiere MCP 工具调用/快捷键/菜单路径/坐标点击。数据集遵循 AgentNet 轨迹格式,可直接用于计算机使用 Agent 的 SFT、推理中训练、工具调用和函数调用,以及 Agent 与人类专家基线的 benchmark 对比。

开源了 4 条专业剪辑师在 Premiere 里的操作轨迹数据集,共 234 步带标注。做 AI 剪辑 Agent 或自动化后期管线的可以直接拿这个数据集做 SFT 或 benchmark,比纯合成数据靠谱。

点击打开原平台查看,能否访问取决于网络环境

这个 Seedance 提示简直是神作。 后启示录追逐战,洪…

创作者 Pierrick Chevallier 分享了一条用 Hailuo 制作的 Seedance 提示词,描述后启示录追逐战:幸存者驾驶装甲肌肉车在洪水淹没的城市中逃亡,被感染的生物在屋顶和桥梁上追逐。提示词包含 0-4s、4-10s、10-15s 三段分镜,涵盖漂移、撞击、氮气加速、冲出水面等动作,并指定了电影级运镜(低角度跟踪、FPV 速度感、碎片、英雄式最终揭示)。

一条 Seedance 提示词拆解,后启示录追逐战的分镜和运镜写得挺细,做 AI 短剧和视觉的可以直接套用这个 prompt 结构跑一遍看看效果。

点击打开原平台查看,能否访问取决于网络环境

成功了!!Kimi k3 OAuth 现在直接连接到 cod…

开发者 @ziwenxu_ 将 Kimi k3 模型通过 OAuth 接入 Codex 编辑器,无需额外 API key,直接使用已有订阅即可在模型选择器中调用 k3。

个人开发者把 Kimi k3 模型通过 OAuth 接进 Codex 编辑器,省掉 API key 直接用已有订阅。搞 AI 编程工作流的可以看一眼集成方式,对创作管线影响不大。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

由 @chaas 创作的一部美丽的“手动提示”电影,完全使用…

Google Flow 官方账号推荐创作者 @chaas 使用 Google Flow 完全制作的“手动提示”电影。影片时间跨度数年,创作者利用 Google Flow 的 Agent 功能为角色生成符合电影美学的多种服装变化。展示了在单一工具链下,通过 Agent 辅助解决长叙事中角色外观一致性与多样性的工作流思路。

Google Flow 官方推荐的手动提示电影,角色服装一致性处理是看点,做 AI 短剧和视觉开发的可以拉片看怎么用 Agent 生成多套服装变体。

AI 在 5 天内完成了这个 引用 el.cine @EHu…

el.cine 工作室(5 人 AI 电影团队)发布一条 AI 短片,声称 5 天内完成。团队同期在 5 天内交付了 14 个客户成片,指出生成渲染不是瓶颈,流程管理和文书工作才是。

5 人团队 5 天交付 14 个客户成片,瓶颈不在生成而在流程。做 AI 短剧和制片管理的可以看看他们怎么绕开 paperwork 的坑。

点击打开原平台查看,能否访问取决于网络环境

在LibTV用自己创建的商品图转TVC skill做了个雅诗…

创作者「栗噔噔」用 LibTV 平台自建的「商品图转 TVC」skill,将雅诗兰黛小棕瓶商品图直接生成为 30 秒 TVC 成片,声称未做二次剪辑。展示了从静态商品图到动态广告短片的自动化工作流,适合电商视觉和广告短片场景。

LibTV 的「商品图转 TVC」skill 实测,从商品图直接生成 TVC 成片,创作者没做二次剪辑。做电商视觉和广告短片的可以看看这个工作流能省多少后期时间。

点击打开原平台查看,能否访问取决于网络环境

当星爷的经典角色遇到权谋运镜!帅爆啦!

小红书作者「屿林奇迹AIGC」发布 AI 短片,将周星驰经典角色与权谋题材的运镜风格结合,属于 IP 角色 AI 化再创作的视觉实验。

周星驰经典角色混搭权谋运镜的 AI 短片,视觉师和编导可以当风格参考,看看经典 IP 的 AI 化视觉处理思路。

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索