← 全部日报

AIGC 信息日报

2026 年 10 月 3 日 周六

行业与平台

Industry

AI 长片《6分钟》入围伦敦 AI 电影奖

创作者 @misslaidlaw 宣布其 AI 剧情长片《6 Minutes》入围 2026 年伦敦 AI 电影奖(AI Movie Awards London 2026),最终入围名单将于 10 月 17 日公布。据其自述,该片从创意到成片经历了数周的写作、实验、生成、剪辑和问题排查。评审团由《哈利·波特》《黑客帝国》《碟中谍》《星球大战》《壮志凌云》等影片的制片人和主创组成。

个人创作者用数周时间从剧本到剪辑做完一部 AI 剧情长片,入围伦敦 AI 电影奖,评审团里有《哈利·波特》《黑客帝国》的制片和主创。做 AI 长片的可以关注 10 月 17 日入围名单,看同行都在什么水平线上。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

BeefTV 上线 3D 导演台,白模摆机位再交给 AI 生成

BeefTV 新增 3D 导演台功能,可在 3D 场景里自建白模,摆放镜头、机位和人物关系,再把摆好的空间关系交给 AI 生成视频,用于精确控制画面构图。项目为开源,GitHub 仓库 glanderness/BeefTV 目前 star 数已突破 700,作者公开征集使用反馈。

把镜头、机位、人物关系先在 3D 白模里摆清楚再喂给模型,正好治「脑子里有画面但模型听不懂」这个老毛病。开源项目已过 700 stars,编导和视觉师可以拉下来跑一遍看能不能接进自己的流程。

点击打开原平台查看,能否访问取决于网络环境

Suno 上线 Speech 功能:配音与配乐一次生成

Suno 推出 Speech 功能,可根据脚本或提示描述生成人声,并支持在同一条音轨里同时生成配音与背景音乐,目前已在 Suno 网页端和移动端开放公测。Suno 首席产品官 Jack Brody 称这是首个把语音和音乐作为一条完整音轨一起生成的音频模型。做短剧旁白、纪录片解说、有声内容的后期可以拿它试配音加配乐的一体化出片流程。

Suno 从音乐跨到配音,脚本或描述直接出人声,还能同轨带上背景音乐,做短剧旁白和解说的后期可以先去公测版跑几条听口音和情绪。

点击打开原文

Eleven v4 支持音频标签写情感,限时免费

ElevenCreative 官方宣布 Eleven v4 支持在脚本中直接写入音频标签(如 [angry]、[nervous]、[embarrassed])来控制角色每句台词的情感表演,该功能在 ElevenCreative 平台上免费开放至 10 月 12 日。做 AI 配音、短剧对白和虚拟角色台词的后期团队可以趁免费期实测标签控制情绪的准确度。

配音和短剧团队可以试:脚本里直接写 [angry]、[nervous] 这类标签就能控制每句台词的情绪,10 月 12 日前在 ElevenCreative 上免费跑。

点击打开原平台查看,能否访问取决于网络环境

Mati Staniszewski 称一个声音可表达每一种情感

ElevenLabs 相关账号转帖 Mati Staniszewski 的推文,内容为「一个声音。每一种情感。」并附 elevenlabs.io/emotional-range 链接(页面锚点为 playful)。推文本身只有这一句口号加链接,未给出具体情绪种类、模型名称或上线时间。做 AI 配音、虚拟角色对白和有声内容的后期,可点开该页面确认情绪范围的实际能力与调用方式。

ElevenLabs 放出一条「一个声音,每一种情感」的预告,指向 emotional-range 页面。做 AI 配音和虚拟角色对白的后期可以点开页面看它到底给了几种情绪档位。

点击打开原平台查看,能否访问取决于网络环境

@Pinsky 称移除工具升级可擦除阴影反射

Howard Pinsky(@Pinsky)发推称移除工具(Remove Tool)再次升级,现在可以擦除关联元素,比如阴影、反射等,并配了演示。原文未说明具体产品版本、上线平台或操作方式。对做视觉和后期的人来说,如果这条指的是 Photoshop 的移除工具,那么处理人物抠图、去杂物、清理背景时能少一步手动补阴影/倒影的活,值得在自己常用的版本里实测一遍确认是否已生效。

修图师和后期可以留意:移除工具现在能连带擦掉阴影、反射这类关联元素,抠图去杂物少一道手工活。具体是哪个版本、哪端上线原文没说,先在自己那版里试一下。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

作者推荐 ComfyUI-H3-Motion-Context 接 MiniMax H3 分段

针对 MiniMax H3 单次最多生成 15 秒、短剧分段拼接易突兀的问题,作者推荐 ComfyUI-H3-Motion-Context 方案,项目内含可直接用的工作流示例。做法是把上一段最后 22 帧(0.92 秒)原样钉在下一段开头,采样时不动这些帧,让模型看到真实运动而非从静态图猜;画面和声音直接从上一段 latent 切出,避免反复解码编码掉画质;生成后用 Trim 节点剪掉开头 22 帧再首尾拼接,无需转场。提示词上下一段开头要先复述上一段的结束状态,同角色同景别同动作保持一两秒再推进新剧情。

做 AI 短剧的可以照这个思路跑一遍:把上一段最后 22 帧钉在下一段开头,接缝处姿势表情都对得上,不用做转场。

点击打开原平台查看,能否访问取决于网络环境

作者称取消 CapCut 订阅改用 Claude Code 剪辑

韩国创作者分享的工作流:用 Seedance 2.5 一次生成 30 秒说话视频,再把视频和动作参考交给 Claude Code 完成剪辑与特效——人身后经过的大字、随单词弹出的卡片、自动打字的输入框全部由代码生成,无需 After Effects。整体耗时约一小时,大部分时间花在等待生成和渲染。模板搭好后,后续只需更换主题即可复用,作者称已能实现较高质量的视频自动化,并已取消 CapCut 付费订阅。

把说话视频和动作参考丢给 Claude Code,大字、弹卡、打字机输入框全用代码画出来,不用碰 AE。做口播和短剧后期的可以照着这套跑一遍,模板搭好后换主题就能复用。

点击打开原平台查看,能否访问取决于网络环境

创作者用 Eleven v4 做 44 秒语音广告实测

创作者 Burak Tuyan 为 Eleven v4 制作了一支 44 秒规格广告,做法是先写一份「AI 语音不能做的一切」脚本,再让 Eleven v4 朗读出来,用反向命题检验语音模型的语气、情绪和表现力边界。做配音、有声书、AI 短剧对白的后期和声音团队可以听成片判断这套语音能不能直接进棚。

作者写了一份「AI 语音做不到的事」清单让 Eleven v4 念出来,用反向命题测语音模型的情绪和语气边界,做配音和有声内容的可以听一遍判断能不能进棚。

点击打开原平台查看,能否访问取决于网络环境

宝玉用 Opus 5.5 做吃瓜视频并附 Prompt

宝玉(@dotey)公开了一条用 Opus 5.5 做吃瓜视频的完整 Prompt,覆盖素材搜集(X、YouTube、新闻,可借 yt-dlp 下载)、9:16 竖版 4–6 分钟中英双版本、Gemini 3.8 Flash TTS 配音、BGM 随旁白自动压低、右上角水印、首帧封面、推文原文卡片叠加、字幕整句不截断,以及交付前用 STT 回听旁白、抽帧检查、查重复镜头。Prompt 还支持去敏版(旁白、字幕、截图、画面均不出现相关人名)。

一条完整可抄的 Prompt:从找素材、配画面到 TTS 配音、抽帧自检全交给 Opus 5.5,做资讯类短视频和短剧的可以照着改话题跑一遍。

点击打开原平台查看,能否访问取决于网络环境

PJ Ace 分享 Blender+Claude 电影工作流

创作者 PJ Ace(@PJaccetturo)称一套 Blender 工作流改变了他们的电影制作方式,团队此前无人用过 Blender,整个流程由 Claude 跑通,并预告将免费公开完整的 3D 与 Dreamina 工作流。推文本身只有这段结论和放料预告,具体步骤、参数和成片效果需看后续线程。

团队没人用过 Blender,靠 Claude 跑通全流程做出片子,作者说要把 3D 加 Dreamina 的完整工作流免费放出来。做 AI 影像和 3D 结合的可以蹲这条线程。

点击打开原平台查看,能否访问取决于网络环境

Karpathy 分享理解语言模型输出的技巧

Karpathy 提出理解语言模型输出的递进方法:一是让模型用 ASD-STE100(原为航空维修文档开发的受控语言规范)重写内容,约束强、可读性高,也可要求「80% 接近该规范」;二是让模型画图代替文字;三是要求输出 HTML 得到可交互网页;四是他最看好的方向——按任意主题生成定制讲解视频,示例 prompt 为「Create a 3b1b style video explainer on X. Use my ElevenLabs API key for audio narration」,配音可接 ElevenLabs API 或用本地算力的免费替代。

Karpathy 给了条具体路径:让模型用 ASD-STE100 受控语言重写、出图、出 HTML 网页、最后直接生成 3b1b 风格讲解视频。做 AI 讲解片和知识类内容的可以照这个顺序试一遍。

点击打开原文,能否访问取决于网络环境

Magnific 用 Ideogram 4.5 做角色设定表

Magnific 官方账号展示用 Ideogram 4.5 生成三个角色 Chloe、Ben、Jake 的 character sheets,覆盖服装、表情和不同角度的视图,prompt 放在推文的 ALT 文本里。核心卖点是同一角色可以反复调用、保持统一外观。做 AI 短剧和系列内容的视觉师可以拿这套设定表流程测试角色一致性,看跨镜头复用稳不稳。

角色设定表是 AI 短剧和系列片最头疼的一环,这条给了用 Ideogram 4.5 定义服装、表情、多角度视图的具体做法,做角色一致性的视觉师可以照着跑一遍。

点击打开原文,能否访问取决于网络环境

Luma AI 博客盘点 11 款 AI 动漫视频工具

Luma AI 博客发布 2026 年 AI 动漫视频生成工具盘点,覆盖 11 款工具,核心结论是动漫 AI 工作流应从静帧起步再动画,而非直接文生视频。文中点名 Seedance 2.5 单次生成支持最多 9 张参考图以维持视觉一致性,WAN 2.7 在赛璐璐上色还原度上表现突出且开源,Kling AI V3 擅长动作序列的流畅运动与打斗调度,Krea 等平台提供含多模型访问的免费额度。角色一致性被列为当前首要难题。

把 11 款动漫视频工具按「先出静帧再动画」的工作流排了一遍,点名 Seedance 2.5 支持 9 张参考图保角色一致性、WAN 2.7 赛璐璐质感、Kling V3 打斗运镜。做动漫短剧和番剧向内容的可以当选型清单过一遍。

点击打开原文

创作者自建 v2v 自动捕获系统,免提示免重roll

创作者 Jon Finger(@mrjonfinger)称自己搭了一套系统,电脑或手机可自动捕获画面并用选定角色做 v2v(视频转视频),全程无需手动写提示词或反复重roll,并称运行可靠性让他意外。推文未说明所用模型、工具或具体搭建方式,仅表达「多玩少提示」的创作取向。

个人创作者自建的 v2v 自动化流程,电脑手机都能自动抓取画面套用选定角色,不用反复写提示词重roll。做角色一致性和批量换脸的可以问问他怎么搭的。

点击打开原平台查看,能否访问取决于网络环境

作者用 mj 与 suno 制作 4K 太空图像视频

作者公开了一条音乐可视化短片的完整工具清单:图像用 Midjourney,音乐用 Suno 并通过 librosa 做节拍同步;第一部分「图像在太空中飞翔」用 three.js + WebGL,经 Playwright 在无头 Chromium 里以 4K 渲染;第二部分「节拍切割窗口和马赛克」用 NumPy + Pillow 写的自定义 Python 合成器;最后用 ffmpeg 编码。

一条把 MJ 出图、Suno 配乐、librosa 卡点、three.js 4K 渲染串起来的完整技术清单,做音乐可视化 MV 和后期合成的可以照着搭一遍。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

AI漫剧《被迫同居后我和豪门少爷恋爱了》持续更新

B 站上的国产 AI 漫剧《被迫同居后我和豪门少爷恋爱了》完结版,题材是篮球冠军与豪门少爷被迫同住、从针锋相对到心动的合约恋爱线,作者标注为 AI 漫剧持续更新。属于个人创作者用 AI 做的连续剧集型漫剧作品,可看漫剧形式下的角色一致性与分集叙事处理。

国产 AI 漫剧的完结样本,豪门恋爱题材、合约同居套路,做 AI 短剧的可以拉片看它怎么用漫剧形式撑起连续剧集和角色一致性。

点击打开原平台查看

B站AI动画短片《奶蛙:一百分的家》第四集

B站 UP 主「轩月27」发布的 AI 动画短片《奶蛙:一百分的家》第四集,标注含 AI 生成内容,归入「AI 剧情大片」话题,标签为动画短片、治愈、温馨,属系列化作品。适合做 AI 动画和系列短内容的创作者参考角色一致性与分集叙事处理。

B站 UP 主「轩月27」的 AI 动画系列第四集,治愈温馨向,做 AI 动画和系列化短内容的可以拉片看角色一致性和分集节奏怎么处理。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索