← 全部日报

AIGC 信息日报

2026 年 9 月 10 日 周四

行业与平台

Industry

OpenAI 官方介绍 GPT-6 Astra 企业级模型

OpenAI 官方介绍 GPT-6 Astra(该产品 9 月 4 日已发布),定位为企业级最强模型,主打高级推理、计算机使用(computer use)能力,以及更强的写作和设计判断力。面向商业场景,可嵌入自动化内容生产与办公流程。对 AI 创作者来说,其写作与设计判断能力可用于批量生成脚本、分镜描述和视觉方案初稿,计算机使用能力则可能打通从创意到成片的自动化操作流程。

OpenAI 面向企业的最强模型,推理、操控电脑、写作和设计判断都升了一档。做 AI 短剧和内容生产的团队可以关注它接进工作流后,批量出文案和分镜的效率变化。

点击打开原文

Suno V6 发布:自然语言改词、混搭曲、多模态生成

Suno V6 发布,官方承诺生成速度更快、音频质量更高、音乐更具表现力。核心创意控制功能包括:用自然语言编辑单个段落、无需重建歌曲即可修改单句歌词、将多首轨道组合成混搭曲、支持从文本/音频/图像/视频生成音乐。共三个模型:V6(精准)、V6-Wild(实验性)、V6-Mini(免费用户可用),两个大模型需 Pro 或 Premier 订阅。注意:自 9 月 3 日起,Pro 用户普通歌曲下载上限为每月 20 首,Premier 为 60 首,超出需额外付费,Premier 用户通过 Suno Studio 保留无限导出。

做 AI 配乐和短剧 BGM 的后期可以实测一下:自然语言改单句歌词、不用重建整曲,能省不少返工时间。

点击打开原文,能否访问取决于网络环境

可控图像生成团队 Reve 并入 OpenAI

可控图像生成研究团队 Reve 宣布与 OpenAI 建立战略合作伙伴关系,其研究团队整体加入 OpenAI,继续可控图像生成方向的研究。Reve 联合创始人 Taesung Park 在推文中确认了这一消息,并提到 OpenAI 最新发布的 GPT Image 2.5 进一步巩固了其在图像生成领域的领先地位。

做视觉和图像生成的可以关注:Reve 团队并入 OpenAI,可控图像生成能力大概率会沉淀进 GPT Image 后续版本,视觉师可以留意接下来 GPT Image 的更新方向。

点击打开原平台查看,能否访问取决于网络环境

LTX-2.5 开源:开放权重视频模型,支持本地部署微调

LTX-2.5 开放权重视频世界模型更新,支持本地部署和微调,前代 LTX 下载量已达 18M。新解码器提升人脸清晰度、文字招牌可读性和快速运动表现;原生 Multishot 在镜头间保持角色、环境、光照与语音一致;IC-LoRA 支持对象移除、连贯性修复和环境更换;更强的蒸馏模型把更多质量带入本地 GPU。(该产品 8 月 12 日已发布)

开放权重视频模型,能本地部署和微调,做短剧和视觉的可以自己跑,角色一致性和人脸清晰度是这次升级重点。

点击打开原平台查看,能否访问取决于网络环境

红果8月热度榜AI剧占9席,真人剧仅1部

红果短剧8月热度榜Top 10中AI剧占9部、真人剧仅1部,且是在平台下调AI剧收益后的表现。作者复盘月度数据:4月AI剧0部、5月2部、6月3部、7月7部逐月上升,认为暑假是转折点,偏好玄幻等AI剧题材的学生观众放假,直接改变了头部格局。

红果8月热度榜Top10里9部是AI剧,还是在砍收益之后。做AI短剧的可以看看这个趋势,题材和受众定位有参考价值。

Lovart 发布 Flare 与 Sunburst 两款图像模型

Lovart 发布两款新图像模型:Flare 主打快速生成、透明背景素材,面向规模化批量创作;Sunburst 主打更锐利的细节、更丰富的纹理、更清晰的文字渲染,并强调跨编辑的一致性。两款模型均面向创作者开放使用。

做视觉和美术的可以上手测一下 Sunburst 的细节和文字渲染,Flare 适合批量出透明底素材,跑一遍就知道合不合用。

蚂蚁百灵发布 Ling-3.0-flash-VL 多模态模型

蚂蚁百灵发布 Ling-3.0-flash-VL(124B/5.5B MoE),具备原生图像和视频理解能力与 1M 上下文窗口,SGLang 上线 Day-0 支持。模型采用 ViT 编码器加 MLP projector 的原生多模态方案、VideoRoPE 时空编码,以及 42 层 KDA 加 Gated MLA 按 5:1 组成的混合骨干网络以支持长上下文。

底层视觉理解模型发布,主打长上下文和原生多模态,对拍片创作没有直接可迁移的东西,做工具链整合的可以扫一眼 SGLang 的 Day-0 支持。

点击打开原文,能否访问取决于网络环境

Gradium 发布 Voice Design:文字描述几秒生成全新合成语音

巴黎语音 AI 公司 Gradium(从 Kyutai 研究实验室分拆)推出 Voice Design,输入 1 到 500 字符的描述即可在 3 到 5 秒内生成 1 到 5 个候选语音,无需参考音频,支持英法西葡德 5 种语言,已在 Gradium API 和 Studio 全部套餐免费开放。

做配音和短剧的后期可以接 API 试一周,按角色描述批量出音色,省掉找参考音频和谈授权的环节。

可灵 AI 将亮相多伦多 TIFF 市场谈电影化叙事

可灵 AI 官方宣布将于 9 月 10 日亮相多伦多 TIFF 市场,与电影人、制片人及行业领袖探讨 AI 如何支持更一致、可控的电影化叙事,议程与演讲嘉宾阵容已公布。

可灵官方下场进主流电影节市场,跟电影人、制片人聊 AI 叙事一致性。做 AI 长片和短剧的可以关注议程,看头部厂商怎么跟传统制片体系对接。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

HeyGen 上线专业声音克隆,20 分钟训练专属音色

HeyGen 官方宣布推出 Professional Voice Clone 功能,现已进入 API 预览阶段。该功能基于 20 分钟的个人语音素材训练专属声音模型,官方演示中两段音频分别来自真人 Josh 与其克隆音色,用于对比效果。该能力直接面向数字人、AI 配音等需要高保真声音一致性的创作场景。

HeyGen 官方推出专业声音克隆,20 分钟素材就能训练专属音色,现在 API 预览可用。做数字人、AI 配音和短剧的可以直接接 API 试,角色声音一致性这块能省不少事。

点击打开原文,能否访问取决于网络环境

OpenRouter 统一模型调用接口,一条命令切换各家模型

OpenRouter 推出统一模型调用方式:通过 `ori kilo --model openai/gpt-6-astra` 或 `ori muse --model anthropic/claude-fable-5.1` 即可在命令行中调用不同厂商模型,`--reasoning-effort` 参数会自动映射到各家模型的原生推理控制标志,其余参数直接透传。对 AIGC 技术整合者来说,这意味着可以用同一套命令调度 GPT 和 Claude,省去为不同模型写适配层的工作。

OpenRouter 把 kilo/muse 这类命令行工具统一成一套模型调用语法,做自动化工作流的可以直接用同一套命令切 GPT 和 Claude,不用再为每家写适配。

Synthesia Assistant 支持拖拽文档生成视频

Synthesia 官方演示 Assistant 新能力:拖入文档、用自然语言描述视频需求,Assistant 自动生成视频,并可在聊天中迭代修改。配套案例为 Carlsberg Group 借助 Assistant 将视频制作从外包转为内部生产,并将其培训内容规模化覆盖全球供应链的多语言需求。

Synthesia 把文档拖拽、描述需求、AI 自动生成视频的流程串起来了,还带 Carlsberg 从外包转自制的案例,做企业培训视频和批量内容生产的团队可以看看这套工作流。

点击打开原文,能否访问取决于网络环境

FLORA 为 Astra 新增 3D 节点,画布内直接 2D 转 3D

FLORA 为 Astra 模型新增专用 3D 节点,可在画布内直接生成 3D 并实现 2D 与 3D 之间的快速迭代,提升 3D 内容生成效率。

做视觉开发和 3D 场景的可以试试,画布上直接 2D 转 3D 迭代,省掉来回切工具的流程。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

Blender 白模+Seedance 2.5 锁死复杂运镜工作流

知识猫AI实验室分享一套复杂运镜/多人走位工作流:用 Blender 灰模(方块+圆柱+Mixamo 人偶)搭场景、K 相机关键帧,渲染成 MP4 白模视频作为骨架,锁死机位路径、人物走位、遮挡关系,再作为参考视频喂给 Seedance 2.5 全能参考模式,附角色图+风格图,AI 只负责换皮。白模阶段零成本(Blender 5.2 免费、Mixamo 免费),生成费 30 秒 720P 即梦约 780 积分(63-84 元/条),fal 约 13.9 美元/条。实操 4 步:搭地面人偶设 120 帧、相机首尾帧 K 关键帧、Workbench 渲 1280×720 MP4、即梦全能参考输入白模+角色图+风格图并注明灰块含义。要点:白模越粗糙越好,先 480P 抽卡定方向再 720P 出片,超 5-8 秒运镜先拆段。

复杂运镜和多人走位一直靠抽卡,这套用 Blender 白模锁死机位和走位再喂给 Seedance 2.5 换皮,废片率能压下来。做短剧和编导的可以直接抄这套流程,白模阶段零成本。

FLORA 工作流:先用 Blender 锁定运动再交给 AI

FLORA 官方展示一种工作流:先用 Astra 在 Blender 里建出鞋楦的 3D 模型并完成动画,把运动轨迹锁定后再交给视频生成模型 FLORA,避免纯靠 prompt 猜运动导致的不确定性。

做产品动画和需要精确运动的创作者可以看看,用 3D 先锁运动再喂给视频模型,能省掉反复抽卡调 motion 的功夫。

点击打开原平台查看,能否访问取决于网络环境

AI 复刻《五王醉归图》:关键帧提示词与归画设计经验

创作者波妞PONYO 用 ChatGPT Image 2.5 关键帧生成 + 即梦做动作运镜,复刻古画《五王醉归图》并补拍宴席前情。分享三条经验:先分别定好五位王爷的脸、衣服、神态再进同一场景;提示词写到动作发生之前(如写目光落杯沿、手指在袖中收紧而非直接拦杯);归画镜头从第一张图就按原画设计站位、马匹朝向、衣服颜色。

做 AI 名画复活或历史题材的编导、视觉师可以细读,三条经验(先定人物关系、提示词写到动作前、归画从首帧设计)都是能直接套用的工作流。

点击打开原平台查看,能否访问取决于网络环境

GPT-6 Astra 做 2D 游戏,GPT-image-2.5 生成精灵图素材

博主歸藏实测:GPT-6 Astra 不仅能做 3D 游戏,做 2D 游戏同样出色。核心工作流是用 GPT-image-2.5 生成游戏素材,包括背景图、跳跃平台、怪物、人物及怪物动作的精灵图,再将这些精灵图做成关键帧动作,配合 JavaScript 实现。技能音效也由 AI 生成。

用 GPT-image-2.5 生成精灵图再拼关键帧动作,这套做游戏素材的思路,做动画和短剧的可以借鉴,角色动作不用一帧帧画了。

点击打开原平台查看,能否访问取决于网络环境

创作者晒 AI 预告片并附完整提示词

创作者 Pierrick Chevallier 发布一支 AI 预告片,主打「无怪物、无爆炸、无威胁」的悬疑氛围,核心悬念是「如果地球在试图告诉我们什么」。作者附上了完整提示词,包含 IMAX 航拍、ARRI Alexa 65 写实感、变形宽银幕镜头、直升机视角、快速跟拍、慢动作等电影级参数,并明确要求男女主角视觉一致性,分镜按 0-5 秒、5-10 秒逐段拆解。

预告片质感拉满,作者把完整提示词和分镜节奏都贴出来了,做 AI 长片和短剧的可以直接套这套提示词跑一遍看效果。

点击打开原平台查看,能否访问取决于网络环境

GPT Image 2.5 对比实测:同 prompt 出图差异

博主 @3three_AI 用同样 6 个 prompt 逐字不改,分别用 GPT Image 2.0 和 2.5 各生成一张图做对比,无后期处理,直观展示两代模型在相同指令下的出图差异。

视觉师可以点开看 2.5 在同样 prompt 下比 2.0 强在哪,判断要不要升级工作流。

点击打开原文,能否访问取决于网络环境

剪辑师实测 Claude 接 Davinci MCP 调色

剪辑师 Hunter Weiss 分享用 Davinci MCP 在 Claude 中编辑一整天的体验,称节省约 10 小时,并对原始 Alexa 素材完成调色,计划次日测试 Astra。个人体验分享。

后期剪辑师亲测 Claude 接 Davinci MCP,一天省 10 小时,还能对 Alexa 原始素材做调色。做后期和剪辑工作流的可以关注这个方向,等 Astra 测试结果。

点击打开原平台查看,能否访问取决于网络环境

Magnific 晒 15 秒荒诞短片提示词

Magnific 官方发布一条 15 秒电影感真人短片示例,配完整提示词:荒诞冷幽默题材,16:9 横屏,四段精确剪辑镜头,视觉定位为 1990 年代高端街头服饰广告片,35mm Kodak Vision3 胶片质感,含细腻有机颗粒。

官方晒的 15 秒短片提示词,带完整分镜和 35mm 胶片质感设定,做 AI 广告和短片的可以直接抄这套 prompt 跑一遍看效果。

点击打开原平台查看,能否访问取决于网络环境

Invideo 演示匹配剪辑工作流:40 分钟出片

Invideo 官方演示用编辑器+代理实现匹配剪辑的工作流:选一张中心有圆圈的参考图,据此生成其他圆形主体图片;上传音频后让代理检测节拍并打点,再将生成的图片对齐到节拍标记;用编辑器标尺保持剪辑与主体对齐。整个过程约 40 分钟完成。

官方演示用编辑器+代理做匹配剪辑的完整流程,从参考图生成到音频节拍对齐,后期和编导可以照着跑一遍看效率。

点击打开原平台查看,能否访问取决于网络环境

博主推荐 OpenAI 官方 GPT Image 2.5 提示词指南

博主 LinearUncle 推荐 OpenAI 官方《GPT Image 2.5 提示词指南》,强调除描述外参数设置同样关键:图片文字较多且需清晰度时,可调高 size 和质量档位;追求更高清效果可优先尝试 GPT Image 2.5 Sunburst,并与 Flare 版本对比差异。指南链接指向 OpenAI 开发者文档。

做视觉和海报的可以点开官方指南看参数设置原理,文字多时调高 size 和质量档位这条对出图清晰度挺实用。

点击打开原文,能否访问取决于网络环境

作品与案例

Works

AI 逐帧复刻 70 年爱情故事

Google AI 官方博客发布 AI 影像作品《Love, Rendered》,以逐帧复刻手法重述一段 70 年爱情故事,已亮相 Telluride 电影节。作品聚焦老年夫妇观影场景,用 AI 生成画面承载跨年代的情感叙事,是官方对 AI 叙事电影形态的一次探索。

Google AI 官方博客展示的 AI 影像作品,用逐帧复刻手法重述一段 70 年爱情故事,做 AI 叙事和视觉风格的可以拉片看情感表达怎么落地。

点击打开原文

《执念尸》第二季更新:AI 丧尸短剧持续连载

B 站 UP 主「老宫特西范」的 AI 真人短剧《执念尸》第二季第 10 集上更新,丧尸末日题材,单集约,已连载至第二季,含 AI 生成内容标注。该系列为个人创作者持续更新的 AI 短剧连载案例。

B 站 AI 丧尸题材短剧《执念尸》第二季新一集,做 AI 短剧的可以拉片看长系列连载的叙事节奏和角色一致性处理。

点击打开原平台查看

AI 短剧《停止呼吸》第八集:清朝僵尸闹韩国街头

B 站 AI 短剧《停止呼吸》第八集,题材为清朝僵尸转运韩国后破封闹市,末日氛围。系列化短剧,主打僵尸题材与异国场景混搭,可拆解系列叙事节奏与角色/场景一致性处理。

AI 短剧系列第八集,僵尸题材混搭异国街头,做短剧的可以拉片看系列化叙事和场景一致性怎么保持。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索