← 全部日报

AIGC 信息日报

2026 年 9 月 5 日 周六

行业与平台

Industry

GPT-6 Astra 向 Pro 与企业用户开放,API 同步上线

OpenAI 官方宣布 GPT-6 Astra 现已向 ChatGPT Work 和 Codex 中的 Pro、Enterprise、Business Premium 用户开放,并同步上线 API。Plus 和 Business 用户将在未来几天内逐步获得访问权限。

OpenAI 官方宣布 GPT-6 Astra 全量开放,Pro/企业用户即刻可用,API 也已上线。做 AI 短剧和后期工作流的可以直接接 API 测一周,看它在长文本理解和多模态处理上能不能顶替现有方案。

点击打开原文,能否访问取决于网络环境

阿里云 Wan3.0 全面开放,支持 30 秒视频生成

阿里云宣布 Wan3.0 正式全面开放(GA),支持 30 秒视频生成和一键文档转视频,定位生产可用,官方已提供详细使用指南。对 AI 视频创作者来说,这意味着一个可商用的视频生成模型正式进入生产环境,做短剧和批量内容的团队可以评估接入成本与出片稳定性。

阿里云把 Wan3.0 推到生产可用,30 秒生成加一键文档转视频,做短剧和批量出片的可以直接接 API 跑流程,省掉中间剪辑环节。

点击打开原文,能否访问取决于网络环境

fal 发布 H3 Max Director 实时连续视频模型

fal 推出 H3 Max Director,定位为首个原生连续实时前沿视频模型,面向动作控制的长篇生成场景。该模型强调实时性与连续性,支持对动作的持续控制,适用于需要长镜头、连续动作叙事的 AI 影视与短剧制作。

首个原生连续实时视频模型,主打动作控制的长视频生成,做 AI 短剧和长片的可以直接接 API 试,看连续性和动作可控性稳不稳。

点击打开原平台查看,能否访问取决于网络环境

Viggle 发布开放权重模型 Viggle-Animate,可单帧重绘换人

Viggle 发布首个开放权重模型 Viggle-Animate,基于 MiniMax-H3 构建,可从一帧重绘帧替换视频中的人物,渲染时无需姿势骨架、遮罩或文本提示。模型经 3 次前向传播可在 26 秒内生成 5 秒视频,已在 Hugging Face 开放。对做角色替换、换脸重绘和后期修复的创作者来说,单帧驱动和免遮罩是实打实省事的能力,值得接 API 或本地跑一遍验证效果。

做角色替换和换脸重绘的可以拉下来跑一遍,单帧就能驱动视频人物,不用姿势骨架和遮罩,26 秒出 5 秒片,效率很能打。

点击打开原平台查看,能否访问取决于网络环境

微软 MAI-Image-2.6-Flash 上线,价格减半速度翻倍

微软发布 MAI-Image-2.6-Flash,定位高速高产量图像生成,质量对标旗舰版但价格不到一半,官方称生成速度比 GPT-Image-2-Medium 快 2.8 倍,已通过 OpenRouter 开放调用。对批量出图、分镜预演和短剧物料生产的团队来说,是低成本高吞吐的新选项。

做批量出图和短剧分镜的可以接 API 试一周,价格砍半、速度 2.8 倍,高产量场景下成本优势明显。

点击打开原文,能否访问取决于网络环境

Magnific 推出 MCP,Claude 可全流程跑制作

Magnific 官方宣布推出 Magnific MCP,让 Claude 能够全流程运行整个制作流程。该 MCP 接口可将 Claude 接入 Magnific 的图像生成与处理能力,实现从创意到成片的自动化调度。对 AI 编导和视觉师而言,这意味着可尝试用 Claude 串联起分镜、生成、后期等环节,减少人工切换工具的成本。

Magnific 官方放出 MCP 接口,Claude 能从头到尾跑完一条制作流程。做 AI 短剧和视觉的可以接上试试,看自动化调度能省多少手工环节。

点击打开原文,能否访问取决于网络环境

Qwen3.8-Flash 上线 QwenWork,自动生成幻灯片

阿里云宣布 Qwen3.8-Flash 正式上线 QwenWork,处理速度提升一倍。用户投入想法和文件后,模型自动整理逻辑并生成结构清晰、排版专业的幻灯片;Standard 模式下 1000 积分约可生成 100 份幻灯片,每份约 10 积分。团队可通过 qwenwork.ai 试用,并经 Model Studio 或 Qwen Cloud 获取 API 访问。

阿里云把 Qwen3.8-Flash 塞进 QwenWork,主打自动整理逻辑出幻灯片,速度翻倍。做提案、写分镜脚本、整理项目方案的编导和制片可以上手试,省掉排版时间。

点击打开原平台查看,能否访问取决于网络环境

Meta Muse Image 登 Artificial Analysis 图像榜前五

Meta Superintelligence Labs 首个图像模型 Muse Image 在 Artificial Analysis Image Arena 首次上榜,位列图像编辑榜第 4 名、文生图榜第 5 名。该榜单为第三方盲测对比平台,反映模型在真实用户偏好下的综合表现。对视觉创作者来说,这是评估 Muse Image 与主流图像模型差距的参考坐标。

Meta 首个图像模型 Muse Image 在第三方盲测榜上首次亮相,文生图和图像编辑都进了前五。做视觉和美术的可以点开看具体榜单数据,判断它跟 Midjourney、Flux 的差距。

点击打开原平台查看,能否访问取决于网络环境

Runway 推出 Team Plan 团队套餐

Runway 推出面向小企业和团队的 Team Plan 自助套餐,支持 2-9 个席位共享一个额度池,包含共享项目、评论、Agent skills 和 Agent Connectors,方便团队在一个地方协作构建。

做 AI 短剧或工作室的制片可以看看,2-9 人共享额度、项目协作和 Agent 连接器,适合小团队统一管理制作预算和素材。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools

Gemini 上线音乐生成模型 Lyria 3.5

Google 在 Gemini 中推出音乐生成模型 Lyria 3.5,主打更丰富的编曲、更具表现力的人声和更高保真度。用户可选择音乐类型、人声或纯器乐,探索新模板,并生成较短或更长的曲目。对后期和短剧团队来说,这意味着配乐和 BGM 的生成质量与可控性提升,可直接在 Gemini 内完成从选风格到出曲的流程。

做后期配乐和短剧 BGM 的可以上手试,编曲丰富度和人声表现力是这次升级重点,能直接生成不同长度的曲目。

点击打开原平台查看,能否访问取决于网络环境

Google Translate 实时翻译支持后台运行与听筒播放

Google Translate 更新两项实时翻译功能:支持在后台运行(锁屏或多任务时仍可实时翻译,Android 已上线,iOS 即将支持);iOS 端新增通过手机听筒播放实时翻译(Android 已有),适用于嘈杂环境无耳机场景。

当天有 1 家独立信源在报同一件事,属于行业动向本身。对具体创作流程没有直接用处,但这个量级的消息值得知道。

点击打开原文,能否访问取决于网络环境

方法与经验

Methods

GPT-6 Astra 空间推理绘制分镜,Seedance 2.5 渲染成片

Higgsfield AI 展示 GPT-6 Astra 在空间推理上的能力:它绘制了博物馆场景、演员阵容和拍摄清单,布景始终保持在视口中,并由 Higgsfield Seedance 2.5 渲染每一个场景。这是一次将大模型空间规划能力与自家视频生成模型串联的流程演示,核心价值在于验证「AI 出分镜、视频模型出画面」的自动化创作流程可行性。

Higgsfield 展示了 GPT-6 Astra 做空间推理、直接产出分镜和拍摄清单,再由自家 Seedance 2.5 渲染的完整流程。做 AI 编导和短剧的可以看看这套「AI 出分镜+视频模型出画面」的串联方式,省掉中间大量人工调度。

点击打开原平台查看,能否访问取决于网络环境

Ethan Mollick 用 GPT-6 Astra 扩展开源海洋模拟项目并开源

Ethan Mollick 用 GPT-6 Astra 在开源单文件海洋风暴生成器 ABYSSAL 基础上,生成其余海洋内容,包括动物行为的程序化模拟,并将成果开源。在线 demo 可访问 abyssal-living-deep.netlify.app。

AI 编程 Agent 扩展开源项目的实操样本,做技术整合和视觉开发的可以看它怎么用 GPT-6 Astra 补全程序化模拟逻辑,跑一遍 demo 就知道生成质量。

点击打开原平台查看,能否访问取决于网络环境

ElevenLabs 为失声者重建家人音色

ElevenLabs 发布案例:为童年失声的 Eliane 重建声音,音色基于其家人录制样本生成。故事聚焦圣保罗两位残障人士的相遇与情感联结,展示语音克隆技术在真实人物叙事中的情感化应用。

语音克隆的情感向应用案例,做配音和声音设计的可以看看技术怎么落到真实人物故事上。

点击打开原平台查看,能否访问取决于网络环境

白板火柴人拆书短视频工作流开源

开源项目 whiteboard-book-video-skill,提供白板火柴人拆书短视频的完整工作流,覆盖脚本、分镜、配音、BGM、字幕与 HyperFrames 本地渲染环节,可直接交给 Agent 执行或在此基础上魔改。

做知识类短视频和拆书号的可以直接把整套工作流丢给自家 Agent 跑,脚本到本地渲染全包,省掉自己搭流程的时间。

点击打开原文,能否访问取决于网络环境

Astra 自主调度子智能体完成 Blender 建模任务

Ethan Mollick 实测 Astra(和 Fable)的自主行动能力:给出一个定义模糊的 Blender 交付需求后,Astra 自行启动历史研究、视觉指导等子智能体开始执行,任务持续 44 分 48 秒,在 Blender 中构建了 Boullée 的牛顿纪念堂内外部场景,并准备 Unity 漫游和本地浏览器漫游方案。

Astra 能自己拆解模糊需求、调度子智能体干活,44 分钟把 Blender 场景建完还备好漫游方案。做技术整合的可以看看这种多智能体自主执行的工作流能省多少人工。

点击打开原文,能否访问取决于网络环境

Seedance 2.0 二次元打戏提示词智能体开源

作者 Arvin 开源了一个面向 Seedance 2.0 的二次元打戏提示词生成智能体,具备打戏动作指导和摄影师/运镜指导双重能力,可根据对战角色、风格偏好和场景需求,生成可直接用于 Seedance 2.0 的 15 秒标准分镜提示词。作者同时提醒不要过度依赖 skill,经验才是核心。

做 AI 短剧和动画的可以拿去当打戏分镜的起点,套上自己的角色设定跑几遍,看生成的运镜和动作提示词顺不顺手。

点击打开原文,能否访问取决于网络环境

Magnific 官方提示词适配指南:逐条绑定参考图

Magnific 官方发布提示词适配指南,针对 2.5 模型「字面执行、只做你要求的事」的特性,给出三条规则:逐条绑定参考图(如「角色 A 对应 [img1]」)、明确写出排除项(如「不要使用图片背景」)、每个阶段只给一个改动并明确结束点。

官方出的提示词写法,针对 2.5 的「字面执行」特性给了三条具体规则:逐条绑定参考图、写明排除项、每阶段只改一处。做视觉和角色一致性的可以直接套用这套写法。

Seedance 2.0 与 2.5 同场景实测对比

博主 @magnific 用厨房、爵士俱乐部、丛林三个相同场景,对 Seedance 2.0 与 2.5 进行并排实测对比,并公开了完整 prompt 供创作者自行复现。对视觉师和短剧团队来说,这是判断是否升级到 2.5 的直观参考,可直接套用 prompt 跑自己的测试。

同一场景下两代模型出片对比,还附了可直接跑的 prompt,做视觉和短剧的可以自己跑一遍看 2.5 到底强在哪。

点击打开原平台查看,能否访问取决于网络环境

Legora 用 GPT-6 Astra 分钟级审 41 份文档

OpenAI 官方案例:Legora 用 GPT-6 Astra 在几分钟内审阅 41 份文档,找出全部 4 处预设错误,并让金融审阅工作流性能提升近 40%。

金融审阅场景的官方案例,展示 GPT-6 Astra 在长文档批量处理上的效率,做 AI 工作流整合的可以看下 Agent 怎么串文档审阅。

点击打开原平台查看,能否访问取决于网络环境

ATV Big Air Tour 用 ChatGPT 把 3 天工作压缩到 3 小时

OpenAI 官方博客发布客户案例:ATV Big Air Tour 赛事方用 ChatGPT Work 加速营销、商品化等环节,并把商品照片在 15 分钟内转成库存网站,将原本 3 天的工作压缩到 3 小时。

OpenAI 官方客户案例,讲的是营销和商品化提效,不是拍片。做 AI 短剧和内容生产的制片可以看看 ChatGPT Work 在物料批量产出上的效率,但别指望有创作工作流可抄。

作品与案例

Works

GPT-6 单图生成可漫游 3D 白宫,22 分钟出成品

创作者 Max For AI 用一张白宫照片和一句「帮我用这个图做一个这个建筑三维的立体页面,可以自由浏览」的提示词,让 GPT-6 在内生成一个可自由漫游的 3D 白宫。场景包含建筑、草坪、树木、花坛、喷泉,支持拖动旋转、缩放、切换视角、WASD 漫游,甚至可调节日照时间让光影变化。照片未拍到的部分由模型近似补全。

一张照片加一句话,GPT-6 直接生成可自由漫游的 3D 场景,连日照光影都能调。做视觉预演和场景搭建的可以试试这套工作流,省掉传统建模的功夫。

点击打开原平台查看,能否访问取决于网络环境

Runway 发布 AI 短片:一颗西兰花开小差

Runway 官方账号发布一部 AI 短片,题材为「一颗西兰花开小差(AWOL)」,属于创意叙事向的影像作品。推文正文无技术细节,仅附成片链接。

Runway 官方发的 AI 短片,题材是西兰花开小差,偏创意叙事向。做 AI 短片的可以点开看看官方在镜头语言和角色动画上怎么处理,当风格参考。

点击打开原平台查看,能否访问取决于网络环境

AI护士系列短剧第四集上线

B站UP主「AI精品分享」的AI短剧系列《当新来的医生吸引了AI护士》第四集,单集约,延续该UP主「AI美女+日常情景」的轻喜剧小剧场风格,属于批量生产的短剧内容。

B站UP主「AI精品分享」的AI短剧系列第四集,单集左右的轻喜剧,做AI短剧的可以扫一眼这类量产式小剧场的内容节奏。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索