← 全部日报

AIGC 信息日报

2026 年 9 月 3 日 周四

行业与平台

Industry

Google 发布 Gemini 3.8 Flash,主打复杂 Agent 任务

Google 官方发布 Gemini 3.8 Flash,定位为处理复杂 Agent 与多步任务的模型,官方称其为最智能的「工作马」模型,推理能力显著提升,不止能写代码。

Google 官方发布 Gemini 3.8 Flash,定位复杂多步 Agent 任务,推理能力显著提升。做 AI 工具链整合的可以关注 API 接入,看能否串进自动化剪辑或批量生成流程。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools
本日无符合条目

方法与经验

Methods

商业导演拆解 Wan3.0 广告工作流,强调提示词遵循

阿里云转发商业导演 Nick Tasker(@SLAIstudio)的讲解视频,他拆解了自己用 Wan3.0 制作的 30 秒广告,涵盖创意来源、工作流、Wan 3 在 AI 广告中的优势以及给创作者的技巧,并强调提示词遵循(prompt adherence)对导演最为重要。视频提供了 Model Studio 和 Qwen Cloud 的 API 入口。

商业导演 Nick Tasker 亲自拆解用 Wan3.0 做 30 秒广告的全流程,从创意到工作流再到给创作者的技巧,做广告和短剧的编导可以拉片看导演视角怎么用提示词控画面。

点击打开原平台查看,能否访问取决于网络环境

Magnific 演示:引用位置保持镜头间场景一致

Magnific 官方演示其图像生成工具支持引用位置(locations)功能,通过 prompt 中指定场景位置,可在多个镜头间保持地点一致。示例为外星山谷的宽银幕定场镜头,紫色天空、锯齿状紫灰山脉、透明水晶树等元素。该功能面向需要跨镜头保持场景连续性的创作者,适合 AI 短剧和视觉开发场景。

做 AI 短剧和视觉开发的可以看看这个位置引用功能,跨镜头保持场景一致,省掉反复重绘的功夫。

点击打开原文,能否访问取决于网络环境

语音智能体延迟评测:首句延迟比首 token 更关键

MarkTechPost 评测语音智能体全流程延迟,指出首 token 延迟(TTFT)会误导选型,用户实际感知的是首句延迟(TTFS),因为 TTS 需等完整句子才能发声。评测覆盖 LLM、STT、TTS 及语音到语音全流程,给出各层延迟预算:STT 约 100-200ms、LLM 300-500ms、TTS 100-200ms,全流程目标 700ms-1.2s。

做 AI 配音、虚拟角色对话和实时字幕的后期团队,这篇把语音流程的延迟预算拆得很清楚,接 API 选型时可以直接当参考。

MiniMax H3 开源社区提速超 60% 引热议

社区为 MiniMax H3 开发了自定义节点,通过 4 步 Turbo 蒸馏、3D 潜在时空超分和动态 LoRA 卸载,在 RTX 5070(12GB)上把 8 秒 768p 视频渲染时间从 20-30 分钟缩短到约 7 分钟,提速超 60%,16GB 以上显卡更快。

社区把 H3 本地渲染提速 60% 以上,12GB 显卡 7 分钟出 8 秒 768p 视频,做短剧批量出片的可以照着这套工作流跑一遍,省时省力。

点击打开原平台查看,能否访问取决于网络环境

开发者用 MiniMax H3 Max 2 秒生成 5 秒视频做爆款钩子

开发者 Romain Torres 展示基于 MiniMax H3 Max 的即时钩子生成器:输入应用或网站信息,2 秒内生成 5 秒视频,并产出 3 条病毒式传播的钩子文案。核心是借助 H3 Max 的极速生成能力,将视频生成与文案创意结合,用于快速产出短视频开头。

用 H3 Max 的极速生成能力做短视频开头钩子,2 秒出 3 条爆款文案,做短剧和营销号的可以试试这套思路。

点击打开原平台查看,能否访问取决于网络环境

Claude 官方演示用代码构建水彩引擎

Claude 官方频道发布视频,演示用 Claude 编写代码构建一个水彩引擎。正文无文字内容,具体实现细节以视频为准。对视觉师和 AIGC 技术整合者来说,这是 AI 编程在风格化视觉生成上的一次官方演示,可参考其工作流思路。

官方演示 Claude 写代码做水彩渲染引擎,视觉师和工具党可以看看 AI 编程在风格化画面生成上的边界,当个思路参考。

点击打开原平台查看,能否访问取决于网络环境

Magnific 展示角色一致性:全程未脱离参考图

Magnific 官方账号发布角色一致性演示,强调生成角色全程未脱离参考图,并附上两个角色的角色设定图链接。展示的是角色一致性保持能力,属于工作流演示而非完整作品。

视觉师可点开看角色一致性保持效果,做 IP 和短剧的可以当参考。

点击打开原文,能否访问取决于网络环境

Seedance 2.5 实测:30 秒 20 个镜头

Lovart 官方转发创作者 @mrdejie 的实测:用 Seedance 2.5 在 30 秒内完成 20 个镜头,发布于 Lovart 平台,并附有完整 prompt。展示该模型在快节奏、多镜头叙事下的出片能力,适合作为短剧或广告分镜节奏的参考案例。

做短剧和快节奏广告的可以看看,30 秒塞 20 个镜头,验证 Seedance 2.5 的镜头切换和节奏控制能力,当个工作流参考。

点击打开原平台查看,能否访问取决于网络环境

Lovart 用 AI 做汉堡广告创意演示

Lovart 官方账号发布一支用 Lovart 工具制作的汉堡广告创意演示,主打食品广告的趣味化表达,展示 AI 在商业广告视觉创意上的应用可能。

Lovart 官方用自家工具做了一支汉堡广告 demo,展示 AI 在食品广告创意上的玩法,做商业广告和视觉的可以点开看看风格参考。

点击打开原平台查看,能否访问取决于网络环境

作者新做口播动效 skill 开放试用

作者 Vincent文森特(@VincentWei93)新做了一款名为 video-talkcraft 的口播视频动效 skill,已开放安装试用。目前为初版,作者自述效果尚未达到满意程度,后续优化后会发布视频展示完全体效果。

做口播、解说类视频的后期可以装来试试,目前是初版,作者说后续会优化并放完全体演示。

点击打开原文,能否访问取决于网络环境

作品与案例

Works

大明14444:AI全民制作人参赛短片

B 站「AI全民制作人」参赛短片《大明14444》,修仙题材,作者自述声线一致性未能锁定,为节约积分未继续调整。个人创作者作品,可拆解点在于角色声线一致性的处理方式与成本控制取舍。

AI 短剧参赛作品,题材是修仙筑基,做短剧的可以拉片看叙事节奏和角色一致性处理。

点击打开原平台查看

众香阁AI唐装微胖AI视频

B站作者「众香阁AI」的AI短片《华服-微胖-唐装》,聚焦唐装华服与微胖体型表现,个人创作者作品,视觉风格偏古风服饰展示。

B站作者「众香阁AI」的AI短片,标题聚焦华服唐装与微胖体型,视觉师可当风格参考,看角色一致性和服饰质感处理。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索