← 全部日报

AIGC 信息日报

2026 年 8 月 29 日 周六

行业与平台

Industry

MiniMax FastH3 v1 开源:13秒生成15秒768p视频

MiniMax 联合 NVIDIA、FastGen 发布开源模型 FastH3 v1,可在 13 秒内生成 15 秒 768p 视频,在 NVIDIA Blackwell GPU 上实现最高 14 倍加速。模型权重与加速方案完全开源,社区可自行运行和改进。团队表示开源视频模型时代已开启,后续将分享更多关于后训练如何提升速度与质量的经验。

开源视频模型加速方案,13 秒出 15 秒 768p 成片,做短剧和批量生产的团队可以关注本地部署和提速的可能性。

点击打开原平台查看,能否访问取决于网络环境

GLM-5.3 开源上线硅基流动,编码智能体对标 Fable 5

智谱 GLM-5.3 开源并已在硅基流动 SiliconFlow 上线,提供 Day-0 支持。与 GLM-5.2 相同的基座模型(744B 总参/40B 激活),通过后训练大幅提升智能,在前沿编码和智能体基准测试中与 Fable 5 和 GPT-5.6 Sol 具有竞争力。硅基流动在 OpenRouter 上 GLM-5.2 token 份额排名第一,现将该体验带到 GLM-5.3。

GLM-5.3 开源并已在硅基流动上线,744B 总参/40B 激活,编码和智能体基准对标 Fable 5 和 GPT-5.6 Sol。做工具链整合的可以接 API 测一周,看能不能替代现有模型跑自动化流程。

点击打开原文,能否访问取决于网络环境

Google 本周推出 Gemini 3.5 Transcribe 与 Omni 1.1 Flash

Google AI 官方介绍本周新品:Gemini 3.5 Transcribe 语音转写模型,主打高精度智能转写;Gemini Omni 1.1 Flash 升级视频生成与编辑的创意能力和控制力(该产品 8 月 28 日已发布);另有 GeminiApp 的 Live 相关功能更新。具体参数和开放时间待官方后续披露。

Google 官方周更汇总,一口气带来两款新模型:更精准的语音转写和视频生成编辑增强版。做后期字幕和 AI 视频的可以关注,等具体参数出来再实测。

点击打开原文,能否访问取决于网络环境

腾讯混元发布 Hy4 preview:770B 参数、1M 上下文,开源上线

腾讯混元发布新一代旗舰模型 Hy4 preview,总参数 770B、激活参数 49B、上下文长度 1M,现已开源并在腾讯云 TokenHub 和 OpenRouter 上线。对 AI 创作者来说,1M 上下文意味着可直接处理超长剧本或小说级文本,开源和双平台上线降低了接入门槛,适合做长叙事和批量内容生成的团队实测。

国产大模型旗舰开源,770B 总参数、1M 上下文,做 AI 短剧和工具链整合的可以接 API 测一周,看长剧本理解和批量生成能力。

点击打开原文

Krea 预告 Krea 3 基础模型与 Krea Agents 两大更新

Krea 官方预告两大更新:Krea 3 是新一代基础模型,在 Krea 2 的美学多样性和个性化基础上强化编辑能力;Krea Agents 为并行推出的智能体功能。目前为预告阶段,具体上线时间和能力细节待官方后续公布。

Krea 官方预告下一代基础模型 Krea 3 和 Krea Agents,主打编辑能力和美学多样性,视觉师和做风格化内容的可以蹲正式发布。

点击打开原文,能否访问取决于网络环境

Fish Audio 语音工作室上线安卓版

Fish Audio 官方宣布其语音工作室(Voice Studio)正式上线 Android 平台,用户可通过链接获取。该工作室此前已覆盖其他平台,此次补齐安卓端,意味着配音、音色克隆等语音创作能力可在移动端使用。

做配音和后期音效的可以装一个,手机端直接跑整套语音工作流,出门在外也能随时出活。

点击打开原文,能否访问取决于网络环境

Wonder 制片人作品入围 XPRIZE 未来视觉大赛 50 强

Future Vision XPRIZE 公布 Top 50 入围名单,Wonder 公司常驻电影人兼后期主管 Hal Watmough 的作品《SLINGSHOT》从全球 2500 部影片中入选。该赛事聚焦 AI 影像创作,入围作品可在线观看并投票。

AI 影视从业者可以看看入围作品,了解全球 AI 影像竞赛的评审口味和创作水准,制片人可关注赛事背后的商业机会。

点击打开原文,能否访问取决于网络环境

腾讯混元宣布免费两周

腾讯混元官方账号宣布免费两周,具体免费范围(模型、功能、额度)未说明。对创作者来说,这是一个低成本实测腾讯混元视频生成能力的窗口期,适合短剧团队和批量出片需求方在免费期内评估其出片质量与工作流适配度。

腾讯混元官方宣布免费两周,做短剧和批量出片的团队可以趁窗口期实测一下出片质量和成本,值不值得接进工作流跑两周就知道。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

Flow Music Spaces 上线实时音乐生成

Google Flow Music Spaces 将 Lyria RealTime 模型接入 Spaces,支持实时音乐生成。用户可即时调整流派、乐器等参数,声音随操作实时变化,并可从 MusicFX 模板开始 remix。

做后期配乐和音效的可以直接上手试,实时改风格和乐器,配乐效率能提一档。

MiniCPM-o 4.5 量化版登陆苹果芯片,本地多模态推理

面壁智能 MiniCPM-o 4.5 现可通过 TyloQuant MFQ 量化版在 Apple Silicon 上高效运行,支持本地多模态推理。TyloQuant MFQ 采用神经元感知的混合格式量化,降低内存占用同时保留视觉、音频与实时交互能力,提供多种量化等级及 Metal/CUDA 内核加速。

做本地工具链的可以关注,量化后能在 Apple Silicon 上跑多模态推理,省内存还保留视觉和实时交互,适合搭离线创作工作流。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

H3 Max 实测:生成速度比观看还快

Ethan Mollick 实测 H3 Max 网页界面,生成质量尚可的 AI 视频所需时间已短于视频本身时长,从按下生成按钮起即为实时,且包含提示词增强环节。

Ethan Mollick 实测 H3 Max 网页端,生成速度已快过观看时长,做短剧和批量出片的可以实测一下出片节奏。

点击打开原平台查看,能否访问取决于网络环境

Lovart 演示 Seedance 2.5 单图生成 30 秒写实 vlog

Lovart 官方演示 Seedance 2.5 能力:单张照片生成 30 秒 1080p 超写实个人 vlog,模拟亚洲年轻人秋日下午的居家生活场景,并附完整 prompt 供复现。对创作者来说,这是单图驱动长镜头叙事的工作流参考,适合短剧和视觉团队实测真实感与连贯性。

官方演示 Seedance 2.5 在 Lovart 上单图生成 30 秒写实 vlog,附完整 prompt,做短剧和视觉的可以照着跑一遍看真实感上限。

点击打开原平台查看,能否访问取决于网络环境

鱼总聊AI揭秘爆火AI短剧制作过程

鱼总聊AI(@AI_Jasonyu)分享其全网爆火、播放量几千万的AI短剧制作过程,全程录制。该5分钟视频为作者首次尝试AI短剧,制作耗时约一个半小时。制作工具为Topview,核心提效点是其Agent可批量创建场景画布,调整速度快;缺点是直出视频时调整可能消耗较多Token。

做AI短剧的可以看看,作者第一次做短剧,5分钟成片只花一个半小时,用Topview的Agent批量建场景画布提效,直出视频费Token的坑也点出来了。

点击打开原平台查看,能否访问取决于网络环境

Picsart 视频产品负责人分享 Wan3.0 提示词玩法

阿里云官方账号转发 Picsart 视频产品负责人 Narek Hayrapetyan 的 Wan3.0 提示词实战分享,内容涵盖结构化提示词写法、音频分层处理、Omni-Reference 功能最大化利用,并附有对模型适用场景的个人评价。

做 AI 视频的可以看看一线团队怎么结构化写提示词、分层铺音频、榨干 Omni-Reference,直接套用进自己的工作流。

点击打开原平台查看,能否访问取决于网络环境

Magnific Agent 结合 MiniMax H3 Max 出片演示

Magnific 官方演示其 Agent 工具结合 MiniMax H3 Max 的生成效果,主打「无限代次生成」概念,强调 H3 Max 本身强大快速,但配合自家工具链后出片效果更佳。帖子附 5 条成片视频及对应 prompt。

做 AI 短剧和视觉的可以点开看 5 条成片和配套 prompt,重点看 Magnific 的 Agent 怎么把 H3 Max 的生成串成完整工作流。

点击打开原平台查看,能否访问取决于网络环境

阿里云万相3.0创作者实战工作流分享

阿里云官方与Pixmax团队的Liz Zhang对谈,分享万相3.0在真实项目中的实战工作流,包括发布概念片、围绕模型构建完整创意流程,并预告创作者社区下一步计划。官方同时给出Model Studio和Qwen Cloud两个API接入入口。对AI编导和视觉师来说,这是了解万相3.0从单次生成走向项目级工作流的一手参考,API接入路径也直接可用。

阿里云官方下场聊万相3.0怎么在真实项目里用,不是点生成按钮那种。做AI短剧和视觉的可以看看Pixmax团队怎么搭完整创意工作流,顺便摸清Model Studio和Qwen Cloud的API接入路径。

点击打开原平台查看,能否访问取决于网络环境

GLIF 代理实测:迷因角色同街景无缝转场

创作者 fabian 用 GLIF 代理,将多个迷因角色统一放置在同一纽约街头场景、统一灯光,角色间用 H3 Max 生成无剪切连续转场,并配上搞笑音乐,最终输出一段连续镜头。展示了用代理调度多角色、保持场景与灯光一致性的工作流。

用 GLIF 代理把一堆迷因角色放进同一纽约街景、统一灯光,再用 H3 Max 做无剪切连续转场。做 AI 短剧和视觉的可以看看这套「多角色同场景一致性」的调度思路。

点击打开原平台查看,能否访问取决于网络环境

玉伯分享 YouMind 30 分钟产出百万爆文流程

玉伯(Frank Wang)分享用 YouMind 在 30 分钟内完成一篇百万阅读爆文的创作流程:粘贴《我的女友景甜》原文链接,让 YouMind 从景甜视角搜索信息并按原文风格写作,约 5 分钟出初稿,经 3 条修改意见后约 10 分钟定稿,再用 Agent 配封面图并一键发布到 X Article。关键点是在 YouMind 里选择 Claude Opus 4.6 模型,YouMind 在搜索、写作和配图场景做了领域优化。

个人创作者用 YouMind 30 分钟从选题到发布跑通一篇百万阅读文章,核心是选 Claude Opus 4.6 模型。做内容生产的可以套这套流程试试,重点在搜索、写作、配图三个环节的提示词配合。

点击打开原文,能否访问取决于网络环境

Lovart 教程:一张照片三步复刻蜘蛛侠 AI 特效

Lovart 官方发布蜘蛛侠 AI 特效教程,用一张面部照片加三步操作即可完成,核心是先生成角色设定图(character sheet)再驱动动作,替代传统 VFX、3D 或实拍跳窗方案。

做 AI 特效和角色一致性的可以看,官方演示了用一张脸照加角色设定图在 Lovart 里三步出蜘蛛侠效果,省掉传统 VFX 和 3D 流程。

点击打开原平台查看,能否访问取决于网络环境

Recraft 官方教程:AI 修复老照片全流程

Recraft 官方博客发布 AI 修复老照片的实用指南,覆盖扫描、去除损伤、放大、色彩还原四个步骤,并说明 AI 修复的局限性。面向后期修复场景,属于基础操作教程,无特定模型或工具参数细节。

后期和视觉师可以当基础操作手册看,扫描、去损、放大、上色四步流程讲得清楚,还点明了 AI 修不了什么,适合当团队内部培训材料。

点击打开原文

作品与案例

Works

B站AI短剧1-6季合集,主打剧本与镜头语言

B站UP主「哈哈动漫管」发布的AI短剧合集,覆盖1-6季内容,标题强调剧本和镜头语言是核心看点,并突出画质表现。视频标注含AI生成内容,属于个人创作者的长篇AI短剧作品。

B站UP主「哈哈动漫管」的AI短剧1-6季合集,标题主打剧本和镜头语言,做AI短剧的可以拉片看长叙事和画质处理。

点击打开原平台查看

AI 短片:自大女主战败虫魔物

B 站作者「都打僵尸啊的」发布的 AI 短片,2K 画质,题材为奇幻战斗向,讲述自大女主面对虫子魔物战败的后果。个人创作者作品,具体工具链和制作细节未在标题中体现。

B 站个人创作者的 AI 短片,2K 画质,题材偏奇幻战斗向。做 AI 短剧的可以拉片看战斗场面和角色状态切换的处理,当个风格参考即可。

点击打开原平台查看

AI全民制作人:终身免单卡食物套餐选择

B站「AI全民制作人」系列短片,以「终身免单卡选食物套餐」为互动选题,属于个人创作者作品,题材偏生活化互动叙事。

B站AI短片,题材是互动式选择玩法,做AI短剧的可以看看这种互动叙事怎么落地。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索