← 全部日报

AIGC 信息日报

2026 年 8 月 28 日 周五

行业与平台

Industry

GLM-5.3-Flash 开源上线硅基流动,成本降九成

智谱 GLM-5.3-Flash 开源并上线硅基流动,总计 320B 参数、仅 18B 激活,原生多模态,MIT 许可,性能强于 GLM-5.2,成本降低 90%,编码与智能体任务接近 Opus 4.8 且成本降低超 95%。硅基流动提供优化推理、高可用性和生产级规模容量,支持 Day-0 调用。

开源大模型,320B 参数只激活 18B,成本降 90%,编码和智能体任务接近 Opus 4.8。做 AI 短剧和工具链的可以接 API 跑一遍,看能不能把批量生成和自动化流程的成本再压一档。

点击打开原文,能否访问取决于网络环境

Google 发布 Gemini Omni 1.1 Flash 视频模型

Google 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供面向专业用途的生成视频能力。新功能包括场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量延长至累计 40 秒)、首尾帧插值、360p 快速草稿(比 720p 快至多 60%、成本为其三分之一)以及最高 4K 分辨率升级。

Google 把视频生成的控制力又往前推了一步,场景扩展、首尾帧、4K 升级都是做片子最常用的操作,做 AI 短剧和后期剪辑的可以直接接 API 试一周。

点击打开原文

Nvidia 129 亿美元收购 Hugging Face,押注开源模型路由

据 The Information,Nvidia 以 129 亿美元收购开源 AI 平台 Hugging Face,约为其年收入 1.5 亿美元的 80 倍。Hugging Face 运营十年,托管开源模型并提供云服务,接近盈利。此举正值 OpenAI、Anthropic 等闭源厂商自研芯片、减少对 Nvidia 硬件依赖之际,Nvidia 或借此扩大云业务,打造开源模型路由平台。

行业级并购,对创作工作流短期无直接影响,但开源模型生态的走向会影响未来工具链选择,技术整合者可以关注。

点击打开原文

MiniMax H3-Max 发布:视频质量与生成速度双提升

MiniMax 官方账号转发 RenLeanna 的推文,宣布 H3-Max 模型发布。该模型将 SOTA 视频质量与生成速度的阶跃式提升相结合,使高质量视频生成更实用。具体参数、价格和开放方式未在推文中详述,需查看官方后续公告。

MiniMax 官方转发的 H3-Max 发布消息,主打 SOTA 视频质量加生成速度跃升。做短剧和视觉的可以蹲一波实测,看废片率和出片速度到底提升多少。

点击打开原文,能否访问取决于网络环境

LipDub 2.0 上线:口型同步更自然,无需训练快 8 倍

LipDub 2.0 正式发布,主打短视频本地化场景。核心升级:口型同步更自然、无需训练、速度提升 8 倍。面向 AI 短剧出海、多语言配音对口型等后期环节,可显著缩短本地化制作周期。

做短剧出海和本地化的后期团队直接受益,口型同步不用再训练模型,速度翻倍,接 API 跑一批样片看效果。

点击打开原平台查看,能否访问取决于网络环境

Magnific 桌面版上线,支持本地处理与同步文件夹

Magnific 推出桌面版应用,支持 macOS 和 Windows,提供文件夹同步、原生快捷键、标签页记忆和本地处理能力,将图像放大与增强流程整合到桌面端。

做视觉和后期的工作流能省不少事,本地处理不用来回传图,装一个试试顺手不顺手。

点击打开原平台查看,能否访问取决于网络环境

AI 短片《The Trials》获澳洲 AI 电影节最佳国际短片

Wonder Studios 出品的 AI 短片《The Trials》获澳大利亚 AI 电影节最佳国际短片奖,由工作室常驻导演兼后期负责人 Hal Watmough 执导,该片也是 Beyond the Loop 第二季的开篇作品,探索电影人如何用新兴 AI 工具推动创作。

AI 短片在国际电影节拿奖,导演是工作室后期负责人,做 AI 短剧和编导的可以看看获奖作品的叙事和后期处理思路。

点击打开原文,能否访问取决于网络环境

Hugging Face 联创发布开源双足机器人 Microduck

Hugging Face 联创 Thomas Wolf 宣布推出 Microduck,一款 25 厘米、15 个执行器的开源双足机器人,配备摄像头、扬声器、LiDAR 等传感器,支持用户通过强化学习自行训练。它开箱即用,内置行走、坐下、轮滑、拾物等多项预训练策略,售价低于 400 美元。

当天有 6 家独立信源在报同一件事,属于行业动向本身。对具体创作流程没有直接用处,但这个量级的消息值得知道。

点击打开原平台查看,能否访问取决于网络环境

阿里云Qwen大会香港站落幕,Agentic AI进入生产阶段

阿里云Qwen Conference Hong Kong 2026落幕,吸引600+行业领袖、16个解决方案展台。会上展示Qwen3.8-Max、QwenWork、Wan3.0、Qwen-Image-3.0等模型,官方释放信号:Agentic AI已从可能性走向生产落地。活动获AMD、Cyberport等合作伙伴支持。

阿里云官方复盘香港站大会,核心信号是Agentic AI从概念走向生产落地。做AI短剧或内容整合的可以关注QwenWork、Wan3.0这些模型在业务场景里的实际接入,但这条本身是活动总结,信息密度一般。

点击打开原文,能否访问取决于网络环境

阿里 Wan 发起技能挑战赛,每周奖励 3 名创作者

阿里 Wan 官方发起「Wan Skill Challenge」技能挑战赛:创作者用 Wan 做出作品后,将其封装为技能并发布到 Wan Video 的 Skills 平台,每周评选 3 个最佳技能,每位获奖者获得 1 个月 Wan 高级会员。活动面向所有 Wan 用户,鼓励把单次创作沉淀为可复用的技能模板。

做 AI 短剧和工具链的可以关注,把 Wan 玩法沉淀成技能模板,既能拿一个月会员,也是给团队攒可复用工作流的机会。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

Photoshop 推 AI 辅助编辑器测试版,支持提示词编辑与蒙版

Adobe 为 Photoshop 新增「AI 辅助编辑器」测试版,采用自然语言提示词编辑方式,提供简化版界面,支持提示词编辑、移除背景、生成式填充等功能,兼容 FLUX 2 Pro、Gemini 3.1、GPT Image 2 等模型,并新增基于提示词的蒙版编辑与非破坏性图层光线调整工具。

做视觉和美术的可以上手试一下,提示词直接改图、去背景、生成式填充都并到一个简化界面里,还兼容 FLUX 2 Pro、Gemini 3.1 这些模型,适合当日常修图的新入口。

点击打开原文

Gemini Live 新增 Agent 能力,语音可执行更多操作

Google 官方账号转发 GeminiApp 消息:Gemini Live 新增生产力升级,引入 Agent 能力,用户可通过语音完成更多操作。具体功能细节(如可执行的任务类型、集成方式)原文未展开。对 AI 创作者而言,语音 Agent 能力可能用于配音、虚拟角色对话或语音驱动的自动化工作流,需查看原文确认具体接入方式。

Google 官方转发 Gemini Live 的 Agent 能力升级,语音交互能干活了。做 AI 配音、虚拟角色对话或语音工作流的可以关注,看能不能接进自己的流程。

点击打开原平台查看,能否访问取决于网络环境

Ideogram 图像模型新增 Very High 模式

PrunaAI 与 Ideogram 合作的 P-Image-Ideogram 模型新增 Very High 模式,采用测试时缩放(test-time scaling)技术提升最终图像质量。该模式面向需要更高精度输出的视觉创作场景,具体效果和参数需查看原文。

做视觉和美术的可以试一下这个新档位,测试时缩放对出图质量有提升,适合需要高精度画面的场景。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

MiniMax H3 Max 实测:15秒电影级提示词出片

@magnific 发布 MiniMax H3 Max 实测:用一段 16:9 电影级提示词生成 15 秒 techno-disaster 喜剧短片,包含三个精确镜头、原生同步英语对白和完整音效设计,场景为蓝色水电站控制大厅内的巨型铜感应线圈。提示词结构完整,可直接复用。

一条带完整 prompt 的 H3 Max 实测,15 秒三镜头带原生对白和音效,做短剧和视觉的可以直接抄这个提示词结构跑一遍。

点击打开原平台查看,能否访问取决于网络环境

Luma 官方教程:8 条提示词保持角色跨镜头一致

Luma AI 官方博客发布教程,提供 8 条 AI 角色提示词模板,解决同一角色在多个镜头中保持一致性的问题。教程面向 AI 视频创作者,重点在于通过提示词工程控制角色外观、服装、发型等视觉特征,使其在连续镜头中不漂移。

官方出的角色一致性提示词模板,做短剧和视觉的可以直接套用,省去自己反复试 prompt 的时间。

点击打开原文

AI 视频文字稳定技巧:引号加位置描述

Magnific 官方分享 AI 视频中文字稳定的四条提示词技巧:将需要显示的文字用引号精确框出;明确说明文字位置(如杯子上、屏幕上);保持字符串简短,句子易碎而标签不易;靠近需要阅读的文字时放慢镜头。

做 AI 视频的都知道文字容易飘,这条给了四条实操口诀:引号框住原文、说清位置、短句优先、镜头放慢。视觉师和后期可以直接收藏当 prompt 模板用。

Magnific 分享单提示词写升级戏的四个要点

Magnific 官方分享单条提示词内构建叙事升级的方法:给镜头编号并打时间戳、全程保持一个元素恒定、只升级一个变量而非多个、把揭示放在最后两秒。

做 AI 短剧和编导的可以收藏这条,讲的是怎么在一条提示词里写出有层次的升级戏:镜头编号、固定一个元素、只升级一个变量、最后两秒揭晓。

GEN-1.5 物理提示词可控性示例

Generalist AI 官方发布 GEN-1.5 物理提示词可控性示例,展示相同环境下不同提示词产生不同行为,并附博客文章链接。

官方演示物理提示词如何控制画面行为,做 AI 视频的可以看看提示词怎么影响生成结果,当个参考。

点击打开原平台查看,能否访问取决于网络环境

Pika 对比 WAN 3.0 与 Seedance 2.5 模拟 UGC 自拍视频

Pika 官方账号发布对比演示:用同一 prompt 生成两段自拍视角视频,分别由 WAN 3.0 和 Seedance 2.5 完成,重点展示模型模拟 UGC 内容(如意外猫闯入)的临场感与真实度。

两条模型生成同一 prompt 的自拍视频,模拟 UGC 的临场感是看点,做短剧和视觉的可以拉片对比两家在真实感上的差距。

点击打开原平台查看,能否访问取决于网络环境

超写实 3×3 肖像联系表提示词:锁定同一人物身份

M. Asif 分享一套超写实 3×3 摄影肖像联系表提示词,核心是身份锁定:九个画面保持同一年轻女性,锁定面部结构、脸型、灰绿色眼睛、肤色等特征,禁止身份漂移和换脸。九个候选瞬间覆盖咖啡馆、书店、户外等场景,统一黑色针织上衣造型。适合用来测试图像模型在多人格/多机位下的角色一致性表现。

做角色一致性测试的视觉师可以直接抄这套提示词,九个机位锁定同一张脸,跑一遍就知道模型身份漂移控制得怎么样。

点击打开原文,能否访问取决于网络环境

Framer 发布 9 分钟 AI 角色唇同步教程

Framer(@Framer_X)公开发布一段 9 分钟完整教程,讲解如何为 AI 角色创建最佳唇同步效果。教程面向 AI 角色动画制作,覆盖从口型匹配到同步优化的完整流程,适合 AI 短剧、虚拟主播和角色动画后期环节直接参考使用。

做 AI 短剧和虚拟角色的后期可以收藏,9 分钟讲清唇同步工作流,直接照着跑一遍。

点击打开原平台查看,能否访问取决于网络环境

个人开发者开源 IP 形象生成 SKILL

个人开发者「兔崽 Dora」开源了一个 SKILL(personal-ip-image-pack),可产出多种风格的 IP 形象,并支持用户自行添加任意形象到其中,代码托管在 GitHub。

个人开发者开源了一个能产出多种风格 IP 形象、还支持自定义形象加入的 SKILL,做角色 IP 和视觉开发的可以拉下来跑一遍看风格覆盖度。

点击打开原平台查看,能否访问取决于网络环境

开源 Agent Skill 让 AI 自动下载视频号无水印视频

开发者 Kin 开源一个 Agent Skill(GitHub: KinGao294/wechat-video-skill),让 Claude Code / Codex / Cursor 等 Agent 学会自动下载微信视频号视频,输入链接几秒后返回无水印 MP4 到微信/飞书,全程本机运行、登录态不出设备,完全免费。

做 AI 短剧和素材收集的可以装一个,把视频号链接丢给 Agent 几秒出无水印 MP4,省掉手动扒素材的功夫。

点击打开原文,能否访问取决于网络环境

作品与案例

Works

B站AI短剧《星际外卖员》登全站榜24名

B站AI全民制作人参赛作品《星际外卖员》,星际外卖题材短剧,登上全站排行榜第24名,视频标注含AI生成内容,主打强冲突开场(迟到3秒被扇巴掌)和快节奏叙事。

B站AI全民制作人参赛作品,星际外卖题材成片冲上全站榜24名、播放512万。做AI短剧的可以拉片看它怎么用强冲突开场和快节奏叙事留住观众。

点击打开原平台查看

中式志怪AI电影《窃丹-求水》发布,单人月产成本800元每分钟

B站作者发布中式志怪类AI电影《窃丹-求水》,为《窃丹-卖龙》系列前传,讲述卖龙故事的缘由和起点。单人制作周期一个月,每分钟算力成本约800元,参与AI全能艺术家计划。

中式志怪题材,单人一个月做完,每分钟算力成本800元,做AI短剧的可以拉片看叙事和成本控制。

点击打开原平台查看

AI 生成《红色警戒2》史诗战争短片

创作者 @EHuanglu 用 AI 制作了一部完整的《红色警戒2》题材史诗战争短片,已发布可观看。题材为游戏改编的战争叙事,视觉风格偏宏大场面,适合拆解 AI 在战争场景、镜头调度和风格一致性上的处理方式。

AI 生成的《红色警戒2》战争短片,做 AI 短剧和视觉的可以拉片看战争场面调度和风格化处理。

点击打开原平台查看,能否访问取决于网络环境

B站AI小剧场《当新来的医生吸引了AI护士》第三集

B站 UP 主「AI精品分享」的 AI 小剧场系列《当新来的医生吸引了AI护士》第三集,44 秒短篇,含 AI 生成内容标签。系列围绕 AI 护士与医生、AI 女友等轻喜剧题材展开,单集时长较短,偏日常互动向叙事。

AI 小剧场系列第三集,44 秒短篇,做 AI 短剧的可以扫一眼这类轻喜剧题材的节奏和角色互动处理。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索