← 全部日报

AIGC 信息日报

2026 年 8 月 26 日 周三

行业与平台

Industry

阿里云 Wan3.0 上线 fal 平台,支持文生图生参考生视频

阿里云官方介绍 Wan3.0 视频生成模型(该产品 8 月 7 日已发布),评测者称其质量持续高水准而非偶发,相较 Wan2.7 是全新模型。支持文生视频(T2V)、图生视频(I2V)和参考生视频(R2V),现已上线 fal 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。评测还分享了 30 秒视频生成时代的提示词技巧。

阿里云 Wan3.0 已上线 fal 平台,评测称质量稳定高水准,支持 T2V/I2V/R2V 三种模式,并开放 API。做 AI 视频的可以上手实测,对比 Wan2.7 看废片率降了多少。

点击打开原平台查看,能否访问取决于网络环境

Qwen 3.8-Flash-Next 明日发布,125B 参数多模态 MoE

通义千问宣布 Qwen 3.8-Flash-Next 将于 2026-08-26 15:00(UTC)发布,参数规模 125B a6B,是基于下一代 Qwen4 架构的多模态 MoE 模型,提前放出架构进展为 Qwen4 家族预热。模型页面已上线 ModelScope,将开源 Qwen3.8-Flash-Next 及 FP8 版本。

通义千问新一代架构的先行版,125B 参数多模态 MoE,明天下午 3 点开源。做工具链整合的可以蹲一下,看能不能接进自己的生成流程。

点击打开原文

ElevenLabs 推出 Composer 分段歌曲编辑器

ElevenLabs 发布 Composer,一款分段式歌曲编辑器。支持从自己的歌词、已有音轨、空白页或一句提示词开始创作,然后逐段(section-by-section)塑造整首歌直至完成。面向音乐制作与声音创作场景,适合需要精细控制歌曲结构的创作者。

做 AI 短剧配乐和后期声音的可以直接上手试,分段编辑比整首生成好控制,能按段落打磨到满意为止。

点击打开原平台查看,能否访问取决于网络环境

苹果发布 M6/M5 Pro 版 Mac mini,LLM 处理提速最高 8.5 倍

苹果发布搭载 M6 与 M5 Pro 芯片的新款 Mac mini。M6 版 AI 性能较 M4 提升最高 4 倍,CPU 快 40%,存储与图形性能翻倍;M5 Pro 版支持最高 64GB 统一内存与 307GB/s 带宽,LM Studio 中 LLM 提示词处理较 M2 Pro 快最高 8.5 倍,Blender 光线追踪渲染快 4.5 倍。两款均支持 Wi-Fi 7、蓝牙 6 与 2.5Gb 以太网,今日起预购,9 月 22 日开售。

做 AI 视频和短剧的,本地跑模型、批量渲染的硬件底座升级了,M6 版 AI 性能较 M4 提升最高 4 倍,M5 Pro 版 LLM 提示词处理较 M2 Pro 快最高 8.5 倍,预算够的可以蹲 9 月 22 日开售。

点击打开原文

苹果发布 M5 Ultra:四芯片架构,AI 性能提升 4.5 倍

苹果发布 M5 Ultra 芯片,首次采用 UltraFusion 四芯片架构,最高 36 核 CPU、80 核 GPU,统一内存带宽 1.2 TB/s(比 M3 Ultra 高 50%),支持 512GB 统一内存,可在设备端运行数千亿参数大模型。AI 峰值 GPU 性能较 M3 Ultra 提升最高 4.5 倍,图形性能提升 40%,配备四路 ProRes 编解码引擎和硬件加速 AV1 解码,面向 3D 渲染、视觉特效和本地 AI 推理场景。

做 AI 视频和 3D 渲染的团队,本地跑大模型和重渲染的硬件天花板又抬高了,换机前值得看一眼参数。

点击打开原文

Perplexity 发布 Portable Computer 本地版

Perplexity 发布 Portable Computer,这是 Perplexity Computer 的完全本地版本,整个运行时(调度 LLM、子代理 LLM、代理框架)都在本地硬件上运行,无云端依赖,支持 NVIDIA DGX Spark。对 AIGC 创作者来说,这意味着 Agent 工作流可脱离云端在本地跑,适合对数据隐私和成本敏感的场景,但当前与影视创作流程的直接关联有限。

本地化 Agent 运行时,不依赖云端,做自动化工作流的整合者可以关注,但对拍片创作本身影响有限。

点击打开原文,能否访问取决于网络环境

苹果发布全新 Mac mini,主打 AI 应用性能

苹果 CEO Tim Cook 官宣全新 Mac mini 发布,主打体积小巧、性能强劲,官方强调其能胜任从日常生产力到各类 AI 应用的任务。具体芯片型号、内存配置和价格未在推文中披露。对 AI 创作者来说,新款 Mac mini 的本地 AI 推理和视频处理性能值得关注,但具体规格需查看官方详情页。

苹果官方发布新款 Mac mini,主打小体积高性能和 AI 应用支持。做 AI 视频和本地推理的后期、技术整合者可以关注硬件升级对本地工作流的影响。

点击打开原平台查看,能否访问取决于网络环境

商汤 SenseNova U1.5 Lite 开源并开放免费公测

商汤官方介绍 SenseNova U1.5 Lite(该产品 8 月 22 日已发布),已开源并上线 Token 计划,提供免费公开测试,每 5 小时 1500 次请求额度。模型支持图像生成与编辑一体化,并支持参考图输入。

商汤把 U1.5 Lite 开源,还给了每 5 小时 1500 次的免费额度,做视觉和短剧的可以接 API 实测图像生成和编辑的稳定性。

点击打开原文,能否访问取决于网络环境

Breeze TTS 2 登顶开源语音合成竞技场

Breeze TTS 2 在 Artificial Analysis Provider Voices 语音竞技场中成为排名第一的开源权重 TTS 模型,Elo 达 1215,领先 Fish Audio S2 Pro 90 分,总排名第 6。对做配音、短剧对白、有声内容的后期团队来说,开源权重意味着可本地部署、成本可控,值得实测对比现有配音方案。

开源 TTS 里目前最能打的,Elo 1215 领先 Fish Audio S2 Pro 90 分。做配音、短剧对白、有声内容的后期团队可以实测一下,开源意味着能本地部署,成本可控。

点击打开原平台查看,能否访问取决于网络环境

Clueso 代理自主录制屏幕并自动剪辑发布视频

Clueso 代理可完全自主捕获产品屏幕录像,并自动编辑视频,添加精准时机的放大效果、聚光灯突出 UI 元素,生成动态图形,产出精美的发布视频。面向产品演示和营销视频场景,主打自动化录屏与剪辑一体化。

做产品宣传片和教程的后期可以看看,自动录屏加剪辑、放大、聚光灯和动态图形,能省不少手工活。

工具与能力

Tools

HeyGen LiveAvatar 取消并发限制,1080p 低至每分钟 1 美分

HeyGen 官方宣布 LiveAvatar 团队今日重大更新:并发限制彻底取消(非提升),同一 API 可同时运行 1 个或一万个会话,全身体 1080p 视频在规模化下低至每分钟 0.01 美元。面向大规模虚拟角色、直播和数字人内容生产场景,官方建议从链接开始规划大规模项目。

做虚拟角色对话、直播和批量数字人内容的团队,并发限制取消意味着可以放开跑量,成本也压到每分钟 1 美分,值得接 API 实测一周。

点击打开原文,能否访问取决于网络环境

OpenAI 推 Jalapeño 提升响应速度与稳定性

OpenAI 官方宣布代号 Jalapeño 的基础设施升级,目标是提升 ChatGPT 响应速度、让 Codex 会话和 Agent 更灵敏,并在需求增长期保持稳定访问。官方推文未给出具体技术参数或上线时间。对依赖 ChatGPT 和 Codex 做批量生成、自动化剪辑流程的创作者来说,响应更快、会话更稳意味着跑长任务时中断和等待会减少。

OpenAI 官方宣布基础设施升级,ChatGPT 响应和 Codex 会话都会更快更稳。做 AI 短剧批量出片、依赖 API 自动化的团队,跑批任务时能少等、少断,值得留意。

点击打开原文,能否访问取决于网络环境

ChatGPT Work 可代登录网站账号,代办 20 余项事务

ChatGPT Work 现可调用其计算机和浏览器,在网页及移动端安全登录网站,全程不接触用户名或密码。用户可让其代办理水电开通、预约 DMV 或护照、查询保险报销、预约医生、处理车辆登记续期、提交报销单据等 20 余项事务。

ChatGPT Work 的 Agent 能力又进一步,能自己登录网站代办水电、预约、报销等事务。做 AI 短剧和内容生产的团队,可以琢磨怎么把这套自动化接进自己的批量制作流程里。

Gemini macOS 应用新增语音听写与摘要

Gemini macOS 应用新增语音交互能力,支持在任意窗口内直接用语音听写、总结文件并改写文案,无需切换应用。该功能面向日常文字处理与内容整理场景,可提升文案修改、资料总结等环节的效率。对创作者来说,语音听写和改写能力可辅助脚本撰写、文案润色等文字工作,但核心创作流程(画面、剪辑)不受影响。

做后期和文字工作的可以试试,语音直接写进任意窗口,改文案、总结文件不用来回切工具,效率能提一截。

点击打开原平台查看,能否访问取决于网络环境

LetzAI 自动高亮 AI 片段剪辑点,方便快速导出最佳镜头

LetzAI 推出新功能:自动识别并高亮 AI 生成片段中的剪辑点(cuts),帮助创作者更轻松地编辑、审阅和导出最佳镜头。该功能面向 AI 视频后期流程,减少手动逐帧定位剪辑点的操作。

做 AI 短剧和后期剪辑的可以试试,自动标出片段里的剪辑点,省得自己一帧帧找,导出最佳镜头会快不少。

点击打开原平台查看,能否访问取决于网络环境

HappyOyster 上线冒险模式:图片加提示词生成可探索互动世界

HappyOyster 推出冒险模式(Adventure Mode),可将一张图片和一个提示词转化为可探索的互动世界,用户可选择进入不同世界,BGM 由 HappyShrimpAI 提供。

一张图加一句提示词就能生成可探索的互动世界,做短剧和视觉开发的可以当场景预演工具试试,看能不能直接当分镜底稿用。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

Wan3.0 长视频工作流分享:创作者可自主控制叙事节奏

阿里 Wan 官方账号转发创作者 @NOSNOWISXVW 的 Wan3.0 全流程工作流分享,核心亮点是支持生成长视频,单次生成产出更多内容,创作者可按自己的意图控制故事节奏。该工作流基于 @openart_ai 平台。

官方转发的创作者实测,讲 Wan3.0 长视频生成怎么串进完整工作流,做 AI 短剧和长片的可以看看别人怎么控制叙事节奏。

点击打开原平台查看,能否访问取决于网络环境

Kyutai 开源 Pocket TTS 训练全栈,可自训语音模型

Kyutai 实验室开源 Pocket TTS 完整训练栈,包含数据工作流、训练配方和评估方法,支持在个人 GPU 上从零训练文本转语音模型,训练后可部署到任意设备的 CPU 上运行。对配音和后期团队来说,这意味着可以训练出专属音色的 TTS 模型,摆脱对云端 API 的依赖,实现本地化、低成本的语音生成。

做配音和后期音效的可以关注,官方开源了从数据到评估的完整训练流程,想自己训一个专属 TTS 模型的可以照着跑一遍。

点击打开原平台查看,能否访问取决于网络环境

创作者分享《猩红女祭司》AI 短片完整提示词

创作者 Minuit 发布 AI 短片《The Scarlet Priestess》,公开完整制作流程:Midjourney + GPT Image 2 生成画面,Seedance 2 做动态,Capcut 剪辑。附 15 秒多镜头 16:9 超写实真人电影幻想序列的完整提示词,核心设定是女祭司举杖冻结时间,雨滴、树叶、碎片悬停空中,唯她本人保持运动。提示词强调绝对摄影写实,明确排除 3D/CGI/游戏渲染质感,要求自然皮肤纹理、布料垂坠、真实重力与镜头光晕。

一条带完整提示词的 AI 短片创作分享,Midjourney + GPT Image 2 + Seedance 2 + Capcut 四工具串起来做超写实真人电影感,视觉师和编导可以直接抄提示词跑一遍看效果。

点击打开原平台查看,能否访问取决于网络环境

图像转可探索 3D 世界:本地免费跑高斯 splat

Mickmumpitz 分享一套方法:用虚拟 360 度无人机在场景中飞行,绘制世界地图并生成合成数据集,用于高斯 splat 训练,从而将单张图像转化为可探索的 3D 世界。全程本地运行、完全免费。

把静态图变成能飞进去看的 3D 场景,本地免费跑,视觉师和做场景预演的可以收藏这套工作流。

点击打开原平台查看,能否访问取决于网络环境

Magnific 分享跨场景一致性工作流:空场景生成后回填参考

Magnific 官方分享跨场景一致性工作流:先单独生成一次空场景(无人物),再将其作为参考图回填到该房间的每个镜头中,实现同一厨房在三条时间线、相隔十五年的场景下保持视觉一致。

做 AI 短剧和视觉的可以学这招:先把空场景生成一次,再当参考图喂回给每个镜头,同一房间跨时间线也能保持一致性。

点击打开原文,能否访问取决于网络环境

AtlasV 集成阿里云 Wan 2.7 做 AI 时尚视频

阿里云官方发布案例:AtlasV 的 Collart 平台集成阿里云 Wan 2.7,将产品和模特静态照片转化为可扩展的高质量 AI 时尚视频,无需摄影棚,制作更快且无传统拍摄限制。Wan 2.7 可在阿里云 Model Studio 试用。

阿里云官方案例:AtlasV 的 Collart 平台把静态产品图转成动态时尚视频,做电商广告和品牌视觉的可以看这套工作流怎么落地。

点击打开原平台查看,能否访问取决于网络环境

MiniMax H3 视频换背景实测:把人放进车里保留唇同步

创作者 fabian 分享用 MiniMax H3 video2video 功能,将人物视频背景替换为车内(或城堡等)场景,并保留原始音频与唇同步。该功能通过 Glif 技能链接提供,适合短视频创作者快速制作场景变换内容。

用 MiniMax H3 的 video2video 把人物换到车里或城堡,音频和唇同步保留得不错,做短视频和短剧的可以拿这个 Glif 技能跑一遍试试。

点击打开原平台查看,能否访问取决于网络环境

AI真人剧主角图被识别成真人?分享防误判 Prompt

创作者 @Sukiea1008 分享解决 AI 真人剧主角图片被识别为真人面部问题的 Prompt 方案:masterpiece, best quality, 1 person, hyperrealistic but stylized, painted texture, not real photo, clean white background, character sheet, front view, soft brush strokes, slight illustration style --ar 3:4 --style raw。核心思路是通过加入 painted texture、not real photo、slight illustration style 等关键词,在保持超写实风格的同时明确区分于真实照片。

做 AI 真人剧的常被平台把主角图当真人脸卡住,这条给了现成 Prompt 模板,视觉师和短剧团队可以直接抄去跑一遍。

点击打开原文,能否访问取决于网络环境

瑞安航空用 Synthesia 批量生成乘客通知视频

Synthesia 官方客户案例:瑞安航空在航班延误等突发情况下,用 Synthesia 为乘客批量生成个性化通知视频,制作效率提升最高 90%,并支持多语言本地化分发。

Synthesia 官博客户案例:航班延误时给乘客发定制视频通知,制作提速 90%。做企业级 AI 视频交付的团队可以看这套批量生成+多语言本地化的流程怎么落地。

点击打开原平台查看,能否访问取决于网络环境

Anthropic 用 Claude Code 自动生成销售个性化周报

Anthropic 市场团队成员 Adam Ward 分享用 Claude Code 将每周销售报告转化为每位客户经理的个性化周一简报。通过 MCP 连接 BigQuery 和 CRM 数据,依据销售与经理反馈迭代提示词,加入"绝不编造 URL"等九条内容规则。该简报已推广至所有销售团队,每周一自动发送三条优先行动项及账户相关活动。

做 AI 工作流整合的可以看:用 Claude Code 接 MCP 连数据库和 CRM,把周报变成自动化的个性化简报,思路能直接搬到内容分发和客户运营场景。

点击打开原文

作品与案例

Works

Pika 官方展示 Wan 3.0 单次生成叙事短片

Pika 官方账号发布一条由 Wan 3.0 单次生成(one generation)完成的短片,官方评价其准确理解了荒诞冷幽默(surreal deadpan comedy)的叙事意图。短片已发布可观看,属于单次生成叙事能力的官方演示。

Pika 官方用 Wan 3.0 单次生成讲完一个荒诞冷幽默故事,做 AI 短剧的可以点开看单次生成能承载多少叙事量。

点击打开原平台查看,能否访问取决于网络环境

Luma 官方展示 AI 短片《L'heure Bleue》

Luma 官方账号转发创作者 Bryan Soegondo(@DreamLabLA)用 Luma 制作的 AI 短片《L'heure Bleue》,蓝调时刻一名杀手穿过大理石地板执行任务,主打光影氛围与叙事张力。

Luma 官方转发的 AI 短片,蓝调时刻杀手题材,做 AI 短剧的可以拉片看光影氛围和叙事节奏怎么用提示词带出来。

点击打开原平台查看,能否访问取决于网络环境

MiniMax H3 MAX 演示:单次生成人脸声音环境音

Magnific 官方发布一条 AI 短片 demo:一位在灯塔独居 41 年的女性,人脸、声音、风声和房间环境音全部由 MiniMax H3 MAX 在单次 10 秒生成中完成。同时宣布 Magnific 平台限时 48 小时提供 MiniMax H3 MAX 无限量使用。

一条 10 秒的 AI 短片 demo,亮点是单次生成就把人脸、声音、风声和房间环境音全包了,做 AI 短剧和后期配音的可以看看这种全要素一次出的效果稳不稳。

点击打开原平台查看,能否访问取决于网络环境

创作者用 Scenario 做出近 4 分钟连贯 AI 短片

创作者 Shaun 用 Scenario 平台制作了一部近的 AI 短片,被同行 @emmanuel_2m 评价为保持了惊人的连贯性,且讲述了一个真正感人的故事。该短片展示了在长叙事中避免常见 AI 伪影和垃圾内容的可能性。

有人用 Scenario 做出近连贯 AI 短片,被同行夸故事感人。做 AI 短剧的可以点开拉片,看长叙事下怎么压住 AI 垃圾和伪影。

点击打开原平台查看,能否访问取决于网络环境

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索