← 全部日报

AIGC 信息日报

2026 年 9 月 18 日 周五

行业与平台

Industry

广电总局:前 8 个月上线微短剧 43 万部,AI 剧占比超九成

广电总局在国新办发布会上披露:全国微短剧用户超 8 亿,2025 年市场规模突破千亿元;今年前 8 个月上线微短剧 43 万部,是去年全年的 13 倍,其中 AI 剧占比超九成。监管要求 AI 剧打上内容标注、平台严守肖像与声音授权底线并全流程把关,同时扶持真人剧精品创作、指导平台开设「真人剧」专区,今年以来已全网下架违规微短剧 6.8 万部。

微短剧用户超 8 亿、市场规模破千亿,AI 剧占比超九成且被要求打内容标注、严守肖像与声音授权,做 AI 短剧的这周得把合规流程过一遍。

点击打开原文

Qwen 发布全模态模型 Qwen3.8-Omni-Flash

Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频、视频输入,上下文窗口 1M token,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超 25%,音频输入每小时价格下降超 98%,音视频输入每小时价格下降超 93%。对做配音、字幕、素材转写和音视频理解类工作流的团队来说,输入成本大幅下降意味着可以更大批量地跑素材。

音频输入价格砍掉 98%、音视频砍 93%,还带 1M 上下文,做配音、字幕、素材批量转写的后期团队可以接 API 跑一周算算账。

VideoClaw 发布:一句话提示跑完视频制作全流程

VideoClaw 正式发布,把视频制作做成提示词驱动的一体化流程:输入一段文字、播客、广告、原始素材甚至一个想法,它就能完成策划、剪辑、生成、添加 B-roll、音乐和字幕,并记住用户偏好的风格。官方称其演示视频完全由 VideoClaw 制作,混合了真人拍摄与生成画面,可免费试用。

从一段文字或播客到成片,策划、剪辑、B-roll、音乐、字幕一条提示跑完,还能记住你的风格偏好。做后期和短剧量产的可以免费试一周,看它出片稳不稳。

点击打开原平台查看,能否访问取决于网络环境

Pika 发布全新 AI 创意平台

Pika 官方账号宣布推出全新 Pika,定位为「由创意人士打造、为创意人士服务」的 AI 创意平台,官方描述其特点是简单、全面,并强调输出质量面向严苛标准,同时表示这只是其创意工作 AI 布局的开始。该条推文未给出具体功能、模型版本或上线时间等细节。

Pika 官方宣布把产品重做成面向创意人的 AI 创作平台,但这条只有定位口号、没有具体功能参数,做视频的可以先记一笔,等官方放出实际能力再上手测。

点击打开原平台查看,能否访问取决于网络环境

Qwen-Image 2.1 将开源,开放 50 个早期试用名额

Qwen 官方账号宣布 Qwen-Image 2.1 将开源,并开放 50 个早期访问名额供发布前试用,具体模型参数、能力和发布时间未在推文中给出。对做视觉开发和角色设定的创作者来说,Qwen-Image 系列此前已支持中文文字渲染和图像编辑,2.1 若延续开源路线,意味着可以本地部署并接进自己的出图流程。

阿里 Qwen 图像模型 2.1 版预告开源,放 50 个发布前试用名额。做视觉开发和角色设定的可以盯一下,开源意味着能本地跑、能接进自己的出图流程。

点击打开原文,能否访问取决于网络环境

推出多语言语音,跨语种保持同一音色

Cartesia 推出 Multilingual Voices 多语言语音功能,主打跨语言保持同一音色身份。官方称翻译语音本身不难,难的是每种语言的节奏、语调和重音不同,换语言后身份容易丢失、听起来像换了个人。该功能可选定一个声音,在服务的每个市场维持同一品牌音色,官网入口 cartesia.ai/voices,并以 Mission 区邻居 Baklavastory 为合作案例演示。

配音和虚拟角色团队可以留意:换语言不换音色,是 AI 短剧出海和多语种版本最头疼的一环,接 API 跑一段自己的台词试试像不像同一个人。

点击打开原平台查看,能否访问取决于网络环境

OpenAI 推出 Astra for Law

OpenAI 发布面向法律行业的 Astra for Law(OpenAI for Law),提供前沿模型能力、律所定制工作流、接入法律数据源,以及针对保密客户资料的合规级管控。属于行业垂直产品,与影视、AIGC 创作流程无直接关联。

法律行业垂直产品,跟影视创作没关系,编导和短剧团队直接跳过。

点击打开原平台查看,能否访问取决于网络环境

404 Media 实测:AI 歌曲冒名劫持乐队 Spotify 主页

404 Media 记者用 Udio 生成一首朋克歌曲,以每月 3.75 美元的 Distrokid 账户冒名上传,一天后歌曲出现在 Brooklyn 朋克乐队 Lathe of Heaven 的 Spotify、Apple Music、Tidal、Amazon Music 和 Deezer 页面上,全程平台未做身份核验。对做 AI 音乐、配乐和独立发行的创作者来说,这条暴露的是发行端的署名与认领漏洞——自己的作品可能被别人的 AI 歌曲挂上主页,反过来也可能踩到冒名风险。

做 AI 音乐和发行的人该看一眼:Udio 生成 + 3.75 美元 Distrokid 账号就能把歌挂到别人乐队主页,平台零核验。做配乐、发歌的先把自家发行账号的认领和署名流程查一遍。

点击打开原文

智谱称 GLM-5.3 优化自身推理设施,Flash 吞吐提升 3 倍

智谱(Zai)分享用 GLM-5.3 帮助构建并优化 GLM-5.3-Flash 推理基础设施的过程:系统从首次成功运行到生产就绪用时不到两周,全流程吞吐相对初始基线提升至 3 倍。这是模型厂商自举优化自家推理服务的工程案例,涉及的是服务端吞吐与部署效率,不涉及生成能力、画面或工作流层面的变化。

智谱用 GLM-5.3 帮自己搭 GLM-5.3-Flash 的推理设施,两周从跑通到上线,吞吐翻到 3 倍。做模型部署和成本核算的技术团队可以看看这套自举优化的思路。

点击打开原文,能否访问取决于网络环境

Kimi Code 桌面端上线,内置浏览器与截图标注

Kimi Code 桌面端发布,内置 browser-use 浏览器、截图标注功能,支持任意 BYOK(自带 API Key),并附带 KimiData 插件;worktree 与 remote-control 功能据称还在开发中。属于 AI 编程工具的产品形态更新,与影像创作工作流无直接关联。

Kimi Code 桌面端发布,带内置浏览器、截图标注和任意 BYOK,做 AI 编程的可以装一个试试,跟创作流水线关系不大。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

Runway 上线 Enhance Frame Rate 帧插值

Runway 推出 Enhance Frame Rate 帧插值模型,可将任意素材转换为指定帧率规格,支持 25、30、48、60、120 fps 以及 NTSC 的 59.94 标准,官方已开放使用入口。对后期和交付环节来说,这是把 AI 生成素材统一到播出/平台帧率标准的一条现成路径,做短剧批量出片和跨平台分发的可以实测补帧后的运动连贯性。

Runway 新出的帧插值模型,能把任意素材转成 25/30/48/60/120fps 或 NTSC 59.94 标准,做后期和交付的可以拿手头素材跑一遍看补帧稳不稳。

点击打开原平台查看,能否访问取决于网络环境

Krea Agent 上线视频编辑器,可拼接延长加音频

Krea AI 在 Krea Agent 中推出视频编辑器,用户可在编辑器内直接处理生成的视频片段,功能包括把多个场景拼接在一起、延长已有片段、添加音频等,现已可在 krea.ai/agent 使用。对做 AI 短剧和批量出片的团队来说,生成到粗剪这一步不用再切工具,能省掉导出再导入的来回。

Krea Agent 里直接能拼场景、延长片段、加音频,生成完不用导出到别的软件再剪,做短剧和批量出片的可以进去跑一遍看顺不顺手。

点击打开原平台查看,能否访问取决于网络环境

Qwen 接入 n8n,免 API key 一键调用

阿里云宣布 Qwen 接入 n8n:从 n8n v2.36 起,Cloud Starter 和 Pro 用户(含免费试用)可通过 Gateway credits 调用 Qwen,无需 API key、无需单独账号、无需额外计费,文本、图像和视频生成都在单个节点内完成,符合条件的用户还会获得一笔 starter 余额用于在真实工作流中试用。

n8n 里现在不用配 key 就能调 Qwen 的文本、图像、视频,一个节点全包。自己搭自动化流程的可以接上跑一遍,省掉账号和计费配置那堆事。

点击打开原文,能否访问取决于网络环境

ChatGPT in Word 向所有套餐开放含免费版

OpenAI 宣布 ChatGPT in Word 面向包括 Free 在内的所有套餐开放,有使用量限制;Business 和 Enterprise 套餐可在 Word 中获得 GPT-5.6 Sol 的两周免费预览。信源同时提到 Anthropic 本周早些时候发布了可直接在 Claude 内编辑文档的 Claude Docs。对写剧本、改分镜文档、整理项目资料的编导和制片来说,这类把 AI 直接嵌进 Word 的能力省掉了复制粘贴到网页端的来回切换。

OpenAI 把 ChatGPT 塞进 Word 并放开到免费套餐,Business 和 Enterprise 还有两周 GPT-5.6 Sol 免费预览。写剧本大纲、改分镜文档的编导可以顺手在 Word 里直接调。

点击打开原平台查看,能否访问取决于网络环境

Claude Code 推出 Projects 功能,候补名单逐步开放

Anthropic 官宣 Claude Code 推出 Projects 功能,先通过候补名单向部分 Pro 和 Max 用户开放,后续推广到全部 Pro 和 Max 用户。用户可从一段对话创建 Project,Claude 会并行运行所需线程,并配有总览面板帮助跟进需要回复的内容,Projects 还具备共享记忆作为可演化的上下文。属于编程工具的产品功能更新,与影像创作流程无直接关系。

Claude Code 加了 Projects 和共享记忆,从一段对话就能起项目、并行跑线程,写代码的可以留意候补名单。对拍片剪片这条帮不上忙。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

jasonzhou1993 开源 AI UGC 视频工作流,单条成本不到 5 元

X 用户 @jasonzhou1993 开源了全套 AI UGC 视频工作流,实测 4 条带字幕成片总成本 2.67 美元,折合单条不到 5 元人民币。作者对比称,此前找海外博主拍一条 TikTok 推广视频需 30 到 50 美元,且要等三四天交付。该工作流面向 UGC 风格短视频的批量生产场景。

4 条带字幕成片只花 2.67 美元,对比海外博主一条 30-50 美元还要等三四天,做投放素材和短剧批量出片的可以扒下来跑一遍。

点击打开原平台查看,能否访问取决于网络环境

ElevenCreative 声音设计+Seedance 2.5 保持角色声音一致

Rourke Heath 分享在 AI 视频中保持角色声音一致的做法:先用 ElevenCreative 的 Voice Design 从一段文字描述生成一个完全原创的声音,再用文字转语音生成该角色的台词,然后把这段音频带进 ElevenCreative 上的 Seedance 2.5,让角色在每一次生成中保持同一个声音。作者称这是面向电影人、叙事创作者的一套简单流程,用于解决角色连续性,全程在同一个创作平台内完成,并提到借助了 Claude。

角色配音跨镜头跑调是 AI 短剧的老毛病,这条给了 ElevenCreative 声音设计配 Seedance 2.5 的具体做法,做系列剧和数字人对话的可以照着跑一遍。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 联手 GPT Astra 打造漫游杰作

PixVerse 官方演示一套三步工作流:先用 GPT-6 Astra 规划构图、镜头路径和色块,再用 Blender 搭可编辑灰模并渲染灰模主片与静帧,最后把灰模视频作为运动控制输入 PixVerse 生成最终画面。核心是用灰模锁住镜头运动,再交给视频模型上色出片。

三步走:GPT-6 Astra 定构图和镜头路径,Blender 出灰模主片,PixVerse 拿灰模当运动控制再上色。做分镜和镜头调度的可以照这套跑一遍,看运动控制能不能压住画面稳定性。

点击打开原平台查看,能否访问取决于网络环境

创作者称用 Astra 24 小时完成全流程后期

创作者 @donaldjewkes 发帖称用 Astra 在 24 小时内完成一支片子,动态图形、Rotoscoping 抠像、调色、Blender 建模、声音设计和混音全部由 Astra 完成,作者表示全程没有打开 DaVinci。帖子未说明 Astra 的具体形态、使用方式或成片时长。

一条后期全流程实测:动态图形、抠像、调色、Blender 建模、声音设计和混音都由 Astra 完成,作者说没打开 DaVinci。做后期和剪辑的可以点开看成片质量,判断这套流程能不能接进自己的活。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 用 GPT Image 2.5 与 Seedance 2.5 生成舞蹈视频

PixVerse 官方演示:先用 GPT Image 2.5 生成完整的竖屏信息流 UI 框架,再用 PixVerse 上的 Seedance 2.5 让画面中的角色完整跳起舞,同时保持自然的竖屏信息流外观。官方强调这不是屏幕录制,成品已难与真实信息流区分。做数字人、竖屏短视频和拟真信息流内容的可以看这条的合成思路。

官方演示了一条「先出竖屏信息流界面、再让角色跳起来」的做法,做数字人和短视频的可以照着跑一遍,看角色动作和界面质感能不能同时稳住。

点击打开原文,能否访问取决于网络环境

insaneUEFN 用 GPT-6 与 Tripo 3.1 搭建 GTA 6 风格别墅

用户 insaneUEFN 用 OpenAI GPT-6 Astra、Atlas3DAI 和 Tripo 3.1 搭了一条自动化流程,把 GTA 6 风格海滩别墅直接生成并组装进 UEFN。他放弃低模的 Tripo P2 改用 Tripo 3.1,将 70 个高模资产优化到 5K 或 1K 三角面,再通过 UEFN MCP 复用梁柱、窗户等模块化部件完成 1:1 重建,全程仅需两次方向性反馈。

70 个高模资产压到 5K/1K 面、靠 UEFN MCP 复用梁柱窗户模块化拼装,全程只给两次方向性反馈。做 3D 场景和虚拟制片的可以拆这套自动化流程。

点击打开原平台查看,能否访问取决于网络环境

Magnific 用 GPT-6 Astra 将四套服装做成动态时尚大片

Magnific 官方发布一条工作流演示:用 GPT-6 Astra 配合 Magnific MCP,把四套服装造型做成动态时尚大片,流程分三步——先建角色、再让细节动起来、最后把每套造型适配成竖版和横版。推文附了完整 prompt 和演示链接。对做品牌 KV、电商视觉和时尚短片的创作者,这是一套可直接套用的角色一致性加多画幅适配流程。

Magnific 官方演示用 GPT-6 Astra 加自家 MCP,把四套造型做成会动的时尚大片,还带横竖版适配。做品牌视觉和电商图的可以照着这套流程跑一遍。

点击打开原平台查看,能否访问取决于网络环境

Astra 结合 GPT-Image 2.5 渲染粗略引导

Arman Maesumi 发布 Astra 与 GPT-Image 2.5 的组合用法:Astra 提供 agentic 感知能力,负责创建、编辑和动画化粗粒度引导(coarse guidance),再交给 GPT-Image 2.5 渲染成图,官方称 Image 2.5 的一致性让结果「很有趣」。推文以线程形式发布,正文未展开具体参数与操作步骤。

Astra 负责感知和粗稿、GPT-Image 2.5 负责出图,做视觉开发和分镜预演的可以看看这套分工怎么串。

点击打开原平台查看,能否访问取决于网络环境

LangChain 构建付费媒体智能体分析广告投放

LangChain 官方博客复盘其付费媒体智能体的搭建过程:给智能体配沙盒、软件、业务上下文和操作说明,让它自己找工具、在权限内完成从广告数据分析到提出投放调整建议,再走人工审批并核验改动是否生效。经验是计算和规则交给代码保证一致性,模型只负责判断和给建议,托管层负责部署、沙盒、Slack 集成和定时任务。

LangChain 自己拿付费广告当试验田,把数据分析、改投放、人工审批串成一条流程,做投放和增长的技术团队可以看看它怎么拆权限和审批环节。

点击打开原文

Meshy API 把奥德赛场景装进宝箱

Meshy 官方展示了一个把《奥德赛》场景装进宝箱的完整案例,流程分三步:先用 GPT-6 Astra 配合 Meshy 生成概念图,再用 Meshy 把概念图转成 3D 模型,最后用 Astra 加 Blender 给场景做动画。这条演示的是概念图到 3D 资产的转换流程,适合做 3D 场景、道具和空间设计的创作者参考。

Meshy 官方演示了一条从概念图到 3D 模型再到动画的完整流程,做 3D 场景和道具的视觉师可以看看这套串法。

点击打开原平台查看,能否访问取决于网络环境

爆料称 GPT-6 Sol 面向 Plus 用户主推

账号 @TokenGremlin 称「被告知」GPT-6 Sol 是面向 OpenAI Plus 用户的主推版本,据其测试在创意写作、3D 建模、前端设计等方向表现接近 Astra,价格更亲民、使用限制更高;作者同时表示尚未测试 GPT-6 Luna,并称曾向 OpenAI 施压希望 Plus 恢复接近 3000 条消息的额度但认为难以实现。以上均为个人转述,无官方确认。

二手爆料,作者自称「被告知」,无官方口径也无实测数据,做创作决策的等 OpenAI 官方发布再说。

作品与案例

Works

Kling 3.0 全片生成 AI 长片《ODYSSEUS: The Fall》上线

Kling AI 官方宣布,Fountain 0 的新长片《ODYSSEUS: The Fall》已完整上线,全片每个镜头均由 Kling 3.0 生成,由 Ash Koosha 执导。同一团队的《Dreams of Violets》曾入围 2026 Tribeca,是首部进入主要电影节的 AI 长片。

Fountain 0 团队新长片全片镜头由 Kling 3.0 生成,导演 Ash Koosha,同团队前作曾入围 2026 Tribeca。做 AI 长片和短剧的可以拉片看长叙事下的镜头一致性怎么处理。

点击打开原平台查看,能否访问取决于网络环境

AI 短片《人生反悔局》讲透选择焦虑

B 站热门 AI 短片《人生反悔局》,主题是当代人的选择焦虑与后悔内耗:主人公从高考志愿开始反复反悔——改专业、辞工作、退房子、回头找初恋,每次回到过去都不带现在的记忆,人生仍按他自己的性格和处境重新展开,躲开土木却撞上 AI 裁员,逃过房贷却困在出租屋。叙事靠「反悔—重来」的循环结构推进,适合编导拆解其重复叙事与情绪递进的处理方式。

一部把「如果当初」拍成循环叙事的 AI 短片,主人公从高考志愿一路反悔到初恋,做 AI 短剧的可以拉片看它怎么用重复结构撑起情绪。

点击打开原平台查看

B站AI动画《立志成为恶兽》第四集更新

B站UP主「立志成为恶兽」的AI动画系列《立志成为恶兽》第四集,标注「up动画」「AI全民制作人」,含AI生成内容,登全站排行榜最高第99名,系列已更新至四集。做AI动画连载的可以看它怎么在连续多集里保持角色形象和叙事连贯。

B站「AI全民制作人」标签下的系列动画第四集,已更新到第四集说明这套流程能稳定连载,做AI动画和短剧的可以拉片看角色一致性和分镜节奏怎么维持。

点击打开原平台查看

B站UP主用wan3.0重制Re:0第四季17集尤里乌斯打戏

B 站 UP 主发布的《Re:0》第四季第 17 集尤里乌斯部分打戏的 AI 重制版,属同人创作,参与 B 站同人扶持计划。作者自述用 Wan3.0 从头学做打戏,并提到 Wan3 做打戏难度高、容易「软绵绵」。

同人向 AI 打戏重制,作者自述用 Wan3.0 从头学起、打戏是难点。做 AI 动作戏的可以拉片看它怎么处理连续打斗的力度和节奏。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索