← 全部日报

AIGC 信息日报

2026 年 7 月 23 日 周四

行业与平台

Industry

腾讯设计Agent Miora全量上线,支持品牌VI与多模型

腾讯设计Agent平台Miora正式全量开放,无需邀请码。提供品牌设计、影视创意、电商广告、互动游戏、网页应用五大场景模式,内置Skill模板和画板编辑功能。Agent底模分Standard/Pro/Max三档,可调用GPT-image、Seedance、可灵等多模态模型,支持框选编辑、文字替换及自定义Skill发布。

腾讯设计Agent Miora全量开放,内置品牌VI、影视创意等五大场景,底模分三档可调GPT-image/Seedance/可灵。做短剧和视觉的可以直接套Skill模板跑一遍,看多模型调度下的出片一致性。

点击打开原文,能否访问取决于网络环境

Grok Build 上线,可调用 Grok 4.5 构建 …

Elon Musk 宣布推出 Grok Build,一个终端工具,可调用 Grok 4.5 模型。开发者 Daniel Farinax 用它安装了 Unity 免费 CLI,成功构建 3D 场景并导出视频,还在同一会话中创建了可玩的 macOS 岛屿探索游戏。Unity CLI 支持 MCP 模式且免费,无并发限制。

xAI 出了个终端工具 Grok Build,能直接调 Grok 4.5 装 Unity CLI 搭 3D 场景和导出视频。做 AI 视觉和工具链整合的可以上手测一下,看它能不能当自动化场景生成管线用。

点击打开原文,能否访问取决于网络环境

Grok Imagine 将制作《奥德赛》全片

马斯克在 X 上宣布,今年年底前 Grok Imagine 将制作一部完整长度的《奥德赛》电影,声称将兼顾历史准确性与荷马原著的艺术性。此前已有创作者用 Grok Imagine 制作了《奥德赛》对话场景片段(时长约 3 分钟),马斯克转发了该片段并做出上述承诺。目前尚未公布具体制作团队、工作流或上映渠道。

马斯克亲自官宣 Grok Imagine 年底前出《奥德赛》AI 长片,做 AI 长片和短剧的可以蹲这个项目当行业标杆看——从预告到成片的制作周期、历史准确性还原、角色一致性处理,都是今年最值得拉片的案例之一。

点击打开原平台查看,能否访问取决于网络环境

New for enterprises: OpenAI Pr…

OpenAI 发布企业级平台 Presence,支持企业部署可信的语音和聊天 AI Agent,可回答客户问题、调用公司系统、执行授权操作并在必要时转接人工,且能随时间持续优化。该产品面向企业客户服务与内部工作流场景,非面向个人创作者的消费级工具。

OpenAI 面向企业客户推出 Presence 平台,用于部署可信的语音和聊天 Agent。做 AI 短剧或虚拟角色对话的可以关注其底层能力,但这是企业级产品,不是面向创作者的消费级工具。

点击打开原文,能否访问取决于网络环境

Ant Design Vue 作者唐金州开源视频剪辑 Ski…

Ant Design Vue 作者唐金州开源了 Pireel,一个专为 OpenAI Codex 设计的视频剪辑 Agent Skill。通过 `npx skills add pireel/pireel-agent` 安装,它能根据视频内容智能匹配主题,内置 20 多种 HyperFrames 主题,主打口播类场景的自动化剪辑。开源协议允许直接使用、二次开发和商业化。

Ant Design Vue 作者开源了一个给 Codex 用的视频剪辑 Skill,装一句命令就能让 AI 根据口播内容智能匹配主题和剪辑。做后期和整合工作流的可以装起来跑一遍,看它能不能省掉口播视频的粗剪环节。

点击打开原文,能否访问取决于网络环境

RT @PixVerse4Biz: Your product…

PixVerse 推出 Video Ads Generator,已上线 Shopify 平台,帮助商家将产品信息自动转为视频广告。

PixVerse 把视频广告生成器搬上了 Shopify,做电商视频和短剧广告投放的可以看看出片效率和模板质量。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

For one-shot use, upload a sin…

ElevenLabs 推出新功能:上传单段人声录音即可用该声音生成一首完整原创歌曲(歌词相同),或从 Vocal Library 中挑选固定声音持续生成歌曲,无需额外设置。适用于角色主题曲、配音角色定制声线等场景。

上传一段人声录音就能用你的声音生成一首完整歌曲,做 AI 短剧和后期配音的可以直接给角色定制主题曲,不用再调音色库。

Introducing companion mode

HeyGen 推出 companion mode,将视频制作流程拆解为 AI 代理先提案 5 个方向、再生成故事板、然后绘制草图帧供审核,创作者逐层确认后才进入最终生成。该模式强调「导演式」控制而非一键生成,可通过命令行 `npx hyperframes@latest skills` 体验。

HeyGen 把视频制作拆成「提案-分镜-草图-定稿」四步,编导可以像指挥助理一样逐层把关,做短剧和广告的值得跑一遍看控片效率能提多少。

点击打开原平台查看,能否访问取决于网络环境

Speak your script

HeyGen 推出 Audio to Video 功能:用户只需上传语音(或直接说话)加一张图片,一次 API 调用即可生成对口型视频。支持同一张图片搭配 100 段不同语音的批量处理,适用于多语言配音、口播视频、短剧批量生成等场景。

HeyGen 把配音和视频生成合成一步 API 调用,做短剧批量配音、多语言版本、口播视频的可以直接接进流水线,省掉先录再对的步骤。

点击打开原平台查看,能否访问取决于网络环境

RT @aimlapi: Yup, a football v…

LumaLabs 宣布从零重建图像生成管线,采用「推理优先、像素其次」的新架构,并发布了一支世界杯主题的足球视频作为能力展示。新架构强调对场景逻辑和物理规律的理解,而非单纯像素拟合。

Luma 把图像生成从底层重写了,先推理再像素,做视觉和美术的可以看看这次出图质感稳不稳。

点击打开原平台查看,能否访问取决于网络环境

One master shot, recomposed wi…

LumaLabsAI 官方展示 Reframe 功能:基于一个主镜头(master shot),自动为不同投放渠道(横屏/竖屏/方形等)重新构图,保持画面意图不被裁切破坏。由创作者 Eli Coleman 用 Luma 制作演示。

Luma 的 Reframe 功能演示,一个主镜头自动适配多比例,编导和视觉师不用再手动裁切重构图,做短剧和广告的可以看看实际出片效果。

点击打开原平台查看,能否访问取决于网络环境

Watch Glif narrate how it's bu…

Glif 推出「技能」功能,用户可在聊天界面调用 100+ AI 模型(Flux 到 Seedance)构建内容,完成后可一键锁定为可复用的技能模板。官方演示案例为用「Diorama」风格制作《奥德赛》短版叙事。

Glif 把 AI 工作流做成了可复用的「技能」,从对话到锁定模板一步到位,做短剧和视觉的可以看看怎么把常用管线固化下来。

点击打开原平台查看,能否访问取决于网络环境

🚨 Google AI Subscribers: Unloc…

Google Flow 官方宣布,即日起至 8 月 31 日,所有 AI 订阅用户每天可免费获得 50 个 Google Flow 积分,当日有效、不累积。Flow 是 Google 的 AI 工作流编排平台,支持多模型串联、自动化生成管线,免费额度可用于测试和批量生产场景。

Google Flow 每天白送 50 个积分,持续到 8 月底,做 AI 短剧和批量出图的可以趁这波免费额度跑通工作流,省一笔测试成本。

点击打开原平台查看,能否访问取决于网络环境

OpenRouter 新增音频转写 API,支持 Whisp…

OpenRouter 新增 POST /api/v1/audio/transcriptions 端点,支持 base64 编码音频输入,返回 JSON 格式文本与用量数据,可使用同一 API key 调用 Whisper 及 token 计价 STT 模型。

OpenRouter 把音频转写做成统一 API 端点,后期和剪辑团队不用再单独接 Whisper 或各家 STT 服务,一条 key 搞定字幕生成,适合集成进自动化剪辑管线。

点击打开原文

OpenAI API 平台本周开放硬性消费限额

OpenAI API 平台本周向所有账户开放硬性消费限额功能,用户可自行设定 API 支出上限,超出后自动停止调用。

OpenAI API 新增硬性消费限额,做 AI 短剧批量生产的团队可以设个预算上限防跑冒,对制片人控制成本有点用。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

实测Qwen-Image-3.0:19大场景挑战GPT Im…

Qwen-Image-3.0 上线,支持最高 4.5k token 输入、12 种语言、20 多种字体,以及多图融合、图中图和图片编辑。实测在中文长文本生成、多语言混合排版、UI 设计、多图融合等 19 个场景中文字不崩且信息对应准确,图片质量与 GPT Image 2 相当。国内可直接使用,速度快且价格不贵。

中文长文本生成不崩字、多图融合不乱,做海报和 UI 的可以直接当 GPT Image 2 的平替用起来,国内直连速度快,跑一遍就知道稳不稳。

点击打开原文

可灵 MCP 教程:快速打造电影级 AI 表演

可灵 AI 官方发布 MCP 教程,演示如何在智能体中通过 MCP 协议构建完整创意工作流,覆盖角色创建、情感设计到批量视频生成,目标是将电影级 AI 表演的制作时间压缩到几分钟内。

可灵官方出的 MCP 教程,从角色创建到批量出片一条龙,做短剧和视觉的可以直接套工作流跑一遍,省掉自己摸索的时间。

点击打开原平台查看,能否访问取决于网络环境

从一个从未存在的摄像机重新拍摄视频 这个 LTX-2.3 I…

Hugging Apps 发布基于 LTX-2.3 的 IC-LoRA 模型,可从新视角重新渲染真实视频素材,保持相同场景和动作,仅改变摄像机位置。用户通过文字描述(如“远在左侧,更高,更远”)指定新机位,模型即生成对应角度的画面。已在 Hugging Face 上线可试玩空间。

后期和视觉师可以立刻上手试:用一段实拍素材,选个新机位角度,LTX-2.3 就能重新渲染出那个视角的画面。省掉补拍成本,剪辑时改镜头角度有了新玩法。

点击打开原平台查看,能否访问取决于网络环境

4/The full prompt structure I …

PixVerse 官方账号分享了一套分镜式 prompt 结构:将视频拆解为 Shot 1/Shot 2 等连续镜头,每个镜头内分别指定时间区间、视觉描述、机位(如低角度/水面高度/晃动)、前景/中景/背景分层、调色方案(冷蓝等)。旨在用单条 prompt 控制多镜头连续视频的镜头语言和视觉一致性。

PixVerse 官方分享的分镜式 prompt 结构,把镜头、景深、调色、前景/中景/背景分层写进一条 prompt 里。做 AI 短剧和视觉开发的可以直接套这个模板跑几轮,看画面控制力能到什么程度。

在 Grok Imagine 中指导一个角色的情感真的很有趣…

创作者 Heavy Pulp 在 Grok Imagine 中测试角色情感控制能力:同一场景、同一角色,仅通过修改表演指令(如愤怒、悲伤、惊讶、平静)生成四个不同情绪版本的 10 秒视频片段。展示了 Grok Imagine 在角色表演微调上的可控性,无需重新构图或换场景即可改变角色情绪表现。

Grok Imagine 的角色情感控制实测,同一个场景只改表演指令出四种情绪版本。做 AI 短剧和编导的可以直接拉片看指令怎么影响表演,省掉反复重绘的试错成本。

点击打开原平台查看,能否访问取决于网络环境

I used Claude as the director …

创作者 @CharaspowerAI 分享工作流:用 Claude 分析一段动漫视频的镜头、节奏、构图和视觉语言,再通过 Higgsfield MCP 将分析结果重建到自己的角色(Amazon Queen)上,实现从参考片到新角色的风格迁移与镜头复刻。

用 Claude 当导演拆解镜头语言,再让 Higgsfield MCP 重建画面,做 AI 编导和视觉的可以拉片看这套工作流怎么跑通风格迁移。

点击打开原平台查看,能否访问取决于网络环境

15秒一镜到底奔跑提示词设计

X用户「阿易 AI Notes」分享一套15秒一镜到底奔跑提示词设计,严格保持参考人物(东亚女性、绿裙、草帽)一致性,通过镜头犹豫与焦点漂移构建追赶者压迫感。运镜时间线精确到秒:0-3秒起身、3-7秒加速与焦点切换、7-12秒草地奔跑、12-15秒减速回望。同时给出声音空间分层与负面约束(禁止切镜、瞬移变焦等)。

一套精确到秒的15秒一镜到底奔跑提示词模板,连镜头犹豫和焦点漂移都写进去了。做AI短剧和叙事片的可以直接套用改参数,省掉自己试错的时间。

点击打开原平台查看,能否访问取决于网络环境

一张参考图片就是你所需的一切!见 工作流程: @midjou…

创作者 gen.ericai 分享了一条从单张参考图到 48fps 4K 视频的完整工作流:Midjourney 8.2 预览版生成参考图,配合主体/地点/视觉/摄影机/音乐描述,在 Dreamina Seedance 2.0 中使用时间编码提示(含运镜、构图、动作)生成视频,最后经 Magnific 升格至 48fps 4K。

从一张参考图到4K成片,工作流拆得挺清楚:MJ 8.2出图+Seedance 2.0时间码提示控制运镜+Magnific升格。做AI短剧和视觉的可以直接套这个流程跑一遍,看废片率能压多少。

点击打开原平台查看,能否访问取决于网络环境

回来学着搞了一个~ broll 风格的 自动剪辑的 skil…

个人创作者虎小象分享了一个自动剪辑 skill 的实验:Agent 通过 /chrome 在 Google Flow 上自动操作首尾帧和首图驱动(图片由 Codex 生成),再结合 HyperFrames 完成剪辑。音频因未及时提供中文配音而改用英文。作者自评:从时间消耗和精细度看,当前 skill 暂时替代不了人。

个人实验,用 Agent 在 Google Flow 上自动操作首尾帧和首图驱动,再结合 HyperFrames 做剪辑。做自动化剪辑工作流的可以看看这个思路,但作者自己也说精细度还替代不了人。

点击打开原平台查看,能否访问取决于网络环境

【开源一个skill,让你的WorkBuddy一键用上GPT…

开发者「智见AI-大鹏」开源了一个 WorkBuddy CLI Model Bridge Skill,基于 CLIProxyAPI 自动检测本地已登录的 CLI Agent(如 Codex、Grok、Google Gemini),拉取模型列表并验证工具调用、图片、推理能力后写入 WorkBuddy,省去手动填 Base URL 和 API Key 的步骤。已跑通 GPT-5.6 SOL/Fast、Grok 4.5、Gemini 3.6 Flash。

个人开发者开源的一个 WorkBuddy 小工具,让本地已付费的 CLI Agent 模型(GPT、Grok、Gemini)直接复用到 WorkBuddy 里,省掉重复积分消耗。搞 AI 工具链整合的可以看一眼,但跟影视创作本身关系不大。

点击打开原文,能否访问取决于网络环境

作品与案例

Works

One continuous shot

Skywork 官方发布一镜到底 AI 短片,无剪辑单镜头,展示视频生成模型在长镜头运动下的画面连贯性与稳定性。

Skywork 官方发的一镜到底 demo,视觉师和编导可以点开看看长镜头下的画面稳定性和运动连贯性,判断能不能当短剧的运镜参考。

点击打开原平台查看,能否访问取决于网络环境

用AI两天250美元做出互动版《奥德赛》

创作者用 Yoroll 平台,花约 250 美元和 2 天时间,将诺兰电影《奥德赛》改编成可玩的 AI 互动故事,包含分支剧情和玩家选择影响结局。Yoroll 平台提供互动叙事制作能力,结合 AI 编程和视频模型,实现极低成本快速产出互动式内容。

250 美元 2 天做出互动叙事,做短剧和互动内容的可以看看 Yoroll 这个平台怎么跑通分支剧情和低成本出片。

点击打开原平台查看,能否访问取决于网络环境

原来我是假千金,太好了,以后不用装了!!!

B站UP主「小美追漫记」发布AI短剧《原来我是假千金,太好了,以后不用装了!!!》全剧终,含AI生成内容,假千金题材,非憋屈向爽剧定位,B站短剧频道已上线完整正片。

B站AI短剧假千金题材全剧终,做AI短剧的可以拉片看长叙事节奏和观众互动反馈,短剧团队直接当竞品分析素材用。

点击打开原平台查看

A dancer, a green stage, a per…

LumaLabsAI 官方发布 AI 短片,由创作者 Dinda Prasetyo 使用 Luma 制作。短片以舞者与绿色舞台开场,表现悲伤情绪,随后舞台消失、雪景切入,完成场景转换。作品侧重情绪氛围与视觉节奏,属于 Luma 官方用例展示。

Luma 官方号发的 AI 短片 demo,情绪和视觉氛围是看点,编导和视觉师可以拉片看镜头调度和场景转换的处理方式。

点击打开原平台查看,能否访问取决于网络环境

〖白洁〗 第五集

B 站 UP 主「寂夜漫剧」AI 漫剧系列《白洁》第五集,2026-07-20 发布,标注含 AI 生成内容。该系列为 AI 短剧连载,验证了个人创作者用 AI 工具进行系列化叙事产出的可行性。

AI 漫剧系列第五集,做 AI 短剧的可以拉片看系列化叙事和角色一致性处理,尤其是多集连载的视觉稳定性。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索