← 全部日报

AIGC 信息日报

2026 年 8 月 13 日 周四

行业与平台

Industry

xAI 发布 Grok 4.6,强化长时运行智能体能力

xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。Grok 4.6 今日起在 Cursor 和 Grok Build 中可用,首周提供 2 倍包含用量。训练上采用比 4.5 更长的补充训练,使用精选模型生成数据、高质量工程数据及改进的优化器和训练配方。

xAI 官方发布 Grok 4.6,主打长时运行智能体,在多项智能体编码与知识工作基准上达到前沿,综合分追平 GPT-5.6 Sol。做 AI 编程和自动化工作流的可以直接在 Cursor 里试一周,看长任务稳定性。

点击打开原文

Meta 开源 Muse Glimmer 30B 模型上线 OpenRouter

Meta Superintelligence Labs 首个开源权重模型 Muse Glimmer 上线 OpenRouter,30B 稠密文本+图像模型,Apache 2.0 协议,定位可靠本地 Agent,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。对 AIGC 技术整合者来说,这是可本地部署的多模态模型新选项,可接入创作流水线做图像生成或 Agent 任务。

Meta 首个开源权重模型 Muse Glimmer 上线 OpenRouter,30B 稠密文本+图像模型,Apache 2.0 协议,本地 Agent 场景可用。做工具链整合的可以接 API 测一周,看它当本地 Agent 的稳定性和出图质量。

DeepSeek V4 Pro 0813 上线 OpenRouter,Agent 能力大幅提升

DeepSeek V4 Pro 0813 已上线 OpenRouter,相比 V4 Pro Preview 在 Agent 基准上大幅提升:DeepSWE 62.7(+49.9)、CyberGym 83.3(+30.6)、NL2Repo 61.5(+23.0)、Terminal Bench 2.1 87.9(+15.8)。更多服务商即将接入。对 AIGC 技术整合者来说,这是可调用的 Agent 能力升级,适合接入自动化创作链路。

DeepSeek V4 Pro 0813 在 OpenRouter 上线,Agent 基准全线大涨,做 AI 编程和自动化工作流的可以直接接 API 实测。

点击打开原文,能否访问取决于网络环境

Qwen3.8-Max 权重上线 Hugging Face,2.4T 参数 95B 激活

Qwen3.8-Max 权重在 Hugging Face 上线(该产品 8 月 4 日已发布),总参数 2.4T,激活参数 95B,采用 MoE 架构。开源社区可下载权重进行微调和部署。对 AI 创作者来说,这类大模型权重开源意味着后续可能出现针对视频生成、图像编辑等场景的微调版本,可接入本地创作流水线。

开源大模型权重上线,2.4T 总参数 95B 激活的 MoE 架构。做 AI 短剧和视觉生成的可以关注后续社区微调版本,看能不能接进本地工作流。

点击打开原文,能否访问取决于网络环境

微软首发自研推理模型 MAI-Thinking-1

微软 AI CEO Mustafa Suleyman 宣布,微软首个自研推理模型 MAI-Thinking-1 从零构建,现已上线 Microsoft Foundry。该模型定位为推理模型,对影视创作者而言,该模型目前与图像/视频生成无直接关联,主要面向企业级推理场景,后续是否开放创作相关 API 尚不明确。

微软首个自研推理模型上线 Foundry,对影视创作工作流暂无直接价值,技术整合者可留意后续 API 接入情况。

点击打开原平台查看,能否访问取决于网络环境

Higgsfield 上线 Cinema Studio 4:30+ 运镜预设与调色台

Higgsfield 正式上线 Cinema Studio 4,新增 30+ 运镜预设、双源视频灯光控制台、50+ 调色盘、6 种情绪 3 级强度的表演控制台,以及支持正向/桥接/反向生成的视频扩展功能。

运镜预设、双源灯光、50+ 调色盘、6 情绪表演控制,做短剧和视觉的可以直接上手试,镜头语言和情绪表演一步到位。

点击打开原平台查看,能否访问取决于网络环境

IndexTTS 2.5 开源发布:零样本情感迁移+2.28倍提速

IndexTTS 2.5 开源发布,主打更广语言覆盖、新语言零样本情感迁移、2.28 倍推理提速。官方提供 demo 页,并已支持通过 vLLM 跑推理。对 AI 配音、短剧批量出音、多语言本地化配音的后期和短剧团队,是可直接接入工作流的开源 TTS 选项。

开源 TTS 上新版,语言覆盖更广、新语言零样本情感迁移、推理快 2.28 倍,还接好了 vLLM 推理。做配音和短剧批量出音的后期可以直接跑 demo 页试效果。

点击打开原平台查看,能否访问取决于网络环境

DeepMind 训练手语翻译模型,直接把手势转文本

Google DeepMind 官方宣布训练手语翻译模型,解决手语 AI 长期因技术复杂和认知误区进展缓慢的问题。模型将手、身体、面部的同步动作直接翻译为文本,基于大规模数据训练。面向手语内容翻译与无障碍字幕场景。

Google DeepMind 官方发布手语翻译模型,把手、身体、面部同步动作直接转成文本。做无障碍字幕、手语内容本地化的后期团队可以关注,看它能否接进现有转写链路。

Suno官方称与BMG达成全球合作,将推首个音乐模型

Suno 官宣与全球最大音乐公司之一 BMG 达成全球合作,作为其首个与音乐行业共同开发的音乐模型发布计划的一部分。合作将探索艺术家与粉丝连接的新音乐体验,并为选择加入的艺术家和词曲作者创造新的经济机会。Suno 还通过 Suno: In Session 和 Spark 项目直接投资独立艺术家。

Suno 官宣与全球最大音乐公司之一 BMG 的全球合作,并预告首个与音乐行业共同开发的音乐模型。做 AI 音乐、配乐和音效的后期与短剧团队可以关注后续模型能力,看它能否直接进创作管线。

点击打开原文

小红书 306 粉小店卖人生模拟器,单品售出 1661+

小红书博主黄赟分享一个低粉小店卖「人生模拟器」的生意案例:3.99 元一单,单品已售 1661+,一周内 300+ 人购买,店铺仅 306 粉。

AI 短剧和 IP 运营可以看看这个变现样本:3.99 元单价、一周 300+ 单,验证了轻量互动内容在小红书的付费意愿。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

Higgsfield 插件正式集成进 ChatGPT 应用

Higgsfield 官方宣布其插件正式集成进 ChatGPT 应用,用户无需离开聊天界面即可调用 Seedance 2.5、Seedance 2.0、Seedream 5.0 Pro、GPT Image 2.0 和 Kling 3.0 生成内容。Faceless Channel、Narrator 和 Subtitles 技能已同步上线。对 AI 短剧和视觉创作者来说,这意味着把主流视频生成模型直接嵌进对话工作流,批量出片和自动化剪辑链路更顺了。

做短剧和视觉的可以直接在 ChatGPT 里调 Seedance 2.5、Kling 3.0 出片,不用切工具,Faceless Channel 和字幕技能也内置了,值得上手跑一遍。

点击打开原平台查看,能否访问取决于网络环境

Grok Imagine Image 2.0 登陆 Runway 平台

Runway 官方宣布 Grok Imagine Image 2.0 现已上线其平台,与现有图像和视频模型并列可用。创作者可直接在 Runway 工作流中调用该模型生成图像,无需切换工具。

Runway 官方接入 Grok 图像模型,视觉师和做短剧分镜的可以直接在 Runway 里调图,不用切工具,值得上手试一轮。

点击打开原平台查看,能否访问取决于网络环境

Topaz 发布 Hyperion 2.5:SDR 转 HDR 与降色带

Topaz Labs 发布 Hyperion 2.5,主打真正的 SDR 转 HDR 能力并减少色带(banding),面向专业后期管线。同批更新 Starlight Precise,提升处理速度、新增锐度滑块、输出更平滑。适用于 AI 生成素材的后期调色、修复与专业工作流集成。

后期调色和修复团队直接看:SDR 转 HDR 和降色带是 AI 成片进专业管线最头疼的两件事,这次更新正好打在痛点上,值得实测一轮。

点击打开原文,能否访问取决于网络环境

FLORA 上线 Custom Actions:自然语言生成图像视频处理工具

FLORA 推出 Custom Actions 功能,用户可在画布上直接用自然语言描述需求(如「制作 risograph 效果」「电影感拼接片段」),系统即时生成可用的定制化图像/视频处理工具,无需手动搭建工作流。

FLORA 把「要什么工具就现场造一个」做成了产品功能,输入一句自然语言就能生成可用的图像/视频处理工具,做后期和视觉的可以直接上手试,省掉自己搭工作流的功夫。

点击打开原平台查看,能否访问取决于网络环境

Runway Agent 接入 Figma、Dropbox、Notion

Runway 官方宣布 Agent 新增连接器(Connectors),支持接入 Figma、Dropbox、Notion,可将设计稿、文件和文档直接同步进 Agent 工作区,所有付费套餐可用。对 AIGC 技术整合者来说,这意味着素材不再散落在各工具里,能直接汇入 Runway 的生成与编辑流程,减少手动搬运。

Runway 的 Agent 现在能直接拉 Figma、Dropbox、Notion 里的素材进工作流,做视觉和整合的可以接上试试,省掉来回导文件的功夫。

点击打开原平台查看,能否访问取决于网络环境

LiveKit Agents 推出 Expressive 模式,语音代理能感知情绪

LiveKit 在 Agents 中推出 Expressive 模式,让语音代理不再用千篇一律的乐观语调说话,而是能感知呼叫者的实际情绪并调整语气。该模式面向语音代理场景,适用于 AI 配音、虚拟角色对话、互动叙事等需要情绪表达的创作链路。

做 AI 配音、虚拟角色对话和互动短剧的可以接 API 试一周,看情绪感知能不能让角色对话更自然。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

Magnific 推出 Seedance 2.5 电影制作免费课程

Magnific 官方发布一套基于 Seedance 2.5 的电影制作完整课程,共 3 集,覆盖参考设定、故事构建、声音设计和最终剪辑全流程,产出为一部完整影片而非单条片段,全部免费开放于 Magnific Academy。

官方出的完整电影制作课,从参考、故事、声音到成片,3 集全免费。做 AI 短剧和长片的编导可以直接当工作流模板跑一遍。

点击打开原平台查看,能否访问取决于网络环境

Magnific 公开分镜级提示词模板

Magnific 官方公开一条可直接复用的提示词模板,包含镜头指令(Shot 1、6s、truckLeft)、风格定位(AAA 游戏概念艺术、写实绘画风、非动漫)及完整场景描述(雨夜屋顶、霓虹灯光、人物动作)。对视觉师和分镜创作者来说,这是一份可直接套用的分镜级 prompt 范例,能快速生成风格统一的概念图。

官方直接甩出带镜头语言和风格描述的完整 prompt,做视觉和分镜的可以直接抄来改,省得自己磨提示词。

点击打开原平台查看,能否访问取决于网络环境

Magnific 教程:3D 运镜结合 Seedance 2.5

Magnific 官方发布 3D 运镜(3D Motion Control)使用教程,核心是在 3D 空间设定相机路径,支持手机端操作,并与 Seedance 2.5 组合使用,实现更灵活的镜头控制。教程附有具体操作链接。

官方教程,讲怎么在 3D 空间里设相机路径、手机也能操作,再配 Seedance 2.5 出片。做运镜和镜头语言的编导、后期可以直接照着跑一遍。

点击打开原平台查看,能否访问取决于网络环境

博主建议用 Claude Code 为 Seedance 2.5 自动写提示词

日本创作者分享:把 Dreamina/ByteDance 官方 Seedance 2.5 提示词指南和最佳设置文档贴进 Claude Code,指示其读取并做成 Skill,之后只需描述视频内容即可自动生成符合官方规范的提示词。附 15 秒清凉饮料 CM 的完整示例提示词,Codex 也可实现同样流程。

把 Dreamina 官方提示词指南喂给 Claude Code 做成 Skill,以后只报内容就自动出 Seedance 2.5 长提示词,做短剧和广告片的可以照抄这套工作流。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 开源《芭比》AI 短片项目文件供拆解

PixVerse 官方开源《BARBIE A GIANT DREAM》AI 短片项目文件,供创作者拆解尺度节奏、对白时机和镜头语法,并支持二次创作。对 AI 编导和短剧团队来说,这是难得的官方级镜头语言与叙事节奏参考模板。

官方把《芭比》AI 短片的项目文件开源了,编导和短剧团队可以直接拆解镜头语法、对白节奏和巨物尺度处理,套用到自己的城市奇观题材上。

点击打开原文,能否访问取决于网络环境

Flux 3 复古电视质感实测:Glif 生成超现实频道切换

Glif 官方账号实测 Flux 3 在复古视频内容上的表现,称其可能是当前唯一能稳定还原 20 世纪电视特有模糊质感的模型,并用 Glif 生成了一段超现实频道切换体验的演示视频。

做复古风格和年代感画面的视觉师可以点开看,Flux 3 对 20 世纪电视模糊质感的还原是当前少见的稳定输出,值得收藏当风格参考。

点击打开原平台查看,能否访问取决于网络环境

MiniMax H3 古装剧集标题动画演示

创作者 Heather Cooper 用 MiniMax H3 制作古装剧集标题动画,并附上文本到视频提示词。演示了 H3 在片头标题动画场景的生成能力,适合做剧集片头、视觉包装的创作者参考提示词写法。

用 MiniMax H3 做古装剧集标题动画的演示,附了文生视频提示词,做短剧片头或视觉包装的可以直接抄 prompt 跑一遍看效果。

点击打开原平台查看,能否访问取决于网络环境

Google 展示 Omni 三个创意可视化用例

Google 官方账号展示 @hyperagentapp 团队用 Omni 完成的三个创意可视化用例:景观设计改造前后对比提案、将数据人格化以讲解业务仪表盘、将待办清单游戏化。均为 Omni 在商业与生活场景下的图像生成应用示例。

Google 官方晒 Omni 的三个落地用例:景观改造前后对比、数据人格化讲解、待办清单游戏化。做视觉和交互创意的可以点开看 Omni 在不同场景下的出图逻辑。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 拆解对峙戏制作:分参考图与剪辑节奏

PixVerse 官方拆解一段对峙戏的制作方法:1. 为面部/阵营/地形分别建参考图;2. 每个镜头保持同一片冰封山谷;3. 用硬切+近景音效+停顿台词制造紧张感;4. 在冲击发生前一帧剪切。强调这套方法免费,是官方分享的创作思路。

官方拆解对峙戏的 4 步做法:分参考图、统一场景、硬切加音效、提前一帧剪。做短剧和动作戏的可以直接套这套节奏。

作品与案例

Works

Wonder Studios 发布 AI 混合 3D 动画短片《88》

Wonder Studios 发布动画短片《88》,由 Junky Cream 制作,采用真人表演、动作捕捉、真实 3D 动画与 AI 叠加的混合生产方式,主打以 AI 降低 3D 动画制作成本。

做 AI 动画和短剧的可以拉片看这套「真人表演+动捕+3D+AI 叠加」的混合制作流程,成本控制思路值得抄。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 展示 Seedance 2.5 微表情演技片段

PixVerse 官方账号发布 Seedance 2.5 生成的角色表演片段,展示 85mm 镜头下角色听到真相时面部微表情的细微变化——一个几乎不可察觉的推近镜头,眼神和面部细微的破裂感。强调无剪辑、无运镜、无戏剧化处理,仅靠画面收紧和眼神传达情绪。

官方号放出的演技 demo,重点在 85mm 镜头下微表情的细微变化,做 AI 短剧和剧情片的可以拉片看角色情绪传达的极限在哪。

点击打开原平台查看,能否访问取决于网络环境

Magnific 发布 AI 粘土动画喜剧第二集

Magnific 发布 AI 粘土动画喜剧系列第二集《laundry day》,八位风格化 3D 粘土渲染角色同框,配手风琴喜剧配乐与自然音效对话,多镜头喜剧短剧形式。

做 AI 动画短剧的可以拉片看多角色一致性处理,八个粘土角色同框的调度和喜剧节奏是看点。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 发布黄金时刻电影感短片

PixVerse 官方发布一支黄金时刻电影感短片,展示从车内特写(手部、戒指捕捉落日余晖)到高空航拍(人物缩小为远景)的无缝运镜,强调镜头语言与光线氛围的连贯性。

官方号放出的电影感样片,主打黄金时刻光线和从特写到航拍的无缝运镜,做视觉和编导的可以拉片看镜头调度和光线处理。

点击打开原平台查看,能否访问取决于网络环境

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索