← 全部日报

AIGC 信息日报

2026 年 9 月 13 日 周日

行业与平台

Industry

OpenAI 把 GPT-Live-1 语音模型开放至 API

OpenAI 宣布 GPT-Live-1 正式登陆 API,即 1-800-ChatGPT 背后的语音能力。开发者可将其接入应用,获得边说边听的自然对话语音智能体,并搭配自选的模型与 harness 使用。对做配音、虚拟角色对话、实时语音交互的团队来说,这是把电话客服级语音能力搬进自己产品的直接入口。

1-800-ChatGPT 背后的语音能力现在能接进自己的应用,边说边听、可自选模型和 harness,做 AI 配音、虚拟角色对话、实时语音交互的可以接 API 跑一周。

点击打开原平台查看,能否访问取决于网络环境

@thsottiaux 预告 Astra 本周上线五项功能

OpenAI 员工 Tibo(@thsottiaux)发帖称,Astra 驱动的五项功能本周上线:Images 2.5、GPT-Live-1、Agents API、Data Agent、ChatGPT for Financial Services,并称下周还有更多计划、尚未到 DevDay。帖子只列了功能名,未给出参数、价格或具体开放时间。做图像生成的可以关注 Images 2.5,做自动化工作流的可以关注 Agents API 的接入方式。

Images 2.5、GPT-Live-1、Agents API 等五项本周上线,做图像和 Agent 工作流的可以盯一下 Images 2.5 和 Agents API 的实际开放情况。

Dario Amodei 发文呼吁放慢 AI 前沿速度

Dario Amodei 发布新文章《We Must Pace the Frontier》,主张 AI 行业应放慢前沿推进速度,并提出三部分计划。Anthropic 单方面承诺执行第一步:为第三方评估者提供永久的员工级系统访问权限,用于核实安全措施执行情况、报告事故,并评估训练期间模型的 alignment。该消息由 Anthropic 首席经济学家 Peter McCrory 在 X 上转述。

Anthropic 一把手亲自下场谈行业该不该踩刹车,还给出三步计划并单方面先做第一步。做 AI 内容的可以了解下监管风向,但跟拍片工作流没直接关系。

点击打开原文,能否访问取决于网络环境

Google Cloud 扩大与 Avid 合作,加速后期制作

Google Cloud 宣布扩大与 Avid 的合作,目标是让后期制作更快、更智能,并且可以从任何地方访问,官方说法是让剪辑师少花时间翻找素材、多花时间讲故事。具体的技术细节、接入方式和上线时间需要看链接原文。对做后期和剪辑流程的团队来说,这是云厂商和主流剪辑软件厂商在素材检索与远程协作方向上的合作动向。

Google Cloud 和 Avid 扩大合作,主打让剪辑师少花时间翻素材、多花时间讲故事,做后期和剪辑流程的可以点进去看具体怎么落地。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

达芬奇新版加入 MCP,Codex 可直接操作剪辑

用户 @wadezone 发帖称,达芬奇最新版本增加了 MCP 功能,Codex 可以直接操作达芬奇。帖子未给出具体版本号、操作范围或演示,仅一句结论加互动数据。对后期和剪辑岗来说,如果 MCP 真能驱动达芬奇,意味着 AI 助手可以接管时间线操作、批量处理这类重复劳动,值得自己装一版验证。

达芬奇新版支持 MCP,Codex 这类 AI 编程助手能直接驱动剪辑软件,做后期的可以试着自己搭一条自动剪辑流程。

GPT-Image-2.5 Sunburst 在 Arena 免费直用剩 24 小时

Arena 提醒用户在 Direct Mode 免费使用 OpenAI 的 GPT-Image-2.5 Sunburst 仅剩 24 小时,该模型刚在 Text-to-Image Arena、Image Edit Arena 和 Multi-Image Edit Arena 三项榜单均排名第一。用户在 Arena 选择该模型即可直接测试,官方 Discord 有相关讨论。

GPT-Image-2.5 Sunburst 在文生图、图像编辑、多图编辑三个 Arena 榜单都排第一,Arena 的 Direct Mode 还能免费直用 24 小时。做视觉开发和 KV 的趁窗口期上手跑几组图,比看榜单更实在。

点击打开原文,能否访问取决于网络环境

方法与经验

Methods

尤栗Yuri演唱会落地:AIGC撑起百米12K巨幕

汗青 HQ 分享:尤栗 Yuri 演唱会落地,现场使用百米 12K 巨幕,观众几千人几乎全满,最后一首歌时无人离场,正式节目本周陆续更新。这是 AIGC 内容进入线下大型演出场景的一次实际落地,验证了 AI 生成画面在超大尺寸、高分辨率大屏上的可用性。做视觉开发和线下演出的可以关注后续放出的正式节目,看大屏素材的镜头节奏和分辨率处理。

AIGC 内容第一次撑起线下演唱会的百米 12K 巨幕,几千人现场几乎坐满、散场没人走。做视觉和制片的可以盯后续放出的正式节目,看大屏素材怎么切、怎么和现场节奏对。

点击打开原文,能否访问取决于网络环境

Tripo P2.0 出结构化网格,配合 GPT-6 Astra 做绑定

Tripo 官方给出的一套 3D 角色制作流程:先用 Codex 把单张图拆成头、发、身三个部件,再用 Tripo P2.0 分别 3D 化,头部建议控制在 2000-5000 面以保证网格干净结构化,最后交给 GPT-6 Astra 在 Blender 中完成组装、表情设置和绑定。核心思路是分件建模换取更规整的拓扑,让后续绑定和物理设置少出问题。

做 3D 角色和虚拟人的可以照这套流程走一遍:Codex 拆部件、Tripo P2.0 分件建模、Astra 在 Blender 里组装绑定,头部面数给了 2000-5000 的参考区间。

点击打开原平台查看,能否访问取决于网络环境

用 GPT-6 Astra + Magnific MCP 对话生成动态图形视频

Magnific 官方发布演示:通过 GPT-6 Astra 搭配 Magnific MCP,在单次对话中同时控制画面风格、动作和特效,产出带动态图形的视频。官方列出三类效果——图形跟随动作反应、超现实材质变换、电影感剪辑与运镜,并附上完整 prompt 供复现。

Magnific 官方演示用 GPT-6 Astra 加自家 MCP,一句对话里同时控画面、动作和特效,做动态图形和转场的可以照着 prompt 跑一遍。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 称 GPT-6 Astra 15 分钟完成村庄场景

PixVerse 官方账号展示的一条工作流演示:在 Blender 里手工摆放树木、房屋、灯光的温馨村庄场景通常需要 2-3 天,改用 GPT-6 Astra 生成耗时 15 分钟,再由 PixVerse 在 5 分钟内转成最终视频。原文只给出这两个环节的耗时对比,未说明场景资产的具体生成方式与 PixVerse 使用的模型版本。

PixVerse 官方晒的流程演示:Blender 里手工摆 2-3 天的村庄场景,GPT-6 Astra 15 分钟生成、PixVerse 5 分钟出片。做场景概念和预演的视觉师可以看这条怎么把建模和出片串起来。

点击打开原平台查看,能否访问取决于网络环境

Krea Agents 早期体验:单次对话能推到多远

Krea 官方账号转发 @lostnlatency 的 Krea Agents 早期体验分享,作者称拿到 early access 已有一段时间,想测试单次对话能把 Agent 推到什么程度,帖子以「this is 'imagi…'」开头,具体产出内容被截断。

Krea 官方转发的早期体验帖,作者用一次对话把 Krea Agents 推到极限,做视觉开发和图像工作流的可以看看单会话能承载多少步操作。

点击打开原平台查看,能否访问取决于网络环境

reelbench-skills 新增拉片结果贴回原视频功能

作者烁皓发布 reelbench-skills 系列 skill 的新模块 video-sync,可把拉片分析结果贴回原视频上,并导出方便逐帧学习的新视频;同时在系列 skill 中加入钩子、铺垫、递进、重音、转折、兑现、换气、收口八个维度的节奏分析。作者表示后续将探索复刻与二创方向。

把拉片结论直接叠回原片、导出可逐帧看的新视频,还加了钩子/铺垫/递进等八个节奏维度分析,做短剧和编导的可以拿它拆自己片子的节奏。

点击打开原平台查看,能否访问取决于网络环境

Kling 3.0 Omni 发布越南文艺片镜头提示词

Magnific 发布 Kling 3.0 Omni 生成片段《Where the Day Begins》,公开了 SHOT 1 的完整 prompt:越南真人文艺片风格,侧向跟拍同一名成年骑行者从右向左骑行,指定灰色羊毛衫、炭灰长裤、棕色皮鞋和做旧黑色自行车,并附参考图链接。属于带 prompt 的镜头级实测演示,可看到模型对服装、道具和运动方向的还原控制。

一条带完整 prompt 的 Kling 3.0 Omni 实测:真人文艺片质感、侧向跟拍、指定服装与道具,做分镜和视觉开发的可以照着这个 prompt 结构改自己的镜头。

点击打开原平台查看,能否访问取决于网络环境

Aurora Aura作品在柯尼卡美能达天文馆展出

Topaz Labs 分享 Aurora Aura 作品《Solaris Breath》的创作流程,该片在柯尼卡美能达 PLANETARIA YOKOHAMA 天文馆放映。流程为:Midjourney 与 NanoBanana Pro 生成静帧,Topaz Gigapixel 放大源图,再用 Grok Imagine、PixVerse、ViduAI、Seedance 生成视频。多模型分工出片加放大环节,适合做高分辨率投影类影像的团队参考。

从 Midjourney 出图到 Grok、PixVerse、Vidu、Seedance 多模型出片,再进 Topaz 放大,这条把穹顶投影级影像的完整工具链摊开了,做视觉和后期拆一遍能省不少试错。

点击打开原文,能否访问取决于网络环境

Codex 调 Remotion 20 分钟做 58 秒宣传片

作者称放弃 Screen Studio 订阅,改用 GPT-6 Astra 加 Remotion 的组合,在 Codex 内部调用 Remotion 为自研开源项目「微信个人情报库」(2000+ star)做了一支 58 秒产品宣传片,全程耗时 20 几分钟,作者评价丝滑程度不输 Screen Studio。对做产品宣传片、录屏演示和批量出片的后期与工具链团队来说,这是一条把代码生成工具接进视频渲染流程的实操样本。

用 Codex 在内部直接调 Remotion 出 58 秒产品宣传片,20 几分钟搞定,做后期和工具链的可以看看这套自动化出片的路子。

点击打开原平台查看,能否访问取决于网络环境

黄赟称用一条提示词切出视频6个观点切片

作者黄赟用 GPT-6 Astra Ultra 配合 QWen3 ASR FileTrans,一条提示词把张元拆解清华陈晶的 11 分 30 秒视频切成 6 个观点切片,原视频梳理了 880+ 条陈晶视频,覆盖起号、选题、流量、内容、交付和循环飞轮。作者认为月薪 1 万左右的剪辑手将面临裁员,并建议有矩阵的团队直接大量铺切片。

作者用 GPT-6 Astra Ultra 加 QWen3 ASR 转写,一条提示词把 11 分半的长视频切成 6 个观点切片,做矩阵号的可以照着跑一遍看切片质量。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

GPT-6 Astra 据照片用 3D 构建老式机械表

Higgsfield AI 展示:用 GPT-6 Astra 从一张照片生成老式机械表的 3D 模型,共 177 个独立元素、90 万个动画关键帧,所有资产均在 Blender 中由 Higgsfield 生成。属于图像到三维资产的生成演示,展示复杂机械结构的拆件与动画能力。

从一张照片生成 177 个零件、90 万关键帧的 3D 机械表,做视觉开发和三维资产的可以看看这套从图到模型的流程能拆出什么。

点击打开原平台查看,能否访问取决于网络环境

UP主-胡莱克修斯-发布AI短片第二集

B 站作者「-胡莱克修斯-」的 AI 短剧《女朋友被假小子牛走,所以只能拿下假小子了!》第二集,属于「AI全民制作人」系列。

B 站 AI 短剧系列第二集,播放量不错,做 AI 短剧的可以拉片看角色一致性和连续叙事怎么处理。

点击打开原平台查看

AI 灵异短剧《野佛》第二幕上线

B 站作者 foooga 的原创灵异恐怖 AI 短剧《野佛》第二幕《叩首》,系列作品,恐怖题材,主打氛围营造与叙事推进。

灵异恐怖题材的 AI 短剧系列第二幕,做短剧的可以拉片看恐怖氛围和叙事节奏怎么用 AI 呈现。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索