01
@OpenAIDevs
OpenAI 宣布 GPT-Live-1 正式登陆 API,即 1-800-ChatGPT 背后的语音能力。开发者可将其接入应用,获得边说边听的自然对话语音智能体,并搭配自选的模型与 harness 使用。对做配音、虚拟角色对话、实时语音交互的团队来说,这是把电话客服级语音能力搬进自己产品的直接入口。
1-800-ChatGPT 背后的语音能力现在能接进自己的应用,边说边听、可自选模型和 harness,做 AI 配音、虚拟角色对话、实时语音交互的可以接 API 跑一周。
点击打开原平台查看,能否访问取决于网络环境
02
@thsottiaux
OpenAI 员工 Tibo(@thsottiaux)发帖称,Astra 驱动的五项功能本周上线:Images 2.5、GPT-Live-1、Agents API、Data Agent、ChatGPT for Financial Services,并称下周还有更多计划、尚未到 DevDay。帖子只列了功能名,未给出参数、价格或具体开放时间。做图像生成的可以关注 Images 2.5,做自动化工作流的可以关注 Agents API 的接入方式。
Images 2.5、GPT-Live-1、Agents API 等五项本周上线,做图像和 Agent 工作流的可以盯一下 Images 2.5 和 Agents API 的实际开放情况。
03
X
Dario Amodei 发布新文章《We Must Pace the Frontier》,主张 AI 行业应放慢前沿推进速度,并提出三部分计划。Anthropic 单方面承诺执行第一步:为第三方评估者提供永久的员工级系统访问权限,用于核实安全措施执行情况、报告事故,并评估训练期间模型的 alignment。该消息由 Anthropic 首席经济学家 Peter McCrory 在 X 上转述。
Anthropic 一把手亲自下场谈行业该不该踩刹车,还给出三步计划并单方面先做第一步。做 AI 内容的可以了解下监管风向,但跟拍片工作流没直接关系。
点击打开原文,能否访问取决于网络环境
04
@googlecloud
Google Cloud 宣布扩大与 Avid 的合作,目标是让后期制作更快、更智能,并且可以从任何地方访问,官方说法是让剪辑师少花时间翻找素材、多花时间讲故事。具体的技术细节、接入方式和上线时间需要看链接原文。对做后期和剪辑流程的团队来说,这是云厂商和主流剪辑软件厂商在素材检索与远程协作方向上的合作动向。
Google Cloud 和 Avid 扩大合作,主打让剪辑师少花时间翻素材、多花时间讲故事,做后期和剪辑流程的可以点进去看具体怎么落地。
点击打开原文,能否访问取决于网络环境
01
@hq4ai
汗青 HQ 分享:尤栗 Yuri 演唱会落地,现场使用百米 12K 巨幕,观众几千人几乎全满,最后一首歌时无人离场,正式节目本周陆续更新。这是 AIGC 内容进入线下大型演出场景的一次实际落地,验证了 AI 生成画面在超大尺寸、高分辨率大屏上的可用性。做视觉开发和线下演出的可以关注后续放出的正式节目,看大屏素材的镜头节奏和分辨率处理。
AIGC 内容第一次撑起线下演唱会的百米 12K 巨幕,几千人现场几乎坐满、散场没人走。做视觉和制片的可以盯后续放出的正式节目,看大屏素材怎么切、怎么和现场节奏对。
点击打开原文,能否访问取决于网络环境
02
Tripo
Tripo 官方给出的一套 3D 角色制作流程:先用 Codex 把单张图拆成头、发、身三个部件,再用 Tripo P2.0 分别 3D 化,头部建议控制在 2000-5000 面以保证网格干净结构化,最后交给 GPT-6 Astra 在 Blender 中完成组装、表情设置和绑定。核心思路是分件建模换取更规整的拓扑,让后续绑定和物理设置少出问题。
做 3D 角色和虚拟人的可以照这套流程走一遍:Codex 拆部件、Tripo P2.0 分件建模、Astra 在 Blender 里组装绑定,头部面数给了 2000-5000 的参考区间。
点击打开原平台查看,能否访问取决于网络环境
03
@magnific
Magnific 官方发布演示:通过 GPT-6 Astra 搭配 Magnific MCP,在单次对话中同时控制画面风格、动作和特效,产出带动态图形的视频。官方列出三类效果——图形跟随动作反应、超现实材质变换、电影感剪辑与运镜,并附上完整 prompt 供复现。
Magnific 官方演示用 GPT-6 Astra 加自家 MCP,一句对话里同时控画面、动作和特效,做动态图形和转场的可以照着 prompt 跑一遍。
点击打开原平台查看,能否访问取决于网络环境
04
@PixVerse
PixVerse 官方账号展示的一条工作流演示:在 Blender 里手工摆放树木、房屋、灯光的温馨村庄场景通常需要 2-3 天,改用 GPT-6 Astra 生成耗时 15 分钟,再由 PixVerse 在 5 分钟内转成最终视频。原文只给出这两个环节的耗时对比,未说明场景资产的具体生成方式与 PixVerse 使用的模型版本。
PixVerse 官方晒的流程演示:Blender 里手工摆 2-3 天的村庄场景,GPT-6 Astra 15 分钟生成、PixVerse 5 分钟出片。做场景概念和预演的视觉师可以看这条怎么把建模和出片串起来。
点击打开原平台查看,能否访问取决于网络环境
05
@krea_ai
Krea 官方账号转发 @lostnlatency 的 Krea Agents 早期体验分享,作者称拿到 early access 已有一段时间,想测试单次对话能把 Agent 推到什么程度,帖子以「this is 'imagi…'」开头,具体产出内容被截断。
Krea 官方转发的早期体验帖,作者用一次对话把 Krea Agents 推到极限,做视觉开发和图像工作流的可以看看单会话能承载多少步操作。
点击打开原平台查看,能否访问取决于网络环境
06
@eternityspring
作者烁皓发布 reelbench-skills 系列 skill 的新模块 video-sync,可把拉片分析结果贴回原视频上,并导出方便逐帧学习的新视频;同时在系列 skill 中加入钩子、铺垫、递进、重音、转折、兑现、换气、收口八个维度的节奏分析。作者表示后续将探索复刻与二创方向。
把拉片结论直接叠回原片、导出可逐帧看的新视频,还加了钩子/铺垫/递进等八个节奏维度分析,做短剧和编导的可以拿它拆自己片子的节奏。
点击打开原平台查看,能否访问取决于网络环境
07
@magnific
Magnific 发布 Kling 3.0 Omni 生成片段《Where the Day Begins》,公开了 SHOT 1 的完整 prompt:越南真人文艺片风格,侧向跟拍同一名成年骑行者从右向左骑行,指定灰色羊毛衫、炭灰长裤、棕色皮鞋和做旧黑色自行车,并附参考图链接。属于带 prompt 的镜头级实测演示,可看到模型对服装、道具和运动方向的还原控制。
一条带完整 prompt 的 Kling 3.0 Omni 实测:真人文艺片质感、侧向跟拍、指定服装与道具,做分镜和视觉开发的可以照着这个 prompt 结构改自己的镜头。
点击打开原平台查看,能否访问取决于网络环境
08
@topazlabs
Topaz Labs 分享 Aurora Aura 作品《Solaris Breath》的创作流程,该片在柯尼卡美能达 PLANETARIA YOKOHAMA 天文馆放映。流程为:Midjourney 与 NanoBanana Pro 生成静帧,Topaz Gigapixel 放大源图,再用 Grok Imagine、PixVerse、ViduAI、Seedance 生成视频。多模型分工出片加放大环节,适合做高分辨率投影类影像的团队参考。
从 Midjourney 出图到 Grok、PixVerse、Vidu、Seedance 多模型出片,再进 Topaz 放大,这条把穹顶投影级影像的完整工具链摊开了,做视觉和后期拆一遍能省不少试错。
点击打开原文,能否访问取决于网络环境
09
@rionaifantasy
作者称放弃 Screen Studio 订阅,改用 GPT-6 Astra 加 Remotion 的组合,在 Codex 内部调用 Remotion 为自研开源项目「微信个人情报库」(2000+ star)做了一支 58 秒产品宣传片,全程耗时 20 几分钟,作者评价丝滑程度不输 Screen Studio。对做产品宣传片、录屏演示和批量出片的后期与工具链团队来说,这是一条把代码生成工具接进视频渲染流程的实操样本。
用 Codex 在内部直接调 Remotion 出 58 秒产品宣传片,20 几分钟搞定,做后期和工具链的可以看看这套自动化出片的路子。
点击打开原平台查看,能否访问取决于网络环境
10
@huangyun_122
作者黄赟用 GPT-6 Astra Ultra 配合 QWen3 ASR FileTrans,一条提示词把张元拆解清华陈晶的 11 分 30 秒视频切成 6 个观点切片,原视频梳理了 880+ 条陈晶视频,覆盖起号、选题、流量、内容、交付和循环飞轮。作者认为月薪 1 万左右的剪辑手将面临裁员,并建议有矩阵的团队直接大量铺切片。
作者用 GPT-6 Astra Ultra 加 QWen3 ASR 转写,一条提示词把 11 分半的长视频切成 6 个观点切片,做矩阵号的可以照着跑一遍看切片质量。
点击打开原平台查看,能否访问取决于网络环境