Making advanced intelligence m…
OpenAI 宣布,借助 GPT-5.6 Sol 在效率上的突破,已降低 Luna 和 Terra 两款模型的 API 调用价格。具体降价幅度和新的定价细节需查看官方公告。这是 OpenAI 在降低高级智能使用成本上的最新动作。
OpenAI 官宣 Luna 和 Terra 模型降价,做 AI 短剧和批量出片的团队可以算算 API 成本降了多少,直接决定下一轮制作预算。
OpenAI 宣布,借助 GPT-5.6 Sol 在效率上的突破,已降低 Luna 和 Terra 两款模型的 API 调用价格。具体降价幅度和新的定价细节需查看官方公告。这是 OpenAI 在降低高级智能使用成本上的最新动作。
OpenAI 官宣 Luna 和 Terra 模型降价,做 AI 短剧和批量出片的团队可以算算 API 成本降了多少,直接决定下一轮制作预算。
NVIDIA 发布 Cosmos3-Super-4Step 蒸馏模型,将文生图推理步数从 50 步降至 4 步,图生视频从 35 步降至 4 步,并去除了无分类器引导(CFG),登顶开源文生图/视频榜首。
NVIDIA 把文生图推理步数从 50 步压到 4 步,图生视频从 35 步压到 4 步,还去掉了无分类器引导。做视觉和短剧的可以接 API 测一下出片速度和废片率,省时间就是省钱。
点击打开原平台查看,能否访问取决于网络环境
HeyGen 官方宣布,自其播客上线后 AI 数字分身引发关注,将推出系列教程讲解如何制作最佳输出,首期主题为数字分身设置。目前仅发布预告,具体教程内容需查看链接。
HeyGen 宣布要出数字分身制作教程系列,做虚拟角色和 AI 短剧的可以蹲一下,看官方怎么定义最佳实践。
点击打开原文,能否访问取决于网络环境
LumaLabs 在 Luma Agents 中上线「Layers」功能,支持从 Luma 生成或用户上传的图片中自动提取图层(产品、背景、标题等),用户可单独替换其中任一元素而保留其余部分不变,基于 Uni-1 模型驱动。
Luma Agents 新增图层提取能力,从图片里单独抠出产品、背景、标题分别替换,做广告物料和视觉迭代的可以省掉来回切图软件的时间。
点击打开原平台查看,能否访问取决于网络环境
阿里 Wan 视频推出实时生成模式(Realtime mode),用户输入文字描述即可实时重塑画面,无需点击生成按钮或等待加载,实现边想边改的交互式视觉创作。
Wan 视频的实时生成模式,打字即改画面,不用点生成按钮。做视觉概念设计和分镜的可以当实时画板用,省掉反复调参的等待时间。
点击打开原平台查看,能否访问取决于网络环境
ElevenLabs 为有声书制作新增角色语音自动分配功能:上传文稿后自动识别角色并推荐对应声音,支持预览角色在对话中的实际朗读效果,而非通用样本。该功能直接嵌入有声书制作流程,减少手动分配角色的工作量。
ElevenLabs 给有声书加了个角色语音自动分配功能,上传文稿自动识别角色并匹配声音,还能听角色在对话里的实际效果。做 AI 配音和有声书的后期可以直接省掉手动分配角色的步骤。
点击打开原平台查看,能否访问取决于网络环境
Google 旗下 Gemini App 宣布限时免费提供 10 个 Omni 视频生成额度,截止太平洋时间 2026 年 8 月 4 日 23:59。用户可在工具菜单中选择「创建视频」进行生成、编辑和混剪。该活动面向所有用户,无需付费即可体验 Gemini Omni 的视频生成能力。
Gemini 免费送 10 个 Omni 视频生成额度,截止 8 月 4 日。做短剧和视觉的可以趁免费期实测 Omni 的生成质量和风格一致性,零成本试错。
点击打开原平台查看,能否访问取决于网络环境
CapCut 推出 Director Mode(导演模式),面向 AI 影视创作全流程:从创意构思、分镜规划、素材管理到最终精修,整合在单一工作流内,不再只是生成片段后切到其他工具处理。该模式已上线。
CapCut 把导演模式塞进剪辑台,从构思到分镜到素材管理到精修一条线走完,做 AI 短剧和长片的可以上手跑一遍,看能不能省掉来回切工具的功夫。
点击打开原平台查看,能否访问取决于网络环境
OpenAI 与 Airtable 合作,将后者直接集成进 ChatGPT。用户可在聊天界面连接已有数据表、生成新表格结构,并将非结构化对话即时转化为可运行的工作流。该功能由 OpenAI 总裁 Greg Brockman 在 X 上宣布,Airtable 官方账号同步发布。
ChatGPT 直接连 Airtable,聊天界面就能建表、改结构、把零散对话转成可跑的工作流。做 AI 短剧或视觉项目的制片和整合者,可以省掉手动整理素材表、排期表、分镜表的时间,直接在对话里生成和更新。
点击打开原平台查看,能否访问取决于网络环境
OpenAI 为 Codex 中的 ImageGen 功能新增灯箱和画布界面,方便在工作流中预览和调整生成图像。同时,ChatGPT 和 Codex 桌面端上线了新的图像编辑工作流,支持点击角色、擦除元素、标注修改位置等交互式操作,减少对长 prompt 的依赖。
Codex 里 ImageGen 的灯箱和画布更新,主要是 UI 交互层面的优化,对创作工作流影响有限。做视觉的可以看一眼,但不用专门跑一遍。
点击打开原平台查看,能否访问取决于网络环境
MiniMax 旗下 Hailuo AI 发布新模型 H3,个人创作者用 15 秒 prompt 实测,生成结果在角色运动、物理交互和镜头连续性上表现突出,初步观感接近 Seedance 2.0 水平。
MiniMax 新模型 H3 刚出,实测 15 秒 prompt 出片,角色运动、物理交互和镜头连续性接近 Seedance 2.0。做 AI 短剧和视觉的可以点开看实测对比,判断值不值得切工具链。
点击打开原平台查看,能否访问取决于网络环境
可灵 AI 官方发布戛纳狮子奖获奖短片《L'Ultimo Uomo Reale》幕后案例。短片由 Lipstick 制作、导演 Sebastian Strasser 执导,使用可灵 AI 保持角色一致性与电影级画面细节,探索「何为真实」的命题。导演将 AI 称为「被引导的技术」,强调 AI 在可信角色表演和逼真视觉效果上的突破。
可灵 AI 官方发布的戛纳狮子奖获奖短片幕后,导演把 AI 定位为「被引导的技术」。做 AI 短剧和视觉的可以拉片看角色一致性和电影级画面细节怎么在 AI 管线里落地。
点击打开原平台查看,能否访问取决于网络环境
Kling AI 官方博客发布教程,介绍如何利用其平台创建个性化教育视频,涵盖角色设计、场景生成、语音合成、视频编排等环节,目标用户为教育内容创作者,提供从脚本到成片的完整工作流参考。
Kling AI 官方博客手把手教你做个性化教育视频,从角色设计到语音合成全走通。做在线课程或知识类 AI 短片的工作室可以直接套这个工作流,省去试错成本。
点击打开原文
Thoughtworks CTO Giles Edwards-Alexander 通过实验证明,对 AI 智能体(Claude Code + Cursor)生成的约 15 万行 Rust 应用进行代码重构,可大幅降低后续修改的 token 消耗。单个数据访问层文件从 17,155 行重构至 3,695 行,输入 token 消耗从 159,564 降至 27,360。
AI 生成代码越堆越贵?Thoughtworks CTO 用实测数据告诉你重构能省多少 token。做 AI 短剧批量生产管线、搭自动化工作流的技术整合者,这个成本模型可以直接套用评估自己的项目。
点击打开原文
Skyscanner 品牌团队在美加广告拍摄中,用 Runway 辅助艺术指导,在开拍前锁定镜头构图、灯光方向和演员站位,并将生成的场景、道具和构图直接放入最终广告版式(OOH、Meta 广告等)。团队将原本两周的构思过程压缩为可执行的预可视化方案,使拍摄现场反馈闭环从后期提前到实时。
Skyscanner 用 Runway 做广告预可视化,把两周的构思压成可执行的方案,片场实时验证。做导演和美术的可以看看这套工作流怎么把后期反馈提前到拍摄现场。
宝玉基于其 baoyu-design Skill 实践指出,AI 生成美观且易编辑的 PPT 的最佳中间格式是 HTML+CSS,Claude Opus 模型效果最好。若要转为原生 PPTX,需使用有约束的 HTML+CSS。引用推文则强调,设计精炼直观且往返高保真的中间表示才是正确路线,基于 HTML 或操作 PPT 软件包的方案在效率和成本上均不占优。
做 AI 演示文稿或视觉提案的,可以拿这套 HTML+CSS 中间格式思路跑一遍,比直接操作 PPTX 工具链出图更可控,Claude Opus 出 HTML 效果最好。
点击打开原文,能否访问取决于网络环境
Rachel @Zesee 分享其3个月从0运营抖音账号的完整数据:累计50余条视频、1万粉丝、20多个广告合作、变现超3万元。公开了使用的AI工作流和数字人口播的Codex Skill,并组建付费实战群共享方法与工具。
个人AI做抖音账号的实操复盘,3个月50多条视频做到1万粉变现3万+,公开了工作流和Codex Skill。做AI短视频/数字人口播的创作者可以拆解她的变现路径和自动化流程。
点击打开原文,能否访问取决于网络环境
AI 创作者 Sani Ai Tech 在 X 上分享实测:同一 K-pop MV 项目分别用 Seedance 2.0 和 MiniMax H3 生成,Seedance 2.0 输出经典僵硬 AI 动作,H3 则产出富有表现力的偶像动作,动态文本也能无缝融入画面美学。
个人实测对比 Seedance 2.0 和 MiniMax H3 在 K-pop MV 风格上的表现,做 AI 视觉和 MV 的可以看 H3 的偶像动作和动态文本效果,当个风格参考。
点击打开原平台查看,能否访问取决于网络环境
PixVerse 官方推文解释深度图作为控制层的核心原理:通过灰度距离信息让模型识别场景中物体的远近和运动方向(向前/向后)。链接指向详细说明或演示,适合想精细控制生成视频镜头语言的创作者参考。
PixVerse 官方把深度图控制层拿来单独讲,做 AI 视频的视觉和后期可以点开链接看具体用法,对理解镜头景深和运动控制有基础参考价值。
点击打开原文,能否访问取决于网络环境
AI樱木(@0xSilver_Time)分享Codex 5.6在视频制作中的4个实用技能:HyperFrames(文字到视频框架)、Remotion(React批量生成,适合数字人+动效)、video-use(自动识别素材卡点剪辑)、Seedance(电影级运镜prompt生成)。每条工具附外链,实测一周总结。
个人实测Codex 5.6做视频的4个技能:HyperFrames出策划到渲染、Remotion批量出片、video-use自动卡点剪辑、Seedance补运镜指令。做AI视频的可以快速检一遍链接,省自己试错。
点击打开原平台查看,能否访问取决于网络环境
Google Flow Music 官方发布用 Lyria 3.5 在 Flow Music 平台生成的完整音乐作品《Hasta Que Salga El Sol》,展示 Lyria 3.5 在音乐生成上的实际出片效果,风格偏拉丁流行,音质和结构完整性是看点。
Google Flow Music 用 Lyria 3.5 生成的完整音乐作品,做 AI 配乐和声音设计的可以直接拉片听音质和风格一致性,看 Lyria 3.5 在 Flow Music 里的实际出片水平。
点击打开原平台查看,能否访问取决于网络环境
fofr 用 Flux 3 生成了一段金属乐队现场手机翻录视频,模拟小场地演出返场时的盗录质感,包含手抖、人群模糊等真实手机拍摄特征。评论区多位用户表示伪劣画质处理比单纯加噪点更自然,难以一眼分辨是否为 AI 生成。
Flux 3 的伪手机翻录质感很到位,手抖和人群模糊不是简单加噪点,做视觉和后期的一眼就能看出区别。
点击打开原平台查看,能否访问取决于网络环境
创作者 CuiMao 在 Seedance 2.5 即将到来之际,用 Seedance 2.0 配合 Kimi K3 模型制作了一部游戏流程体验视频,作为对 Seedance 2.0 的告别作品。视频为 AI 生成,完整流程需点击评论区链接体验。
Seedance 2.0 极限压榨 + Kimi K3 模型配合,做 AI 短剧和视觉的可以拉片看角色一致性和镜头连贯性在极限性能下的表现。
点击打开原平台查看,能否访问取决于网络环境
B站AI短剧系列《赛伊德》第二集,4分半钟,变身喜剧题材。由B站官方AI平台updream制作,监制徐Toso,动画导演巴巴Boyei,AIGC生成师旁可PANKO。系列化AI短剧,角色一致性和叙事节奏是看点。
B站AI短剧系列第二集,4分半的变身喜剧,做AI短剧的可以拉片看角色一致性和叙事节奏,尤其是B站官方AI平台updream的成片质感。
点击打开原平台查看
小红书作者「一叶扁舟-」发布 AI 短片,标题提及郭帆认证,正文仅含小红书首页链接,无作品正片、无工具链、无工作流细节。
标题蹭了郭帆热度,但正文只有链接没有作品本体,无法判断质量。做 AI 短剧的可以搜作者主页看看,但这条本身信息量约等于零。
点击打开原文
