01
@runwayml
Runway 官方发布新模型 Ruby,可将 SDR 视频转换为最高 16-bit HDR,输出支持 ProRes 和 EXR 序列格式,兼容任何已上传视频或生成的输出,最长支持 30 秒素材。对后期和视觉师来说,这意味着调色和合成环节可以直接在 Runway 内完成 HDR 升级,无需额外软件,工作流更顺。
后期和视觉师直接受益,把普通 SDR 素材一键升到 16-bit HDR,ProRes 和 EXR 序列都支持,调色和合成的工作流能省一大截,接 API 测一周看效果。
点击打开原平台查看,能否访问取决于网络环境
02
@pika_labs
Pika 官方发布 Pika Speech,3B 参数文本转语音模型,RTF 0.02。本地长文本测试中,生成一分钟 48kHz 工作室级语音约需 1.2 秒,支持最长五分钟的请求。
做配音和短剧后期的可以关注,本地跑长文本语音效率很高,一分钟 48kHz 语音只要 1.2 秒,支持最长五分钟请求,接进自己的配音工作流试试。
点击打开原文,能否访问取决于网络环境
03
@deepseek_ai
DeepSeek 推出实验性多模态模型 V4-Flash-Vision-Exp,已上线 API 平台,文本能力与 V4-Flash 持平,覆盖智能体、推理与世界知识;在多模态智能体基准上较 V4-Flash 大幅提升,性能接近 Opus-4.8。同日发布 DeepSeek Harness 0.1.1,开箱支持新模型。对创作者来说,这是视觉理解/智能体方向的研究型发布,不直接生成图像或视频,与 AI 影视制作工作流关联有限。
多模态智能体基准上逼近 Opus-4.8,但这是研究向的视觉理解模型,不直接产出图像视频,做片子的人用不上,搞工具链集成的可以看一眼 API。
点击打开原文,能否访问取决于网络环境
04
@oran_ge
Cola 上线全新多模态模型 Ox,小参数、强后训练,官方称能力对标 Terra 级别、速度对标 flash,目前限时免费体验。beta 阶段无技术支持且可能存在一定问题,官方在帖子集中收集反馈。
多模态小参数模型,主打 Terra 能力级别加 flash 速度,目前限时免费,做 AI 短剧和视觉的可以上手试一轮,看小参数模型出片效率值不值。
点击打开原文,能否访问取决于网络环境
05
@LumaLabsAI
LumaLabs 官方预告将推出面向创意专业人士的 Creative agents 产品,将于 9 月 14 日在与 GMI Cloud 合作的 Summer Signal 活动上正式亮相。目前仅发布预告。
Luma 官宣要出面向创意人的 Agent,9 月 14 日 Summer Signal 上发布。做视觉和短剧的可以蹲一下,看它能不能把生成、编辑、批量的活串起来。
点击打开原文,能否访问取决于网络环境
06
@OpenRouter
OpenRouter 宣布 Inkling 与 Inkling Small 两款开源权重 MoE 推理模型上线,由 @thinkymachines 直接托管,在 agentic harnesses 内免费使用,可接入 Claude Code、Codex、Hermes Agent 等工具,模型原生支持文本、图像、音频多模态。对 AIGC 技术整合者来说,这是把多模态推理能力免费接进自动化创作工作流的机会,但纯影视创作向的编导、视觉、后期团队与这条关系不大。
OpenRouter 直接托管 Inkling 和 Inkling Small,开源权重 MoE 推理模型,原生支持文本、图像、音频,可免费接入 Claude Code、Codex 等 Agent 工具。做 AI 工具链整合的可以接上试试,纯创作向的这条路过。
点击打开原文,能否访问取决于网络环境
01
@magnific
MiniMax H3 新能力演示:从任意视频生成全新机位,无需重拍,保持同一场景与表演,可切换不同视角。推文附有 prompt 拆解。对编导和短剧团队来说,这意味着分镜调度和补拍成本大幅降低,值得实测。
做短剧和编导的可以拉片看:同一场戏不重拍,直接换机位,镜头语言调度省一大截。
点击打开原平台查看,能否访问取决于网络环境
02
@heyglif
Glif 团队在自家平台实测 20 款视频模型,用同一角色面孔、不同场景,检验声音是否保持一致。测试覆盖主流视频生成模型,结果以对比形式呈现。对 AI 短剧和配音团队来说,这是选型参考,能直接看出哪些模型在跨场景时能稳住角色声音,减少后期配音对轨成本。
做 AI 短剧和配音的可以收藏这份实测,20 款模型同脸换场景测声音是否变化,选模型前先看结论。
点击打开原平台查看,能否访问取决于网络环境
03
@pyona_ai
创作者 Pyona 用 Seedance 2.5 在 Newtake 平台生成 30 秒 16:9 横屏 4K 24fps 超写实动作喜剧短片。公开的 prompt 包含:两张上传图片作为男女主角身份参考(严格保持脸部、五官、发型、体型、服装一致),5 次脸颊轻吻作为喜剧节奏点,镜头规则要求轻吻时用同一连续镜头的 camera push-in 推进到 close-up,禁止动漫感、游戏 CG 感、慢动作。
创作者用 Seedance 2.5 生成 30 秒动作喜剧短片,公开了完整 prompt:双角色身份参考、5 次轻吻节奏点、镜头推进规则。做短剧和动作戏的可以直接套这套 prompt 跑一遍看效果。
点击打开原平台查看,能否访问取决于网络环境
04
Hacker News 热门
DeepSeek 官方介绍 DeepSeek-v4-flash-vision-exp 实验模型,支持图像与文本多模态输入,可描述图片、读取截图文字、分析图表。支持 JPEG、PNG、GIF、WebP 格式,格式按文件内容自动识别。提供三种传图方式:Base64 内联编码、公开 http(s) 链接(URL 限 8192 字符、文件限 32 MiB、60 秒内下载完成)、Files API 上传引用,均兼容 OpenAI Chat Completions 与 Responses API 格式。
DeepSeek 补上多模态短板,能看图读字分析图表,API 兼容 OpenAI 格式,做 AI 工作流整合的可以接上试试,视觉师可当辅助工具用。
点击打开原文
05
@magnific
Magnific 官方演示:用 Seedream 5.0 Pro 生成角色,再作为参考图喂给 Seedance 2.5 生成动画,实现跨模型角色一致性。所有提示词和角色图已公开,由 BytePlusGlobal 提供算力支持,现已上线 Magnific 平台。
官方演示了「Seedream 5.0 Pro 建角色 + Seedance 2.5 做动画」的完整工作流,角色一致性是看点,视觉师和短剧团队可以照着跑一遍。
点击打开原平台查看,能否访问取决于网络环境
06
@ArtificialAnlys
Artificial Analysis 推出 Speech Agent Arena,用真人对比评测语音到语音模型,衡量对话偏好与任务成功率。偏好榜 Gemini 3.1 Flash Live Preview - Minimal 以 1046 Elo 居首,任务成功率由 Grok Voice Think Fast 2.0 High 以 94.7% 领先。评测覆盖 15 个需调用工具的智能体场景(如点外卖)和 20 个非智能体场景(如询问营业时间),通过真人实时对话后投票拟合偏好 Elo 分。
做 AI 配音、虚拟角色对话和实时语音交互的团队,这份榜单直接告诉你哪个语音模型用户更爱聊、任务成功率更高,选型前值得扫一眼。
点击打开原文,能否访问取决于网络环境
07
@xieenze_jr
Sol-Engine 团队官方介绍 MiniMax H3 超级加速方案,在单张 NVIDIA GB200 上,5 秒 768p 视频生成从 152.3 秒降至 6.85 秒(22.2× 加速),10 秒视频达 27.7× 加速,对比已发布的 SGLang 基准。按 MiniMax 官方 API 价格折算,理想满载下单卡每小时可服务约 525 条 5 秒视频,对应约 210 美元/小时产值,单卡月产 37.8 万条 5 秒视频。
推理加速直接换算成成本账:单张 GB200 一天能出 1.26 万条 5 秒视频,做短剧批量生产的制片可以算算自己的单位成本能压到多少。该产品的发布我们已在 2026-08-01 报过,这条是官方对已有能力的介绍,不是新上线。
点击打开原文,能否访问取决于网络环境
08
@lansenai
创作者澜森分享一套真人电影级实拍质感动作短片的提示词模板,约13秒,强调 ARRI Alexa 35 级别电影质感、真实皮肤布料金属与风压雨雾,要求镜头焦点、光线方向、受力反馈连续可读,允许少量超现实能力但必须真实照亮人物与环境。角色设定示例为「赤凰」:东亚女性,红色旗袍,可将身体解构为黑色羽鸟重组。
一份能直接套用的电影级动作短片提示词模板,从摄影质感、镜头逻辑到角色设定都写得很细,做 AI 短剧和视觉的可以拿去改角色和场景直接跑。
点击打开原平台查看,能否访问取决于网络环境
09
Luma AI Blog
Luma AI 官方博客发布 12 条 UGC 风格 AI 视频 prompt 示例,面向 DTC 品牌和创作者广告场景。每条示例针对 UGC 广告的镜头语言、口播节奏和产品展示方式设计,可直接套用或改写。
做 DTC 广告和电商素材的可以直接抄这 12 条 prompt 模板,省得自己调半天。
点击打开原文
10
@zephyr_kongge
小红书博主分享水上商单收入约 2w/月,万粉账号图文视频报价 2k-5k,平台抽 10% 平台费,中介单另返 20%-40%,到手约 65%。另开源一套 10 个 skill 的小红书起号工作流,覆盖定位、选题、写作、视觉、复盘五个环节,含账号体检、笔记复盘等工具。
做小红书商单变现的可以看报价分成细节,想用 AI 起号的可以试这套开源 skill 工作流。
点击打开原文,能否访问取决于网络环境