达芬奇新版加入 MCP,Codex 可直接操作剪辑
用户 @wadezone 发帖称,达芬奇最新版本增加了 MCP 功能,Codex 可以直接操作达芬奇。帖子未给出具体版本号、操作范围或演示,仅一句结论加互动数据。对后期和剪辑岗来说,如果 MCP 真能驱动达芬奇,意味着 AI 助手可以接管时间线操作、批量处理这类重复劳动,值得自己装一版验证。
为什么值得看:达芬奇新版支持 MCP,Codex 这类 AI 编程助手能直接驱动剪辑软件,做后期的可以试着自己搭一条自动剪辑流程。
按创作使用场景整理 AI 视频、图像、声音和工作流工具更新,重点保留能直接试用、比较或纳入制作流程的信息。

用户 @wadezone 发帖称,达芬奇最新版本增加了 MCP 功能,Codex 可以直接操作达芬奇。帖子未给出具体版本号、操作范围或演示,仅一句结论加互动数据。对后期和剪辑岗来说,如果 MCP 真能驱动达芬奇,意味着 AI 助手可以接管时间线操作、批量处理这类重复劳动,值得自己装一版验证。
为什么值得看:达芬奇新版支持 MCP,Codex 这类 AI 编程助手能直接驱动剪辑软件,做后期的可以试着自己搭一条自动剪辑流程。
Suno 官方演示三种新输入方式:上传照片可生成对应主题的歌曲(如「根据这张照片做一首乡村歌」),上传视频可为其生成配乐,哼唱 15 秒可让模型以这段哼唱为主干扩展成完整歌曲。对短剧和预告片后期来说,视频直接出配乐这条能省掉找版权音乐和手动对点的环节。
为什么值得看:上传一张照片或一段视频就能出配乐,哼 15 秒还能当骨架扩成整首歌,做短剧配乐和预告片声音的可以拿手上的素材试一轮。
Luma Labs 给 Layers 加了文字提取功能:选中图层点 Extract,画面里烘焙进图层的文字会被转成可编辑的实时文本,并自动套上字体库里最接近的字体,可以直接改字、换字体、重新排版。官方说法是改一句文案从「重新生成一张图」变成两次点击。对做海报、KV、电商图的视觉和后期来说,这意味着出图后的文案微调不用再回炉重跑。
为什么值得看:做海报和 KV 的视觉师可以试:选中图层点 Extract,图里的字就变成可编辑文本并自动匹配最接近的字体,改文案不用整张重生成。
HeyGen 官方宣布推出 Professional Voice Clone 功能,现已进入 API 预览阶段。该功能基于 20 分钟的个人语音素材训练专属声音模型,官方演示中两段音频分别来自真人 Josh 与其克隆音色,用于对比效果。该能力直接面向数字人、AI 配音等需要高保真声音一致性的创作场景。
为什么值得看:HeyGen 官方推出专业声音克隆,20 分钟素材就能训练专属音色,现在 API 预览可用。做数字人、AI 配音和短剧的可以直接接 API 试,角色声音一致性这块能省不少事。
Grok 转发 Imagine 的更新:视频场景生成支持自定义首尾帧,或创建无缝循环,指令控制能力有所增强。适用于 AI 视频创作者控制镜头起止与循环素材生成。
为什么值得看:做 AI 视频的可以上手试试首尾帧控制,镜头起止能自己定,做循环背景和转场会顺手很多。
fal 官方介绍 H3 Max 与 H3 Max Turbo 现支持原生实时 Full HD(1080p)视频生成,5 秒视频生成时间低于 5 秒,每帧细节更丰富。对 AI 短剧和批量内容生产团队来说,这意味着高清素材的实时产出成为可能,可显著缩短从提示词到成片的等待时间,适合接入自动化工作流。
为什么值得看:H3 Max 系列原生实时 1080p,5 秒视频 5 秒内出,做短剧和批量出片的可以直接接 API 跑,废片率和出片速度都值得实测。该产品的发布我们已在 2026-08-28 报过,这条是官方对已有能力的介绍,不是新上线。
Google 在 Gemini Flash 系列模型上推出 agentic 视频理解,模型不再按固定 1 FPS 单遍读取视频,而是按需加载帧、音频和转录文本。官方称 token 最多减少 88%、成本降低 66%、标准视频基准准确率提升 7%。仅通过 Gemini API(Google AI Studio 和 Gemini Enterprise Agent Platform)提供,支持文件上传和公开 YouTube URL,按标准 token 计费无额外功能费,无开源权重。
为什么值得看:做 AI 后期和工具链的可以关注:视频理解不再按固定 1 FPS 全量读,而是按需取帧、音频和字幕,长视频分析成本能砍一大截,接 API 就能用。
Google 在 Gemini 中推出音乐生成模型 Lyria 3.5,主打更丰富的编曲、更具表现力的人声和更高保真度。用户可选择音乐类型、人声或纯器乐,探索新模板,并生成较短或更长的曲目。对后期和短剧团队来说,这意味着配乐和 BGM 的生成质量与可控性提升,可直接在 Gemini 内完成从选风格到出曲的流程。
为什么值得看:做后期配乐和短剧 BGM 的可以上手试,编曲丰富度和人声表现力是这次升级重点,能直接生成不同长度的曲目。
OpenRouter 推出视频模型横向评测功能,支持在多种挑战任务下并排对比不同视频模型。评测显示 Seedance 2.5 在物理模拟和指令遵循方面表现突出,新发布的 MiniMax H3 Max 则在生成速度和成本上树立新标杆。
为什么值得看:选视频模型前先来这拉个对比,Seedance 2.5 物理和指令遵循强,MiniMax H3 Max 主打速度和成本,做短剧的挑模型能省不少试错时间。
Magnific 官方演示角色参考图功能:将角色设定图(脸、眼镜、毛衣、波点)作为参考输入,每次生成都能保持完全一致。示例 prompt 为「羊毛毡定格动画女性角色参考图,纯白无缝背景」。该功能面向 AI 动画和短剧制作中的角色一致性需求。
为什么值得看:做角色一致性的视觉师可以点开看,官方演示了用一张角色参考图(脸、眼镜、毛衣、波点)在每次生成中保持完全一致,对 AI 动画和短剧的角色稳定很有参考价值。
阿里千问创作上线 Agent Teams 功能,支持 Wan3.0,已在 PC 端和千问 App 上线。用户只需描述创意,Agent 自主规划任务,由编剧、导演、美术、视频生成等不同角色 Agent 分工协作,完成从创意策划、脚本撰写、角色设定、分镜设计、画面生成、配音配乐到成片制作的全流程,支持创作 AI 短剧、漫剧、营销广告、图像设计等内容。
为什么值得看:千问把创作从写提示词改成提创意,Agent 自动拆任务、编剧导演美术分工协作,做 AI 短剧和漫剧的团队可以上手试,看这套多 Agent 流程能不能真省掉中间环节。
Anthropic 官方宣布,自9月14日起,Claude Code 的 Pro、Max、Team 及按席位计费的 Enterprise 套餐标准每周限额将永久提高25%。在此之前,目前50%的增幅将继续生效。
为什么值得看:做 AI 短剧批量生产的团队如果重度依赖 Claude Code 跑自动化流程,额度上调能省点成本,可以留意下。