← 全部日报

AIGC 信息日报

2026 年 9 月 14 日 周一

行业与平台

Industry

蚂蚁灵波开源 LingBot-World 2.0 三款世界模型

蚂蚁灵波科技继 7 月开源 14B 模型后,本周再开源 LingBot-World 2.0 Small(1.3B)、Bidirectional 和 Causal Pretrain 三款模型。LingBot-World 2.0 是实时交互世界模型,支持小时级连续生成,可响应攻击、射箭、施法、射击等角色动作及下雪、下雨等环境事件,高算力配置下可达 720P / 60FPS。Small 版面向消费级单卡 GPU,可在单卡实时生成;Bidirectional 提供蒸馏源,Causal Pretrain 提供因果预训练底座。项目主页、Hugging Face、魔搭、GitHub 代码与技术报告均已放出。

1.3B 版本能在单卡上实时跑,支持小时级连续生成和攻击、施法、下雪等事件响应,做互动影像和实时场景的技术整合者可以拉下来本地跑一遍。

工具与能力

Tools
本日无符合条目

方法与经验

Methods

reelbench-skills 开源:AI 视频逐镜头拉片工具

作者 @GoSailGlobal 开源 reelbench-skills,上线两天 196 star,Apache 2.0。含两个 skill:video-shots 把一条成片拆成逐镜头分析表,时长、景别、运镜、画面描述列在一张表里,切点和时长由 ffmpeg 量出,模型只判断四件事,14 道质量门逐条对账;video-sync 做画面与分镜信息同步,镜头切换时信息跟着切,横竖版各一套布局。拉片报告是单文件交互页,内嵌播放器,播放时同步高亮镜头、点镜头即跳转,离线双击可开。零 npm 依赖、零 API key,只需 node 和 ffmpeg,Claude Code、Codex 可用脚本软链安装。

把一条成片拆成逐镜头分析表,时长景别运镜全在一张表里,切点由 ffmpeg 量、模型只判断该判断的。做 AI 短剧和分镜的可以装起来,拿自己的片子跑一遍看镜头节奏。

点击打开原平台查看,能否访问取决于网络环境

作者分享用 Runway Agent 制作病毒广告的完整拆解

作者 Nicolas Neubert 拆解了自己那条病毒广告的制作过程:通过 Runway 平台、ChatGPT Runway 插件或 Runway MCP 调用 Agent,让它生成一条 30 秒、针对 Seedance 2.5 优化的提示词——故事是度假中的人被老板临时要求改方案,表情微变后镜头拉远露出广阔风景,结尾停在超广角以便加标语。作者称结果超出预期,并给出追问话术用于批量产出同结构的不同变体,同时提醒 Agent 会基于历史对话生成个性化画像,结果可能因人而异。

作者公开了用 Runway Agent 生成 30 秒 Seedance 2.5 广告提示词的完整过程,还给了批量出变体的追问话术,做广告和短剧的可以照着跑一遍。

点击打开原平台查看,能否访问取决于网络环境

@TanLuAI 称在 Codex 用 GPT image 2.5 补人物与环境资产图

作者分享在 Codex 里调用 GPT Image 2.5 补全人物与环境资产图的做法:不用写复杂提示词,直接让模型基于新剧情(新的 AI 视频提示词)设计生成角色和场景图,群众角色可做到千人千面。文中给出两条指令原文——一条生成平民多人角色设定图(服装风格可不同、可含外星人),一条基于原场景图生成反打镜头的长街场景并保持建筑风格一致。

用剧情提示词直接让 Codex 调 GPT Image 2.5 出龙套角色设定图和反打场景图,还给了可抄的指令原文。做 AI 短剧、需要大批群众角色的美术和编导可以照着跑一遍。

点击打开原文,能否访问取决于网络环境

GPT-6 Astra 操控 Blender 建模,Pollo AI 转成街景视频

日本 Hasamaru Studio 分享一套工作流:先用 GPT-6 Astra 操作 Blender 生成街景 3D 模型,再在 Blender 里搭好镜头运动,最后用 Pollo AI 的 Seedance 2.5 补上材质、光线和人群动态转成视频。作者称走路路线、环视时机、仰视角度这些镜头运动在生成时都能更自由地控制。

用 GPT-6 Astra 驱动 Blender 搭 3D 街景、定机位,再交给 Pollo AI 的 Seedance 2.5 加质感光影和行人,走路路线和抬头角度都能自己控。想精确控制镜头运动的编导可以照这套流程跑一遍。

点击打开原平台查看,能否访问取决于网络环境

VYRO 发布 Kling 3.0 登山镜头分镜 prompt

Magnific 发布 VYRO · Kling 3.0 的生成 prompt,按镜头切分:SHOT 1 为 0–3 秒,电影感实拍登山场景,要求沿用参考图中的脏旧墨镜与镜面反射中的登山者,用极微距拍镜片反射里戴头盔、背灰色背包的登山者向上迈一步,含风声与呼吸声描述。属于带分镜结构的 prompt 示例,可看镜头切分与参考图约束的写法。

一条带完整分镜 prompt 的 Kling 3.0 实测,从墨镜镜面反射里拍登山者迈步,做镜头语言和参考图一致性的可以照着拆。

点击打开原文,能否访问取决于网络环境

OpenRouter 一个 key 调多家 TTS 模型

OpenRouter 发布文本转语音 API 使用教程,通过 OpenAI 兼容的 POST /api/v1/audio/speech 端点提供 TTS 服务,一个 API key 即可调用多家供应商的语音模型,无需分别对接各家接口。做 AI 配音、旁白批量生成和短剧对白的后期团队,可以按这套端点把多家 TTS 串进现有流程里对比音色和成本。

配音和后期可以看:一个 API key 走 OpenAI 兼容端点调多家 TTS,省掉挨个平台注册比价,做批量旁白的先拿它跑通再说。

点击打开原文

Cristóbal Valenzuela 晒 8 美元 9.5 分钟做广告

Runway 创始人 Cristóbal Valenzuela 转发 Nicolas Neubert 的推文,称一条广告花费 8 美元、制作耗时 9.5 分钟。

Runway 创始人转发的低成本广告案例,8 美元、9.5 分钟出片,做投放和商单的可以看看这个成本结构。

点击打开原平台查看,能否访问取决于网络环境

用户用 Seedance 2.5 生成高中走廊超自然视频

创作者 @itsSaira_1 用 Seedance 2.5 生成一段高中走廊超自然场景,并公开完整提示词:要求锁定金发女生的五官、发型、服装、身材比例和背包全程一致,镜头从中景缓慢推进,随后出现粉红色能量特效、周围学生惊慌散开,画面指定手持运镜、运动模糊、镜头光晕、浅景深、自然皮肤质感、体积光和好莱坞级画质,并在广角、中景、特写、跟拍之间切换。做 AI 短片和短剧的可以拆解它的角色一致性写法和运镜描述。

一条完整可抄的 Seedance 2.5 提示词,从角色一致性锁定到手持运镜、体积光、镜头切换全写清了,做 AI 短片和短剧的可以拿这段当模板改。

点击打开原平台查看,能否访问取决于网络环境

用 reelbench-skills 拉片《当幸福来敲门》镜头节奏

作者用 reelbench-skills/video-sync 拆解《当幸福来敲门》片段:原片 160 秒共 40 镜,平均 4 秒一镜,开头 5 秒塞进 5 个镜头,结尾 22.27 秒长镜不切,最短 0.30 秒与最长 22.27 秒相差 74 倍,工具处理耗时 10 分 33 秒。作者同时提出背景音乐与剧情配合对成片质量影响很大,正在求教选背景音乐的思路。

拿 reelbench-skills/video-sync 把 160 秒 40 镜的片段拆出逐镜时长,最短 0.3 秒最长 22.27 秒,做剪辑和分镜的可以拿它量自己片子的节奏。

点击打开原平台查看,能否访问取决于网络环境

OpenAI 官方分享 GPT-6 Astra 提示词优化建议

OpenAI 开发者账号发布使用建议,针对 GPT-6 Astra 提出三条优化方向:让 skill 的触发条件更具体、只在相关时才加载指引、以及明确定义任务完成的标准,完整内容在 developers.openai.com 博客。属于官方提示词与 Agent 配置层面的调优指引,不涉及新模型或新功能发布。

官方给的调优建议:skill 触发条件写具体、按需加载指引、明确任务完成标准。自己搭 Agent 流程的可以照着改一版配置。

点击打开原文,能否访问取决于网络环境

作品与案例

Works

欧美 AI 短剧《沦为阿尔法的猎物》中字全集

B 站 UP 主「欧美短剧姬」搬运的欧美 AI 短剧《沦为阿尔法的猎物》(I am the prey of three alphas)中字全集,狼人/阿尔法题材,做 AI 短剧的可以拉片看海外团队在同类题材上的角色一致性和分集处理。

欧美向 AI 短剧的中字搬运合集,做 AI 短剧的可以拉片看海外团队怎么处理狼人题材的角色一致性和分集节奏。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索