← 全部日报

AIGC 信息日报

2026 年 10 月 11 日 周日

行业与平台

Industry

Vivix W1 生成视频每秒成本 0.003 美元

Robert Scoble 转述 Vivix Labs 的 W1 实时交互视频模型:生成成本每秒 0.003 美元,8 秒片段约 8 秒生成,同样价钱约等于 77 条 Seedance 2.5 同长度片段;Vivix 自家对比测试中画质对标 Seedance 2.5 与 Kling 3.0。实时能力已通过 API 开放,浏览器工具在开发中。官方承认电影级质感、复杂运动和密集场景仍有差距,全量训练还在进行。

实时交互视频按秒计费,一条 Seedance 2.5 片段的钱能跑 77 条同长度 W1 片段,8 秒出 8 秒。做互动影像和实时表演类项目的可以接 API 试跑,看它现在能不能扛住复杂运动和大场面。

点击打开原平台查看,能否访问取决于网络环境

Google Cloud 发布工作向通用智能体 Gemini

Google Cloud 在 Gemini at Work 活动上发布 Gemini 工作通用智能体,从单一提示框完成问答、知识工作、内容创作和编码,基于云端持续运行,统一记忆与个性化上下文,可创建子智能体处理多步任务,支持跨多模型调度以平衡质量与成本。发帖人 @shao__meng 指出这次并非新模型发布,而是 Gemini 品牌在 Google Cloud 侧的一次重新包装。

Google Cloud 把 Gemini 做成一个能持续跑、带记忆、能派子智能体干多步活的工作助手,做团队协作和自动化流程的可以看看它怎么串多模型。

点击打开原平台查看,能否访问取决于网络环境

HeyGen Voice 登顶 AA 可控音色榜

博主 @ponyodong 转述 Artificial Analysis 可控音色榜结果:HeyGen Voice 拿下第一,超过阿里 Qwen-Audio-3.1-TTS-Plus 和 ElevenLabs Eleven v4 Turbo。该榜测的不是音色好听程度,而是给一段参考音后模型能否每次复刻同一声音。HeyGen 本身做数字人和口型驱动,声音、画面、口型在同一套工具里完成。博主给出三条做法:同一角色出中英日多语言版本并锁住音色、做系列 IP 先建角色音色库再开工、做口播和数字人优先试声画同栈。

做系列短片最怕第十集角色变声,这条把「音色锁定」为什么是生产线硬指标讲透了,配音和短剧团队可以顺着三条建议试一轮。

点击打开原平台查看,能否访问取决于网络环境

Viggle Animate 2 开放权重即将发布

Viggle AI 官方账号预告 Animate 2 将开放模型权重,具体发布时间、参数规模和能力细节均未在推文中给出。Viggle 此前以角色动画和动作迁移见长,开放权重意味着创作者有望在本地或自有服务器上跑这套动画能力,不再依赖云端调用。

Viggle 官方放话 Animate 2 要开源权重,做角色动画和动作迁移的可以蹲一波,等权重落地就能本地跑。

点击打开原平台查看,能否访问取决于网络环境

Midjourney 开放 MCP 小范围测试申请

Midjourney 官方宣布开始面向有限社区测试 Midjourney MCP,招募有创意和技术能力的人来推动模型能力边界,官方强调这次不是面向 SaaS 产品中的 Midjourney,而是纯粹的艺术和创意探索,申请入口在推文下方。对做视觉开发和工具链整合的创作者来说,这是把 Midjourney 出图能力接进自己 Agent 工作流的一次早期名额机会。

Midjourney 官方开测 MCP,明确只招有创意和技术能力的人做艺术探索、不做 SaaS 集成,想把自己的出图流程接进 Agent 的视觉师可以递申请。

点击打开原文,能否访问取决于网络环境

Higgsfield 电影节入围 126 部,投票角逐 10 万美元

Higgsfield 全球电影节公布入围名单,从 67,223 份参赛作品中选出 126 部影片,观众选择奖奖金 10 万美元,投票截止 10 月 15 日 UTC 23:59。这是目前规模较大的 AI 影像赛事之一,入围作品可作为观察当下 AI 短片创作水准的样本。

67,223 份投稿里选出 126 部,这个入围池是现成的 AI 短片样本库,编导和视觉师可以顺着名单拉片,看当下 AI 影像的天花板在哪。

点击打开原平台查看,能否访问取决于网络环境

PixVerse 联手 OpenAI 推 Prompt to Production 计划

PixVerse 官方宣布与 OpenAI 联合推出「Prompt to Production」教育计划,形式为两场线上研讨会加一个持续更新的视频系列,内容围绕如何把 OpenAI 的前沿模型与 PixVerse 的多模态生成工具结合,用于创作流程。目前公布的是计划框架,具体研讨会时间、视频上线节奏和涉及的具体模型均未在原文说明。

PixVerse 和 OpenAI 联合搞的教育计划,两场线上研讨会加持续视频系列,讲怎么把 OpenAI 模型接进 PixVerse 做创作。想摸清两家工具怎么串起来用的,蹲这波内容比零散刷教程省事。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

天工工作台接入 Vidu Q4 Preview 与 SkyNano 2.1

昆仑万维天工工作台 SkyProduction 正式接入视频模型 Vidu Q4 Preview 与生图模型 SkyNano 2.1。SkyNano 2.1 改善多轮编辑中的主体一致性,支持多图参考融合;Vidu Q4 Preview 支持参考声音与音视频同步生成,改善运镜、切镜及动作表现。Vidu Q4 Preview 至尊版年会员价格低至 0.072 元/秒。

天工工作台一次接入两个模型:Vidu Q4 Preview 支持参考声音和音视频同步生成,运镜切镜动作都有改善,至尊版年会员 0.072 元/秒;SkyNano 2.1 主打多轮编辑主体一致性和多图参考融合。做短剧和角色 IP 的可以拿它跑一遍多轮改图,看主体跑不跑偏。

Tripo 游戏资产流程升级:网格到动画六环节打通

Tripo 官方宣布其游戏资产流程升级,覆盖 Quad Mesh(四边形网格)→ 编辑 → UV → 贴图 → 绑定 → 动画六个环节,目标是用一个工具处理整条游戏资产流程。官方原帖只列出这六个环节,未给出各环节的具体参数、生成质量或上线时间。做 3D 角色和游戏美术的可以关注它能否替代多软件来回切换的现状。

Tripo 把四边形网格、UV、贴图、绑定、动画串进一个工具,做 3D 资产和游戏美术的可以试跑一遍看省不省切软件的时间。

点击打开原平台查看,能否访问取决于网络环境

Claude Design 并入对话,独立站点 12 月 14 日关闭

Claude Design 不再作为独立产品,改为 Claude 对话内的一种能力,新建的设计、设计系统和 PPT 均以 artifact 形式创建。Free、Pro、Max、Team、Enterprise 全档位可用,9 月 16 日起对话内 Design 已可使用,12 月 14 日独立站点 claude.ai/design 关闭并跳转到 Claude,官方同步发布迁移指南。

做视觉开发和提案物料的可以留意:设计、设计系统、PPT 现在都在 Claude 对话里以 artifact 形式生成,全档位可用,独立站点 12 月 14 日关停并跳转,官方已出迁移指南。

点击打开原文,能否访问取决于网络环境

方法与经验

Methods

创作者称 Opus 5.5 短剧漫剧制作流程已跑通

创作者 @zhu185178 分享用 Opus 5.5 跑短剧漫剧的流程已基本成型,并自做了一个剪辑插件:可查看素材库生成进度,还能在片段上打标记写问题,让 Claude 直接读取反馈。实测对比中,MiniMax H3 单价便宜但第一集重改 5 版,问题全出在模型抽卡——不适合大范围运动、大角度运动、特技运镜,只适合半身特写和简单推拉摇移,超出范围镜头就崩,改提示词也解决不了;Seedance 2.5 单价贵,一条 30 秒视频约 100 元,但基本一稿过,剪辑压力小很多。作者认为把重生成、失败和时间成本算进去,MiniMax H3 综合成本远高于 Seedance 2.5。

做短剧漫剧的可以细看这段踩坑记录:MiniMax H3 单价便宜但镜头一崩就得重抽,第一集改了 5 版;Seedance 2.5 一条 30 秒 100 块却基本一稿过。算上重生成和时间成本,谁更划算一目了然。

点击打开原平台查看,能否访问取决于网络环境

卡兹克 5 天用 Claude 搭 Agent 原生企业中台

虚实传媒创始人卡兹克分享:用 5 天时间为 30 多人的公司做 AI 化改造,核心是用 Claude 等工具搭建一个以 Agent 操作为原生、以飞书数据为基建的企业中台。属于团队内部流程改造的经验分享,面向的是公司运营层面的 AI 落地,不是影视创作工具或成片方法。

30 多人的公司 5 天完成 AI 化改造,用 Claude 搭 Agent 中台、飞书做数据底座。MCN 和短剧团队负责人可以看看这套内部流程怎么落地。

点击打开原文,能否访问取决于网络环境

用 Three.js 白模当导演台,排演镜头再喂 Seedance 2.5

作者 @cellinlab 分享了一套预演工作流:用 Three.js 搭白模导演台,先用代码排演船、飞机和镜头的运动轨迹,再把这段预演视频连同外观参考图一起交给 Seedance 2.5 生成成片。作者提到前几轮效果像玩具、还疑似炸到自己的船,补上几张参考图后结果才比较接近预期。

拿代码搭白模预演船、飞机和镜头运动,再把视频和外观参考图丢给 Seedance 2.5 出片——做分镜预演的编导可以照这个思路试一遍,比在 Blender 里搭场景轻得多。

点击打开原平台查看,能否访问取决于网络环境

用 Claude Opus 5.5 纯提示词在 Blender 搭出洗衣店 3DCG

日本创作者 @hayashimon1 用 Claude Opus 5.5 的提示词指令,在 Blender 中搭出一个氛围感自助洗衣店的 3DCG 场景,全程没有手动操作 Blender,制作流程写在推文回复里。对做场景美术和前期概念的人来说,这是一条「用自然语言驱动 3D 软件」的实操样本,可拆解提示词如何转成建模与布光步骤。

全程不手动碰 Blender,靠 Claude Opus 5.5 的提示词搭出带氛围的洗衣店场景,做美术和场景搭建的可以看看这套「用嘴建模」的流程能不能接进自己的前期。

点击打开原平台查看,能否访问取决于网络环境

Luma AI:Jon Erwin 用 AI 在舞台拍出《摩西》

Luma AI 官方账号介绍导演 Jon Erwin 的《摩西》拍摄方式:在曼哈顿海滩的一个舞台上完成拍摄,用真实演员表演,再由 AI 把演员置入故事所需的任意场景。核心思路是实拍表演 + AI 生成环境,绕开实景搭建和取景地的预算限制。对做 AI 长片、实拍与 AI 混合流程的编导和制片来说,这是一个「演员在棚里演、世界交给 AI」的落地样本,可关注其表演捕捉与场景合成的衔接方式。

导演 Jon Erwin 在曼哈顿海滩一个舞台上用真实演员拍《摩西》,AI 负责把演员放进故事需要的任何世界。做 AI 长片和实拍+AI 混合流程的编导、制片可以看这套「舞台实拍+AI 换景」怎么落地。

点击打开原平台查看,能否访问取决于网络环境

@AINetworkTech 分享 GPT图像经Tripo3D等生成3D动画流程

日本 AI 动画团队 UEGA 的武田分享了一条 3D 动画制作流程:先用 GPT 生成图像,导入 Tripo3D 建模,在 Opus 5.5 中为每个脚部添加骨骼、做分割和着色,再用 H3 生成动作参考视频,最后由 Opus 确认并创建关键帧,完成 3D 动画制作与渲染。作者称这套流程基本一次就能做出像样的成品,并感叹用视频生成来做游戏 3D 动画的时代到了。

从 GPT 出图到 Tripo3D 建模、Opus 5.5 绑骨骼、H3 出动作参考、再回 Opus 打关键帧渲染,一条链跑通 3D 动画。做游戏动画和 3D 预演的可以照着搭一遍。

点击打开原平台查看,能否访问取决于网络环境

H3 Max Turbo 连跑两小时,社区共创四部短片

Wonder Studios 用 Hailuo 的 H3 Max Turbo 连续生成两小时,由 @JustinHackney33 和 @marcusgrip 主持,社区成员实时决定每段故事走向,最终产出 4 部短片,全程无等待。工具链涉及 @fal 与 @Hailuo_AI,完整过程录在社区内。对做互动式内容、直播共创或短剧观众参与的团队,这是一次把生成模型接进实时协作流程的实操样本。

两小时不间断生成、观众实时决定剧情走向,四部片子零等待出片。做直播式共创和短剧互动的团队可以看看这套玩法怎么跑。

点击打开原平台查看,能否访问取决于网络环境

@whosamberella 用 AI 语音构建语言练习 App

Fish Audio 转发 @whosamberella 用 Drama 3 做的语言练习 App:主打真实对话练习,每个角色有独立性格,配初学者发音卡,答不上来时角色会表现出不耐烦。全部语音由 AI 生成,底层是 Drama 3。对做 AI 角色对话、互动叙事和配音的创作者来说,这是一个把「有情绪的 AI 语音」直接用在产品里的落地样本。

每个角色有独立性格、会因为你答不上来而不耐烦,全部语音由 Drama 3 生成。做 AI 角色对话、互动叙事和配音的可以看看这套情绪化语音怎么落地。

点击打开原平台查看,能否访问取决于网络环境

用 Claude Haiku 5.5 串 Pixabay 素材做城市宣传片

创作者用 Claude Haiku 5.5 做总调度,串联 Pixabay 视频素材 API、MiniMax 口播配音、音乐配置、声画字幕匹配和画面检查,产出西安城市宣传片和一期航拍中国山河,单条成本约 2 元。作者称引入 Pixabay API 作为素材源头后质量大幅提升,下一步计划接入更强的声音模型、音乐生成模型,并用 Haiku 5.5 在视频页面做字幕卡片。

个人创作者把 Haiku 5.5 当总调度,串 Pixabay 素材、MiniMax 配音和字幕匹配,一条航拍片成本 2 元。做批量口播和城市宣传片的可以拆一下这套流程。

点击打开原平台查看,能否访问取决于网络环境

Claude Haiku 5.5 做西湖宣传片,4 元成本附完整提示词

作者用 Claude Haiku 5.5 生成杭州西湖宣传片,全片成本 4 元,并公开完整提示词。工作流为:Pixabay API 搜素材(西湖、园林、拱桥、荷花等关键词),火山引擎 seed-audio-1.0 配音(固定音色 zh_male_m191_uranus_bigtts),画面统一裁成 1920×1080、25fps、静音,片段间 0.8 秒叠化,配中文字幕和章节标签,分晨光、湖畔、湖山、湖城、尾声五章,背景音乐音量 0.2,结尾留 3 秒片尾。

一条完整的宣传片自动化工作流:Pixabay 免费素材 + 火山引擎配音 + Claude 写脚本,全片成本 4 元。做文旅宣传片和批量口播的可以照抄这套提示词结构。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

春物语同人婚后篇第4话,小町的加分作战

B 站 UP 主「冰尖の霜语」制作的《我的青春恋爱物语果然有问题》同人婚后日常系列第 4 话,本话讲小町上门蹭饭、侍奉部重启、前社长报名等日常剧情。制作方公开了完整模型清单:文本 Opus-5.5、图片 Image-2.5、音乐 Suno-V6 mini、视频 Seedance-2.5,系列已更新至第 4 话。

《我的青春恋爱物语果然有问题》同人婚后日常第 4 话,制作方把文本、图片、音乐、视频四段用的模型全列了出来,做 AI 番剧和短剧的可以拉片看它怎么把日常对话戏撑满一集。

点击打开原平台查看

AI MV:昭和金曲citypop日语版

B 站 AI MV 大赛参赛作品,以昭和金曲 citypop 日语版为音乐底本,叙事线从唱片店初遇、放学自行车、海边夏天一路走到多年后电车重逢却互不相识。题材偏怀旧情绪向,画面围绕青春恋爱与成年后各自生活的对照展开。做音乐影像、情绪向短片的编导和视觉可以看它如何用镜头段落对应歌词与时间线。

AI MV 大赛参赛作品,走昭和 citypop 怀旧路线,讲一对恋人从心动到电车重逢认不出彼此。做音乐影像和情绪向短片的编导可以拉片看它怎么用画面接住歌词情绪。

点击打开原平台查看

AI穿越视频《不该出现的访客》第二集

B站UP主「卡拉-肖克辉」发布的AI短剧《不该出现的访客》第二集,题材为穿越回父母上学年代,标签含影视剪辑、电视剧、爱情,页面标注含AI生成内容。同系列另有第三集纯享版及第一集,作者自述为原创。做AI短剧的可以看它如何用连续剧集形式铺年代穿越题材。

B站UP主「卡拉-肖克辉」自制的AI穿越短剧第二集,穿回爸妈上学年代的设定,做AI短剧的可以拉片看它怎么处理年代感和连续剧集节奏。

点击打开原平台查看

B站AI视频:男V女V汤姆餐厅剧情超30分钟

B站「AI全民制作人」系列 AI 短剧新一集,讲男V与女V在汤姆餐厅约会的剧情,作者自述本集是铺垫已久的大戏,单场景剧情超过,并强调长时间同一小空间的剧本写作难度很大。做 AI 短剧的可以看它如何在单一场景里靠对话和剧情密度撑住长篇幅。

B站个人创作者做的 AI 短剧续集,单场景「汤姆餐厅」撑起以上剧情,做 AI 短剧的可以拉片看它怎么在小空间里堆对话和节奏。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索