← 全部日报

AIGC 信息日报

2026 年 10 月 6 日 周二

行业与平台

Industry

Reflection 发布 501B 开源权重模型 Beam

Reflection 推出首个开源权重模型 Beam,稀疏 MoE 架构,总参数 501B、激活 23B,面向编码、推理和智能体任务。预训练用了 23.8 万亿 token,RL 阶段在 10.5K 张 NVIDIA GB300 上跑 4 周、生成超 1 亿次 rollout。官方称在编码和智能体任务上对标 GLM 5.2、接近 Qwen 3.8-Max。目前仍在红队测试和评估,权重、技术报告、模型卡和开发者物料本月以 Apache 2.0 许可发布,已开放早期访问申请。

501B 总参、23B 激活的稀疏 MoE,主打编码和智能体任务,权重本月以 Apache 2.0 放出。做创作自动化的技术整合者可以蹲权重,纯拍片的这条可以先放。

点击打开原文

按照 SemiAnalysis 的测试结果:同样 200 美元,Claude 订阅的 Token 用量约为…

半导体与 AI 产业研究机构 SemiAnalysis 实测了 Anthropic、OpenAI 等九家的 AI 订阅套餐,方法是逐 Token 测进度条跳格、再按 API 标价折算成美元。结论:顶配模型两家接近(200 美元档 GPT-6 Astra 约值 2897 美元、Fable 5.1 约值 2485 美元),差距出在中档日常主力模型,Claude 各套餐价值约为 OpenAI 的 5 倍。OpenAI 9 月 29 日 DevDay 前后把 200 美元 Pro 档用量从 Plus 的 20 倍降到 10 倍,并推出 500 美元新档独享每秒约 300 Token 的 Ultrafast 模式,老用户旧额度保留到 10 月 29 日。

重度跑编程智能体的团队可以拿这份实测当采购参考:同样 200 美元,Claude 中档模型折算价值约为 OpenAI 五倍,OpenAI 上周刚把 Pro 档砍半。

点击打开原文,能否访问取决于网络环境

Higgsfield 上线 AI 网红工作室,免费创建

Higgsfield 官方推文宣布上线 AI Influencer Studio(higgsfield.ai/ai-influencer-studio),主打免费创建 AI 网红形象,面向虚拟人设账号运营场景。推文正文仅含产品名与链接,未展开具体功能参数。做虚拟 IP、带货号、AI 网红矩阵的团队可以先去页面实测形象生成与一致性表现。

Higgsfield 开了个 AI 网红工作室页面,主打免费创建虚拟人设账号,做虚拟 IP 和带货号的可以先去跑一个看看出图稳定度。

腾讯发布新开源视频模型 预览表现扎实

腾讯开源一款新视频模型,Hugging Face 页面为 FrancisRing/Prism,发布者称预览效果看起来扎实。目前公开信息仅到模型名称与预览,具体参数、时长、分辨率等细节需查看 Hugging Face 页面。

腾讯又放了个开源视频模型 Prism,Hugging Face 上已有预览,做视频生成的可以先去下权重跑几条看画质和运动稳定性。

ElevenLabs 办 10 万美元广告赛,头奖 5 万

ElevenLabs 旗下 @ElevenCreative 发起名为 The Search 的竞赛,总奖池 10 万美元,寻找全球最洗脑的广告,第一名奖金 5 万美元,共 11 位获奖者,每人还可与 ElevenLabs 创意制作团队进行 1:1 交流。赛事主打广告曲/声音记忆点这一维度。做广告片、声音设计和音乐向内容的创作者可关注参赛门槛与提交要求。

总奖池 10 万美元找全球最洗脑的广告,头奖 5 万,11 位获奖者还能跟 ElevenLabs 创意制作团队一对一聊。做广告片和声音设计的可以拿这个当命题作业练手。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools

Krea Agent 登陆 After Effects,可做动态图形与音视频处理

Krea AI 宣布 Krea Agent 进入 After Effects,可在 AE 内制作动态图形、调整视频尺寸,并处理声音、图像等内容,目前已开放免费试用。对后期和剪辑来说,这意味着原本要在 Krea 网页端和 AE 之间来回导素材的环节,现在能在一个时间线里完成,做动态包装和批量改尺寸的团队值得实测它跟现有合成流程的衔接。

Krea Agent 直接进 AE 面板,动态图形、改尺寸、处理声音图像都在时间线里做,后期和剪辑的可以装上免费试一周,看它接不接得住你现有的合成流程。

点击打开原平台查看,能否访问取决于网络环境

Manus 一条提示词把两小时素材剪成 vlog

Manus 官方展示 Manus Video 的自动剪辑能力:创作者 @Nin19536 带回 125 段旅行片段、近两小时素材,输入一个提示词后,Manus 自动挑出精彩片段并生成 12 分 48 秒的初剪版本,成片带字幕、音乐、特效,并保持了旅行的时间线叙事。官方附有演示视频说明实现过程。

125 段旅行素材、近两小时原片,一句提示词出 12 分 48 秒带字幕配乐特效的初剪,做纪录片和旅拍的后期可以盯一下这个自动粗剪能力。

点击打开原文,能否访问取决于网络环境

Nano Banana 2.1 发布 提示检查 Google Flow

用户 @chetaslua 发帖称 Nano Banana 2.1 已发布,并提示去 Google Flow 里检查是否已更新到该版本,同时给出一个测试 prompt:用你最喜欢的电影,从结尾到开头倒序画面做一张拼贴画。帖子本身只有这一句发布提示加一个 prompt,没有模型参数、能力清单或官方发布链接。做视觉开发和分镜的可以打开自己的 Flow 账号确认版本,用这个倒序拼贴 prompt 快速对比新旧模型在多画面构图和风格统一上的差别。

Nano Banana 2.1 已进 Google Flow,做视觉开发和分镜的可以打开自己的 Flow 账号确认版本,顺手用「把最爱电影从结尾倒着拼成一张拼贴画」这个 prompt 试一下新模型的画面组织能力。

点击打开原文,能否访问取决于网络环境

Suno 上线 Albums 功能,支持整张专辑项目管理

Suno 上线 Albums 功能,支持用户把音乐作品整理成完整专辑项目。官方编辑团队推荐了首批 5 张专辑,包括 Oakwood///diskrot 的《naenia》(古典与民谣融合,含「My Hill」「wildgrass」等曲目)、Isaiah Wallace 的乡村专辑《Old Soul》(温暖原声吉他配怀旧主题)、KakerMix///diskrot 的《phenomenal》(80 年代复古合成器与电子鼓)。

Suno 把单曲生成升级成整张专辑的项目管理,做 AI 音乐、短剧配乐和 MV 的可以试一下多曲目统一调性,官方还挑了 5 张首批专辑当参考。

点击打开原文

Claude 云端会话可读写本地指定文件夹

Claude Projects 云端会话新增本地文件夹访问能力:会话仍跑在云端,只在任务需要时读写用户在本机批准的指定文件夹,已开始逐步推出。作者 Thariq 把这种「云端运行、本地取用」的模式称为 local hands,并确认该能力后续也会进入 cowork。对做素材管理、脚本归档、批量文件处理的创作者来说,这是把本地素材库接进云端 AI 会话的一条路径。

Claude Projects 云端会话现在能连你电脑上批准的文件夹,任务需要时才读写,作者叫它 local hands。自己搭素材库、脚本库自动化的可以试一下接法。

点击打开原平台查看,能否访问取决于网络环境

作者称文本到动画3D模型全流程即将本地免费上线

开发者 Nikhil Shahane 展示了一套全自动流程:文本生成图像、图像转 3D、自动绑定骨骼、自动生成动画,全程无需手动 rigging 和手动动画,且完全本地运行(Mac + Nvidia)免费。他称这是向 Tripo、Meshy 能力靠拢的一大步,但仍有不少小问题待修,计划本周晚些时候把该功能加入自己的 image-to-3dlab 供测试。

文本→图→3D→绑定→动画全自动,本地 Mac 和 N 卡免费跑,做 3D 角色和虚拟形象的可以蹲这周上线的测试版。

点击打开原平台查看,能否访问取决于网络环境

商汤 SenseNova 6.8 Flash 预览版支持静态图转动态

商汤官方账号发布 SenseNova 6.8 Flash Preview 的动态设计演示,主打把静态图片转成动态效果,配文以「Vibe coding, paw edition」加一只小狗的示例呈现。除演示视频外,官方未在推文中给出模型参数、开放方式或调用入口。做视觉开发和后期动效的可以先看这段演示判断动态质感,是否可用还需等官方后续说明。

商汤放出的 SenseNova 6.8 Flash 预览版能把静态图做成动态效果,配了只小狗的演示。做视觉和后期动效的可以点开看看动起来是什么质感,再决定要不要接进流程。

点击打开原平台查看,能否访问取决于网络环境

Gemini Notebook 改用量限额:5 小时刷新加后台队列

Gemini Notebook 更新用量限额系统:限额刷新周期从每 24 小时改为每 5 小时,全天持续分配;原先按功能单独限额改为 Notebook 专属的灵活限额,由用户自行决定额度怎么花;额度用尽时可将视频、幻灯片等生成任务放入后台队列,之后自动生成。对需要批量产出视频和幻灯片的创作者来说,额度分配更灵活、任务可排队等待,适合把生成任务攒起来过夜跑。

限额从 24 小时刷新改成 5 小时,还能把视频、幻灯片生成任务丢进后台队列自动跑,做批量出片和素材堆量的可以留意这套额度怎么分配。

点击打开原文,能否访问取决于网络环境

LTX 回顾 VFX 周:源分辨率处理与调色塑造 HDR

LTX 官方发布 VFX 周回顾,强调三点:支持使用自己的布局、在源分辨率下处理、以及在调色阶段塑造 HDR,并称工具围绕后期制作中的决策来构建,由用户根据镜头需求决定 LTX 介入的位置。推文本身未展开具体参数或操作细节,完整内容需看链接中的回顾。

LTX 官方复盘 VFX 周,主打自定义布局、源分辨率处理和调色阶段塑造 HDR,做后期和合成的可以点进去看它想插进流程的哪个环节。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

用 H3 Max 视频做神经运动匹配动画

作者用 9 段 H3 Max(@fal)生成的视频——8 段图生视频加 1 段视频扩展——做神经运动匹配,把结果和参考素材分别放在两条视频里对比,并全部接进一个 Three.js WebGPU 场景,配了自定义 IK 和动画混合。做角色动画、3D 预演和动作捕捉替代方案的可以看这套从视频到可驱动骨骼的接法。

9 段 H3 Max 视频(8 段图生视频 + 1 段视频扩展)喂进 Three.js WebGPU 场景做神经运动匹配,还自己写了 IK 和混合。做角色动画和 3D 预演的可以拆他的做法。

点击打开原平台查看,能否访问取决于网络环境

用 Opus 5.5 做 MV:绿幕抠像到卡点出片全流程

作者用 Opus 5.5 完成一支 MV 的抠像、配乐、卡点、特效和出片,人物素材是 Seedance 生成的绿幕视频。流程分四步:四角取绿幕色去绿边并先出检查图;写网页搭五层画面(背景、人身后大字、带投影人物、前景贴纸、纸张纹理颗粒),文字绕人转圈时后半圈画在人后面;分析动作停顿点,把 128 BPM 配乐对上,停顿拍冻住人做成白边贴纸、下一拍撕掉;无头浏览器逐帧截图喂 ffmpeg,响度做到 -14 LUFS。作者称品牌 MV、新品广告、舞蹈二创、电商模特换场景都能套用。

一条把绿幕素材做成卡点 MV 的完整做法:抠像、五层画面、动作停顿对 128 BPM、无头浏览器逐帧喂 ffmpeg。做后期和舞蹈二创的可以照着跑一遍。

点击打开原平台查看,能否访问取决于网络环境

OPUS 5.5 纯代码做动态设计发布片

X 用户 @ultimaxbt 分享一套用 Claude(OPUS 5.5)纯代码制作动态设计发布视频的完整 prompt,称成片花费 0 美元、不使用任何外部工具。prompt 要求输入一个单词品牌名、9-12 张高清图、一首 120 BPM 含 drop 与安静段落的免版税音乐(Mixkit)和一段墙面植物影子的免费素材(Pexels);风格指定苹果发布会式 2D 一镜到底,场景之间靠物体变形衔接,禁用交叉溶解、模糊、3D 翻转、粒子、光效和超过 1 秒的定格,字体用 Archivo 与 Geist,配 iOS 26 液态玻璃质感。

一条完整可抄的 prompt:苹果发布会式一镜到底、无转场无粒子,全靠物体变形和光标点击推进。做动态设计和 KV 动画的可以拿这段直接跑一遍。

点击打开原平台查看,能否访问取决于网络环境

Claude Opus 5.5 配 Blender MCP 建模湖上城市教程

日本作者葦沢かもめ发布图文教程,讲解如何用 Claude Opus 5.5 配合 Blender MCP 完成 3D 建模,示例项目是「湖上漂浮的城市」。教程发布在 note.com,含具体操作流程。对做场景概念设计、美术预演和 3D 资产前期搭建的创作者,这是一条把大模型接进 Blender 直接建模的实操参考。

作者把 Claude Opus 5.5 接 Blender MCP 做 3D 建模的完整流程写成了图文教程,做场景概念和美术预演的可以照着跑一遍,看 AI 直接操作 Blender 建出「湖上城市」这种复杂场景到底靠不靠谱。

@alecwilcock 对比 GPT Image 2.5 Sunburst 与 Ideogram 4.5

Alec Wilcock 发布 GPT Image 2.5 Sunburst 与 Ideogram 4.5 的图像编辑对比,用自己照片做测试。他判断效果大概率来自简单的蒙版/局部重绘,并指出可辨识的痕迹:肩膀旁的灌木逐渐变成一条线、靠近 T 恤一侧手臂上的纹身褪色,以及头部被切掉一半。他提到想尝试把这一处理套用到视频的每一帧上。

作者拿自己照片对比两款模型的图像编辑效果,指出大概率是蒙版/局部重绘,还发现肩膀边缘和纹身会随处理褪色、头部被切掉一半。做视觉和后期修复的可以看这个失败案例,判断能不能逐帧套到视频上。

点击打开原平台查看,能否访问取决于网络环境

Three.js 做走位参考,搭配 Seedance

创作者 Rory Flynn 分享的工作流:用 Three.js 搭建三维场景作为镜头调度和构图参考(blocking refs),再交给 Seedance 生成视频,摄影质感和光影效果借助 Midjourney 补充。推文附 11 秒演示片段,展示这套组合的初步效果。

用 Three.js 先搭三维空间做镜头调度参考,再喂给 Seedance 生成,摄影质感靠 Midjourney 补——做分镜预演的可以试这套组合。

点击打开原平台查看,能否访问取决于网络环境

Mustafy 分享 Google Flow 电影感 AI 视频教程

推文转发的是一条 Google Flow 使用教程,主题为「如何用 Google Flow 制作电影感 AI 视频」,标注为分步讲解(Step by Step),推文正文本身只有这一句标题,未展开具体步骤、参数或案例。做 AI 短片和视觉开发的可以点开原视频看完整流程。

Google Flow 做电影感视频的分步讲解,想上手这套流程的编导和视觉师可以跟着走一遍,看镜头和节奏怎么调。

点击打开原平台查看,能否访问取决于网络环境

作者称用AI流程完成游戏飞行单位制作

3D 创作者 @Stefan_3D_AI 分享用 AI 一天完成一个可玩飞行单位的全流程:模型、干净 UV、PBR 贴图、绑定、动画、VFX 到游戏逻辑。他称最大的突破是智能 UV——干净拓扑让 AI 直接从颜色贴图生成正确的法线、粗糙度、金属度贴图,无需高模烘焙,并已用这套流程做出自己 RTS 游戏的第一个飞行单位,附完整过程与单个角色真实成本视频。

做 3D 资产和游戏美术的可以看这套流程:干净拓扑让 AI 直接从颜色贴图生成法线/粗糙度/金属度,省掉高模烘焙这一步,作者附了完整过程视频和单个角色的真实成本。

点击打开原平台查看,能否访问取决于网络环境

Seedance 2.5 生成科幻动作片段

创作者 @NoOneIsHere2603 用 Seedance 2.5 生成一段科幻动作片段,并公开完整提示词:视觉风格设定为超电影感科幻、写实 CGI、夜晚未来城市、蓝橙对比光、雨雾火花碎片;主角为黑色未来装甲战士,明确要求脸型、发型、装甲设计、配色、身材比例和武器配置全片 100% 一致;动作按 0-5 秒陨石撞击、5-10 秒装甲人从陨石中走出、10-15 秒敌方战斗机器人从烟雾中现身分段描述。

一条 15 秒科幻动作片段的完整提示词,从视觉风格、角色锁定到 0-5/5-10/10-15 秒分段动作都写全了,做 AI 短片分镜的可以照着这个结构改自己的 prompt。

点击打开原平台查看,能否访问取决于网络环境

Kling 4.0 AI视频创作完整指南

Kling AI 官方博客发布《Inside Kling 4.0: A Complete Guide to AI Video Creation》,标题标注日期 Sep 30, 2026,内容为 Kling 4.0 的完整使用指南。输入文本仅含标题,未展开具体章节、参数或工作流细节。

Kling 官方给 4.0 补了一篇完整使用指南,做 AI 视频的可以当工具书翻,但这是文档不是新模型。

点击打开原文

作品与案例

Works

B站AI短剧超长长长蛋挞复仇第二集

B站作者「京晶漫剧」发布的 AI 短剧《超长长长蛋挞如何复仇》第二集,走拟人化食物复仇的剧情向路线,带 #ai短剧 #剧情 #动画 标签,系列化更新、单集短平快的结构,是个人创作者做 AI 短剧连载的一个样本。

B站作者「京晶漫剧」的 AI 短剧系列第二集,蛋挞拟人化的复仇剧情向,做 AI 短剧的可以拉片看它怎么用连续剧集养观众。

点击打开原平台查看

B站UP主造梦师希希发布AI短片

B站UP主「造梦师希希」发布的AI短片,题材围绕「星座决定戒色导师」的网感设定展开,属于个人创作者的AI影像作品。

B站UP主「造梦师希希」的AI短片,走的是星座+戒色这种网感梗题材,做AI短剧和搞笑向内容的可以拉片看它怎么把梗转成画面。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索