← 全部日报

AIGC 信息日报

2026 年 9 月 29 日 周二

行业与平台

Industry

可灵 Kling 4.0 公布细节,10 月上线并开启 Flash 内测

可灵官方公布 Kling 4.0 细节并开启内测:4.0 将于 10 月正式上线,Flash 版自 9 月 28 日起早期内测。核心升级包括单次最长 30 秒(Flash 20 秒,可续延)、最多 10 个关键帧、单任务最多 15 个参考素材(图片/视频/角色/声音)、支持单独修改运镜/风格/背景,并加入 4K/HDR、21:9、原生声音与多语言能力。官方称升级方向为真实、可控、专业。

可灵 4.0 把单次时长拉到 30 秒、关键帧给到 10 个、参考素材一次塞 15 个,还能单独改运镜和风格。做 AI 短剧和长叙事的可以盯 9 月 28 日的 Flash 内测,先摸清多关键帧怎么排分镜。

点击打开原文,能否访问取决于网络环境

Google 官方介绍 Gemini 3.8 Flash TTS 语音生成

Google 官方介绍 Gemini 3.8 Flash TTS(该产品 9 月 26 日已发布),主打把语音生成做成完整创作台:支持从零设计原创角色音色、覆盖 100 多种语言、调度双人对话,并可逐行定制每句台词的表演,融入自然的笑声、叹息、耳语等效果。做 AI 短剧对白、有声书、虚拟角色配音的团队,可关注多角色对话调度和逐句表演控制这两项能力。

配音和短剧团队重点看:能从头捏原创角色音色、调度双人对话、逐句调表演,还带笑声叹息耳语,做 AI 短剧对白和有声内容的可以直接接 API 试。

点击打开原平台查看,能否访问取决于网络环境

Anthropic 发布 Sonnet 5.5,更快更省 token

Anthropic 发布中端模型 Sonnet 5.5,官方称其为「明显更便宜、更快的工作伙伴」,响应速度提升、token 消耗降低。这是 TechCrunch 的报道,未给出具体价格、上下文长度或跑分数据。对做剧本批量生成、Agent 工作流和长文本处理的创作者来说,中端模型降价提速直接影响单条内容的推理成本,值得接 API 实测一轮。

Anthropic 中端模型换代,主打响应更快、token 消耗更低,做剧本批量生成和 Agent 工作流的可以接 API 跑一周看成本降多少。

点击打开原文

World Labs 宣布加入 AMD

World Labs 官方账号宣布公司将加入 AMD。官方称自 2024 年成立以来的研发和技术突破,让其对 AI 解决空间与物理世界问题有了清晰愿景,并表示推进空间与物理智能需要扩大投入、扩大覆盖并更贴近硬件。

李飞飞团队的空间智能公司被 AMD 收编,官方说法是要更贴近硬件。做 3D 场景和空间视频的可以留意后续算力侧会不会有变化。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools

Topaz 视频模型三大升级,安卓版正式上线

Topaz Labs 发布更新:Topaz for Web 的三个主要视频模型迎来重大升级,主打更快的视频分辨率提升速度;Adobe Premiere 面板新增 SDR 到 HDR 转换功能;Topaz for Android 正式亮相。官方称完整发布详情见其推文串。

Topaz for Web 三个主力视频模型提速升级,Premiere 面板新增 SDR 转 HDR,安卓版也正式上线。做后期修复和素材升清的这周可以跑一遍看废片率。

点击打开原文,能否访问取决于网络环境

Manus 与 CueAgents 代理可拥有专属电话号码

Manus 宣布其代理与 @CueAgents 现在可以拥有自己的电话号码,支持代理拨打和接听电话、收发短信,用户还能把来电转接给代理。目前仅在部分国家可用,其中一些国家只支持语音,官方称正在推进更多国家上线。

Manus 给 AI 代理配了真实电话号码,能打电话发短信、还能把来电转给代理,做自动化客服或外呼流程的可以接上试一周。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

Qwen3.8-Omni-Flash 技术报告内容转述

@dair_ai 转述 Qwen3.8-Omni-Flash 技术报告(该产品 9 月 27 日已发布),这是一个原生多模态模型,面向跨文本、音频、视频的长时程智能体任务,举例为视频编辑和长音频视频翻译。模型沿用 Qwen3.8-Next 的稀疏 MoE 架构,上下文窗口 100 万 token,通过协同训练策略在保持文本性能的同时把智能体能力迁移到音频和视频任务。目前为报告阶段。

原生吃文本音频视频、100 万 token 上下文,直接点名视频编辑和长音频视频翻译两个场景,做后期和跨语言内容的可以盯一下后续有没有开放调用。

点击打开原文,能否访问取决于网络环境

Seedance 2.5 预览模式实测:比 480p 更好吗

博主 JSFILMZ 对 Dreamina 新上线的 Seedance 2.5 预览模式做了并排提示词测试,对比对象是普通 480p 档位,核心问题是这个更便宜的预览模式画质是否真的更好,测试结果博主称出乎意料,完整对比视频放在评论区。做 AI 短剧和批量出片的团队可以关注这个低成本档位的实际可用度。

Dreamina 新出的 Seedance 2.5 预览模式主打低成本,这位博主做了并排提示词对比测试。跑量出片的短剧团队可以看他的对比结论,判断省钱档位能不能用。

点击打开原平台查看,能否访问取决于网络环境

Grok bot 团队分享 14 个自用智能体

Grok bot 的工程与设计负责人 Lauren Tan 和 Peng Zheng 在播客中展示了工作与生活中使用的 14 个 bot,包括把单个关键帧转成完整用户流程的设计 bot、管理工程 bot 团队的工程负责人 bot。他们给出的上手路径是:先观察 bot 工作并纠正,把有效做法沉淀为 skill,待其一次做对后再设为 routine,逐步把更多工作交给 bot。

Grok bot 工程与设计负责人晒出自己日常在用的 14 个 bot,从单张关键帧扩成完整用户流程到管理工程 bot 团队都有。想给创作流程搭自动化助手的,可以看他们「先观察纠正、再沉淀成 skill、最后设成 routine」这套上手顺序。

点击打开原平台查看,能否访问取决于网络环境

作者用 skill 把 mp3 录音 10 分钟转成讲解视频

作者分享:设计好一个 skill 后,输入一段 mp3 录音,10 分钟即可输出一支 explainer video,走自研路线、不依赖现成动画库,迭代几轮后流程已比较稳定。作者认为 opus 5.5 的能力人人可用,真正拉开差距的是对视频制作流程、视觉风格、技术路线的理解和判断。

一条录音进去、十分钟出来一支讲解视频,作者走自研路线不用现成动画库。做知识类视频和口播转视频的可以看看这套流程怎么搭。

点击打开原平台查看,能否访问取决于网络环境

情绪短片教程:一张底图加参考视频免搭场景

新片场 AIGC 分类的教程视频,针对近期一条情绪短片补出制作方法:只需提供一张底图和一段参考视频,不需要搭建场景。教程形式为视频讲解,时长 3 分 32 秒,属编辑精选内容。做情绪向短片、氛围片的创作者可以按这个思路试跑,重点看单图加参考视频的输入方式在角色和画面一致性上的表现。

只丢一张底图加一段参考视频就能出情绪短片,不用搭场景,做情绪向短片和短剧的可以照着跑一遍看稳定性。

Simon Willison 用 Claude 生成像素动画并录成视频

Simon Willison 在 WeAreDevelopers World Congress North America 闭幕演讲前,把三张鸮鹦鹉照片丢给 Claude Opus 5.5,要求生成 HTML 5 canvas 像素动画——至少 20 只鸮鹦鹉蹦跳开派对、带彩纸效果,并公开了对话记录和成品页面。随后他下载 HTML,让本地 Claude Code 会话用 Playwright 加载页面、在第 3 秒后分散点击触发彩纸,录出 15 秒视频用于嵌入 Keynote。

一条可复用的做法:Claude Opus 5.5 按三张照片生成 20 只鸮鹦鹉的像素动画页面,再用 Claude Code 调 Playwright 自动点击录屏出 15 秒视频。做动态 KV、像素风素材、需要把网页动画转成视频的可以照着跑一遍。

AI生成30秒武侠动作短片 无配乐仅环境战斗音效

创作者 Iqra Saifi 分享一条武侠动作短片提示词:30 秒、16:9、24fps、AAA 电影级写实,主角为红金丝绸长袍、玉簪束发的女剑客,反派是两名分持三节棍与铁环匕首的暗影武僧,要求全程连续动作、无停顿无对视、跳跃翻转直接接剑招,环境为云雾山寺庭院、陶瓦屋顶、香炉与飘落樱花,并明确禁用字幕、UI、Logo、文字、旁白与背景音乐,只保留山风、衣袂、踏瓦、碎石、剑鸣、破空与呼吸等环境与打斗音效。

一条可直接抄的武侠动作短片提示词,把镜头、角色、兵器、环境音都写死了,做 AI 武侠/短剧打戏的可以拿去改参数跑一遍。

点击打开原平台查看,能否访问取决于网络环境

@umesh_ai 分享城市折纸变形视频 prompt

Umesh 分享了一条 15 秒一镜到底的写实超现实城市变形 prompt,按 0-5 秒、5-9 秒、9-12 秒、12-15 秒四段拆解镜头:航拍穿过普通摩天楼、建筑沿隐形接缝像折纸般折叠、整条街道向上弯折让汽车垂直行驶、最后拉远露出整座城市折成一只悬浮云端的巨大纸鹤,并附音效提示(车流渐变为折纸声、结构吱嘎与风声)。

一条可直接抄的 15 秒一镜到底 prompt:城市沿隐形接缝折成纸鹤,连音效节奏都写进了分镜。做视觉开发和 AI 短片分镜的可以存下来改参数试跑。

点击打开原平台查看,能否访问取决于网络环境

傅盛让 GPT-6 接管微信,连跑几千步零失误

傅盛发帖称中秋期间让 GPT-6 接管自己的微信,连续运行数小时,为 50 位公司骨干各写一段专属祝福,并逐条回复收到的 70 多条祝福,共处理 120 多条消息零失误。他对比称半年前 AI 操作电脑两三步就会停下或点错,这次跑了几千步。

AI 操作电脑从两三步就卡,到这次连跑几千步、120 多条消息零失误,做自动化流程和批量运营的可以看看这个长任务稳定性的实测样本。

点击打开原平台查看,能否访问取决于网络环境

用 three.js 把《湖心亭看雪》做成网页动画

作者因儿子背诵张岱《湖心亭看雪》起意,用 three.js 做了一版网页动画:先从油管下载张清声的真人朗诵并定位时间戳,再在 Poe 上调用 Opus 5.5 生成分镜头剧本,在 GPT-6-Astra 辅助下完成网页制作,出于个人喜好未加中国风背景音乐,认为古文本身的节奏音律已足够。

个人创作者把古文朗诵、分镜剧本和 three.js 网页动画串成一条流程,做文学改编短片或交互影像的可以看看这套做法。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

创作者用 Kling 4.0 做 1970 年代银行劫案场景

创作者 Alex Patrascu(@maxescu)发布一段 1970 年代银行劫案逃脱场景的 AI 影像,称整段用 Kling 4.0 构建,并注明该模型「即将推出」。成片主打电影级质感,题材为年代犯罪动作场面。

1970 年代劫案逃脱场景的 AI 成片,Kling 4.0 还没上线就先拿来试了,做年代戏和动作场面的可以拉片看它的镜头调度和质感。

点击打开原平台查看,能否访问取决于网络环境

AI科幻末日短片《尸解仙2050》EP01上线

B 站「AI 全民制作人」系列作品《尸解仙2050》EP01,中式科幻末日题材 AI 短剧,标题自述为多线超展开、要素密集的爆肝制作。具体工具链、时长与制作细节未在标题中体现。

中式科幻末日题材的 AI 短剧第一集,标题主打多线叙事和要素堆叠,做 AI 短剧的可以拉片看它怎么处理多线切换和末日视觉。

点击打开原平台查看

《永恒乐土》更新第2集

B 站 UP 主「AI全民制作人」的 AI 系列短片《永恒乐土》第 2 集,本集安排了打斗段落用于推进剧情,作者称下一集将正式推进主线。作者同时提到积分已耗尽,需等到下个月 11 号刷新,若本集数据表现好会自费加更一集。

个人创作者用积分制工具连载的 AI 系列短片,第 2 集含打斗段落。做 AI 短剧连载的可以看看单集节奏和剧情推进怎么处理,也能感受下积分额度对更新频率的实际约束。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索