← 全部日报

AIGC 信息日报

2026 年 8 月 1 日 周六

行业与平台

Industry

全球发布:Dreamina Seedance 2.5 现已上线!

Dreamina 官方发布 Seedance 2.5,定位最具电影感的视频模型。核心能力:单次生成原生 30 秒视频、长视频模式最长 3 分钟全程保持一致性、全新互动编辑可重塑画面任意部分、精确到 1 秒的时间戳控制。配套 Dreamina AI Maya 和 Blender 插件,支持最多 50 个多模态参考素材(含 3D 白模和绿幕),可将 AI 生成融入真实制作流程。现向订阅用户开放,已上线东南亚、中东、非洲、欧洲和南美,限时每次生成节省高达 32% 积分。

Seedance 2.5 正式上线,单次原生 30 秒、长视频模式最长 3 分钟保持一致性,还带 Maya/Blender 插件和 3D 白模/绿幕参考,做电影级流程和短剧的可以直接上手测长镜头叙事。

点击打开原平台查看,能否访问取决于网络环境

DeepSeek-V4-Flash API公测上线,Agent能力大幅升级

DeepSeek 官方宣布 V4-Flash API 公测上线,Agent 能力大幅升级,基准测试分数远超 V4-Pro-Preview。V4-Flash 原生支持 Responses API 格式,并已完全适配 Codex,官方文档提供配置详情。V4-Flash-0731 与预览版保持相同模型架构和大小,本次升级仅针对 V4-Flash API,V4-Pro API 和 App/Web 模型暂未变动。

DeepSeek-V4-Flash 官方 API 公测上线,Agent 能力大幅升级,基准测试分数远超 V4-Pro-Preview,原生支持 Responses API 并完全适配 Codex。做 AI 短剧批量生产、自动化剪辑/转写链路的,可以接 API 实测 Agent 能力提升幅度。

点击打开原文,能否访问取决于网络环境

MiniMax H3: Toward Open, General-Purpose, Omni-Modal Generation

MiniMax(@Hailuo_AI)发布 H3 模型,定位开放、通用、全模态(Omni-Modal)生成,覆盖视频、图像、音频等多模态生成能力,主打开源与通用性。作为 Hailuo 系列下一代模型,H3 面向创作者提供统一的多模态生成入口,具体参数与开源细节待官方公布。

MiniMax 开源新一代全模态生成模型 H3,主打开放通用,视频、图像、音频生成能力大概率整合进同一模型。做 AI 短剧和视觉的可以蹲一下开源权重,看能不能直接接进现有工作流。

点击打开原文,能否访问取决于网络环境

Building abundant intelligence

OpenAI 官方博客发布《Building abundant intelligence》,阐述其全栈方法:从芯片、数据中心到模型与产品,目标是让高级 AI 更强大、更便宜、更广泛可用。文章为战略方向性概述。

OpenAI 官方发了一篇全栈路线图,讲怎么把高级 AI 做得更便宜更好用。做 AI 短剧和批量生产的可以扫一眼成本趋势,但没具体参数,信息密度一般。

点击打开原文

工具与能力

Tools

Agent Two can now actually und…

Agent Two 更新:支持上传视频、图片、脚本、PDF、YouTube 链接、Drive 文件或粗剪,并在项目完整上下文中分析,而非作为孤立文件处理。处理速度提升 4 倍,价格减半。适用于后期审片、素材整理、脚本分析等创作流程环节。

Agent Two 现在能直接吃视频、图片、脚本、PDF、YouTube 链接和粗剪,在项目上下文里分析而不是当孤立文件,速度 4 倍、价格减半。做后期和制片流程的可以接进工作流试一周,看它能不能真帮你审片和整理素材。

点击打开原文,能否访问取决于网络环境

RT @GeminiApp: Gemini Spark is…

Google 宣布 Gemini Spark 个人 AI 代理开始向美国以外地区的 Google AI Pro 用户开放。Spark 是后台常驻型个人代理,可自主处理任务。对创作者来说,这类后台代理若接入媒体生成或素材整理链路,可减少重复性操作,具体能力边界需实测。

Google 把 Gemini Spark 个人 AI 代理扩展到美国以外地区的 AI Pro 用户,后台常驻型代理,做自动化工作流的可以关注它跟创作管线的结合点。

DeepSeek V4 Flash 上线 OpenCode …

OpenCode 官方宣布 DeepSeek V4 Flash 已上线其 Go 版和免费层,初步反馈显示相比 Preview 版本有大幅改进。对 AIGC 创作者来说,这意味着在 OpenCode 命令行工具中可免费调用一个更强的推理模型,适合用于自动化脚本编写、批量媒体处理等创作流水线环节。

DeepSeek V4 Flash 进了 OpenCode 免费层,做 AI 短剧和批量内容生产的可以直接在命令行里白嫖一个强推理模型,跑脚本、写自动化链路都够用,技术整合者可以接进工作流试一周。

Cover art just got a glow-up

Suno 官方宣布封面图功能升级,支持用自然语言为歌曲和歌单生成封面图像,并展示了用 Suno 编辑的《ORBITING YOU》封面示例。

Suno 给封面图加了语言生成能力,用你自己的语言就能给歌曲和歌单配图,做音乐视觉和专辑封面的可以上手试试。

点击打开原平台查看,能否访问取决于网络环境

Grok Imagine模板大更新,新增多项创意工具

xAI 的 Grok Imagine 模板迎来重大更新,内置现成预设和大量新创意工具,包括照片编辑、风格重绘、智能调整尺寸、背景移除、头像制作、表情符号生成器、周边产品制作器等。

Grok Imagine 模板更新,新增照片编辑、风格重绘、背景移除、头像制作、表情符号生成器、周边产品制作器等一批创意工具,做视觉和 IP 周边的可以上手试一轮。

点击打开原文,能否访问取决于网络环境

方法与经验

Methods

Beyond Realism: How Kling Powe…

Kling 官方博客复盘戛纳狮子奖获奖广告《L'Ultimo Uomo Reale》的制作幕后。该片由 Lipstick 为奢侈品转售平台 The RealReal 打造,全片 AI 生成,唯一真实物体是 The RealReal 手袋。导演 Sebastian Strasser 提出「真实感不等于表演」的核心观点,强调 AI 视频需要可信的表演、稳定的角色和贯穿全片的电影级一致性,而非仅追求写实画面。

Kling 官方复盘戛纳获奖广告《L'Ultimo Uomo Reale》的制作幕后,导演 Sebastian Strasser 讲透了「真实感 vs 表演」的差别——AI 视频不缺写实脸,缺的是让角色活起来的表演。做 AI 广告和短剧的编导值得拉片看角色稳定性和镜头一致性怎么落地。

点击打开原文

How to Create an AI-Generated …

Kling AI 博客于 2026 年 7 月 28 日发布一篇零预算 AI 音乐视频制作教程,内容涵盖从歌曲到 AI 生成画面的完整流程,适合独立音乐人和低成本创作者参考应用。

Kling AI 官方博客发布零预算 AI 音乐视频制作教程,独立音乐人、低成本摄制团队可以直接照着流程跑一遍,省掉外聘团队的成本和沟通周期。

点击打开原文

Seedance 2.5 on @dreamina_ai P…

Seedance 2.5 在即梦(@dreamina_ai)上线,用户分享了一条完整 prompt 示例:手持 mini DV 摄像机质感、轻微手抖与对焦漂移、自然曝光变化,风格定位为咖啡制作 vlog 并带 ASMR 元素,包含分镜脚本(研磨、压粉、萃取等 3 秒镜头)与音效设计(磨豆机、蒸汽棒、杯碰声)。

Seedance 2.5 在即梦上线,这条把完整 prompt 摊开了:手持 DV 质感、咖啡 vlog 分镜、ASMR 音效设计全给到,做生活流短片的可以直接抄这套 prompt 跑一遍看质感。

点击打开原平台查看,能否访问取决于网络环境

开发者用 VoxCPM2 打造 AI 短片角色配音

社区开发者 @xiaofenggan 用面壁智能开源模型 VoxCPM2 为 AI 短片生成角色配音,解决跨场景声音一致性问题。工作流结合 Gemini 优化脚本与提示词、ChatGPT Image 2 生成视觉素材、Happyhorse 生成视频,实现角色音色与情绪风格稳定,减少配音返工。VoxCPM2 已开源。

社区开发者用开源 VoxCPM2 给 AI 短片做角色配音,重点解决跨场景音色漂移问题,做短剧和后期配音的可以拆这套工作流试试,能省不少返工。

点击打开原文,能否访问取决于网络环境

Depth Map Control + Canvas

PixVerse 官方演示 Depth Map Control 与 Canvas 的组合工作流:先用深度图控制重建参考图的空间结构,建立一致的基线,再将关键帧导入 PixVerse Canvas,通过分层前景增强画面的深度与尺度感。

PixVerse 官方演示 Depth Map Control 配合 Canvas 的工作流:先用深度图重建参考图的空间结构打底,再把关键帧丢进 Canvas 做分层前景,出片层次感和景深更稳。做视觉和整合的可以照着跑一遍看效果。

点击打开原平台查看,能否访问取决于网络环境

昨天在 Codex 里,把公众号从选题、核实、写稿、配图,到…

作者在 Codex 里把公众号从选题、核实、写稿、配图到推送草稿箱做成一条 Skill,Codex 额度用完后直接在 Grok 里执行同一 Skill。实测流程:Grok 先读 Skill 文件,按主编流水线走,加载账号上下文(读者画像、历史内容、插图发布规则),主动搜热点输出候选选题(事件、读者在乎点、角度、打分、风险),按可执行度排序后停在确认门由用户拍板。结论是 Skill 是工作流文档而非绑定某家模型,额度不够可换引擎继续跑。

把公众号全流程做成 Skill,Codex 没额度直接换 Grok 跑,验证了 Skill 是跨模型的工作流文档。做内容自动化管线的可以照这个思路,把选题到发布的流程沉淀成可迁移的 Skill。

点击打开原平台查看,能否访问取决于网络环境

太长不看 我给 ChatGPT Work(从移动应用)提供了…

用户 Nick 用 ChatGPT Work(移动端)提供 Jason Liu 讲话的 30 秒样本和其文章链接,ChatGPT 在云端 VM 中微调语音模型,将 12 篇文章转成 12 段以其本人声音朗读的音频轨。流程:从网站抓取文章、微调语音、批量生成播客剧集。

用 30 秒人声样本 + 文章链接,ChatGPT Work 就能调出语音模型把文章念成播客。做 AI 配音、有声内容、播客自动化的后期和内容团队可以直接照这个流程跑一遍。

点击打开原文,能否访问取决于网络环境

Flux 3 夜间森林哥特教堂演示

X 用户 fofr 发布 Flux 3 的演示片段,场景为夜间穿越森林的业余录制视角,头灯发出刺眼白光,在森林中发现一座巨大的废弃哥特式教堂,无窗户,已被自然重新占据。

Flux 3 的夜间森林哥特教堂场景演示,镜头语言和氛围感是看点,视觉师可以拉片看光影和场景一致性处理。

点击打开原平台查看,能否访问取决于网络环境

PROMPT: Yeah, it's in Chinese …

Alex Patrascu(@maxescu)发布一段 AI 短片,并公开完整提示词。核心设定:唯一出场角色是 40 岁上下微胖、发际线后移的男性上班族,冷面,午餐是三明治和咖啡;全片唯一的超现实元素是观众才能看到的剪辑界面三件套——带柔和投影的白色箭头光标、青色虚线圆角选择框、深色圆角提示词气泡(白色英文指令逐字打出后淡出,同一时刻最多一个气泡)。提示词因 5000 字符限制用中文书写。

作者晒了一段用超长中文提示词做的 AI 短片,把剪辑界面(光标、选择框、提示词气泡)做成全片唯一的超现实元素,这个设定思路值得编导和视觉师拉片参考。

我这篇WorkBuddy教程在公众号跑出8万多浏览,还在狂涨…

智见AI-大鹏分享个人经验:其 WorkBuddy 保姆级教程在公众号获得 8 万多浏览,带来 3 万+ 间接收入(含 WorkBuddy 培训和课程定制合作)。作者观点是国内市场要接地气,Codex、Claude Code 研究得飞起但国内落地难,并强调高质量、能体现专业性、构建信任的文章才能带来订单。

个人经验分享:一篇 WorkBuddy 教程在公众号跑出 8 万浏览,带来 3 万+ 间接收入(培训+课程定制)。核心观点是国内市场要接地气,Codex、Claude Code 研究得再深也难落地。做 AI 内容变现的可以看看这个思路,但对创作工作流本身参考价值有限。

点击打开原文,能否访问取决于网络环境

作品与案例

Works

The soundtrack in this anime t…

fal 官方展示 MiniMax H3 能力:一段 prompt 同时生成动漫片头的配乐、动画、剪辑和清晰字幕,配乐由提示词逐秒指定(3 秒低音、6 秒爵士贝斯、10 秒萨克斯、紧张和弦定格),5 张静帧生成 15 秒成片,单次生成完成,已上线 fal 平台。

MiniMax H3 用一段 prompt 同时生成配乐、动画、剪辑和字幕,5 张静帧直接出 15 秒片头,做片头和 MV 的可以拉片看提示词怎么同时驱动音乐和画面。

点击打开原平台查看,能否访问取决于网络环境

曼哈顿的一个雨天 Dreamina Seedance 2.5…

Dreamina Seedance 2.5 已在 Dreamina AI 上线,官方合作创作者 James Yeung 发布 33 秒样片《曼哈顿的一个雨天》,展示新版本在细节锐度、电影级物理模拟和视频生成流畅度上的提升,定位为电影级、专业级、高审美视觉输出。

Dreamina Seedance 2.5 上线,这条是官方合作创作者的实拍样片,33 秒雨天曼哈顿街景,主打细节锐度和电影级物理质感。做短剧和视觉的可以点开看新版本出片质感,再决定要不要升级工作流。

点击打开原平台查看,能否访问取决于网络环境

这个成吉思汗预告片只用了 seedance 2.5 上的 2…

创作者 el.cine 用 Seedance 2.5 仅凭 2 个提示词生成成吉思汗题材预告片,画面真实感强。Higgsfield 官方同步宣布 Seedance 2.5 上线,提供 14 天无限访问:前 7 天为 4K 版 Seedance 2.0,后 7 天可切换任意 Seedance 模型。

成吉思汗预告片只用 2 个提示词在 Seedance 2.5 上跑出来,画面真实感拉满。做短剧和视觉的可以拉片看单提示词能压出多少镜头,顺便关注 Higgsfield 的 7 天无限访问窗口。

点击打开原平台查看,能否访问取决于网络环境

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索