← 全部日报

AIGC 信息日报

2026 年 8 月 2 日 周日

行业与平台

Industry

美国年轻人最常用的社交平台之一的 @Snapchat ,正式对AI垃圾内容动手了…

Snapchat 宣布完全由 AI 生成的视频将无法进入 Spotlight 推荐流,不是贴标签或降权,而是直接取消推荐资格。理由为低质量重复 AI 内容泛滥,流量留给真人创作。使用 AI 剪辑、增强和辅助创作的视频仍可获推荐,但需明确标注。

Snapchat 把完全 AI 生成的视频直接挡在 Spotlight 推荐池外,AI 辅助创作仍可推荐但需标注。做 AI 短剧和批量内容分发的团队,得重新掂量纯自动生成路线的流量风险。

点击打开原文,能否访问取决于网络环境

DeepSeek V4 Flash 0731 上线硅基流动,性能比肩 GPT-5.6 Luna

DeepSeek V4 Flash 0731 已在硅基流动上线,激活参数更少,性能几乎与 GPT-5.6 Luna 持平,价格远低于后者。每百万 token 输入 $0.14、输出 $0.28、缓存 $0.028。官方称其编码更强、工具调用与智能体能力更佳。对创作者来说,低成本高性价比的模型适合批量生成和工具链整合,做 AI 短剧或自动化流程的可以接 API 实测。

DeepSeek V4 Flash 0731 上线硅基流动,激活参数更少但性能比肩 GPT-5.6 Luna,输入 $0.14/百万 token,编码和 Agent 能力更强。做 AI 短剧批量生成或工具链整合的,这个性价比值得接 API 跑一周看效果。

点击打开原文,能否访问取决于网络环境

7月31日,WSJ发表了一篇文章,详细分析了OpenAI为何从AI行业的绝对领先者,逐渐变成了追赶Anthropic的一…

WSJ 文章分析 OpenAI 从行业领先者变为追赶 Anthropic 一方。核心观点:OpenAI 误判市场,押注消费级聊天机器人,而真正爆发的是 AI Coding 和企业开发者市场;Anthropic 的 Claude Code 围绕真实软件开发场景训练,体验优于 OpenAI Codex,吸引大量程序员迁移,收入增速反超,估值接近 1 万亿美元并推进 IPO。OpenAI 资源分散于 Sora、硬件、芯片等项目,现由 Greg Brockman 重新负责产品,推出新 Coding 模型并与 Amazon 合作,最新 GPT-5.6 Sol 获开发者好评,但现金消耗快、为抢客户打折,IPO 或推迟至明年。

WSJ 复盘 OpenAI 为何被 Anthropic 反超:押错消费级聊天机器人、资源分散到 Sora/硬件/芯片,而 Claude Code 靠贴合真实开发场景抢走大量程序员。做 AI 工具链整合的可以看看这场格局逆转背后的产品逻辑。

点击打开原文,能否访问取决于网络环境

工具与能力

Tools

想象 Video 1.5 上个月推出,作为我们迄今为止最好的视频模型,具有更逼真的动作和声音

Grok 官方宣布 Imagine Video 1.5 升级,新增文本到视频、图像和语音参考功能,支持原生 1080p 输出,动作和声音更逼真。现已面向 SuperGrok Plus 和 Heavy 订阅用户开放,未来几天内全量推送,可通过网页、Grok 应用及 Imagine API 使用。

Grok 的 Imagine Video 1.5 升级,支持文本到视频、图像和语音参考,原生 1080p,动作和声音更逼真。做视频和短剧的可以接 Imagine API 试一周,看角色一致性和出片质感稳不稳。

点击打开原平台查看,能否访问取决于网络环境

Your design, your model

Replit 官方宣布其设计套件支持在 Claude、GPT-5、Gemini、Kimi、GLM 等主流模型间自由切换,用户可对比不同模型家族的输出效果并保留最佳结果。该更新面向编程与设计场景,属于产品功能层面的模型接入扩展。

Replit 把 Claude、GPT-5、Gemini、Kimi、GLM 全塞进一个设计套件,做 AI 编程和工具链整合的可以点开看看,但这是 IDE 产品运营更新,对创作工作流影响不大。

点击打开原文,能否访问取决于网络环境

SmolForge 新增皮肤与精灵表动画

swyx 宣布 SmolForge 新增 4 个功能,支持自定义皮肤和精灵表动画,面向游戏素材生成场景。

SmolForge 加了自定义皮肤和精灵表动画,做像素风 AI 游戏素材的可以顺手看一眼,对影视创作工作流影响不大。

点击打开原文,能否访问取决于网络环境

方法与经验

Methods

animated-voiceover 开源:一人干翻动画工作室

前字节产品经理 @s1dashu 开源 animated-voiceover,一套喂给 Codex/Claude Code 的完整动画科普视频制片流程,MIT 协议,可实现 90% 自动化。流程含:先研究写旁白、锁视觉风格和角色参考图、每 15 秒拆 5 个镜头、首段人声提取为 48kHz 立体声 WAV 作为后续所有片段的声音参考、逐段 QC(旁白完整性/角色一致性/构图/运动)、最后拼片做封面。中文旁白卡到每 15 秒 60 字。一条 2 分钟片子成本约 40 元,作者称一个人一个下午可从选题到成片。

前字节产品经理开源的一套喂给 Codex/Claude Code 的动画科普视频制片流程,MIT 协议,90% 自动化。做知识类短剧和批量出片的团队可以直接拿去跑一遍,看它怎么用工程手段锁死声音一致性和角色不崩。

点击打开原平台查看,能否访问取决于网络环境

A Guide to Producing Engaging AI-Animated Explainer Videos…

Kling AI 官方博客发布一篇制作 AI 动画讲解视频的指南,涵盖从选题、分镜到动画生成的完整流程,重点讲如何让画面吸引人并保持信息清晰。具体技巧和参数细节需查看原文。

Kling AI 自己出的官方指南,做 AI 动画讲解视频的直接看,省得自己试错工作流。

Seedance 2.5 发布了,我感觉写视频提示词的习惯都要变一变了…

Seedance 2.5 发布,提示词写法从描述画面转向讲故事。核心能力:30秒长视频、30张图同时参考、时间戳精准分段。作者整理了一份提示词大全,覆盖长叙事、多图参考、时间戳编辑、多轮延长、白模参考五个场景,每个场景有可直接复用的框架,并扒了官方 demo 的提示词供对照复现。作者特别强调白模参考能力被低估:用3D白模锁定构图和机位,风格图管材质和光照,分工清晰,视频可控性大幅提升。作者计划将这套提示词逻辑打包成 Seedance 2.5 专属 Skill 开源。

Seedance 2.5 提示词写法从描述画面转向讲故事,30秒长视频、30图参考、时间戳分段三个能力叠加。作者拆了一整天整理成提示词大全,覆盖长叙事、多图参考、时间戳编辑、多轮延长、白模参考五个场景,还扒了官方 demo 的提示词,做 AI 视频的可以直接对照复现。

点击打开原平台查看,能否访问取决于网络环境

动画配音视频 Skill 更新: https:// github…

开发者 sida 更新了动画配音视频 Skill(github.com/s1dashu/animated-voiceover),配合 Codex 使用一小时可产出数条高质量动画视频,已在小红书和视频号稳定起号。本次新增 7 套内置视觉风格(电影感 3D、多巴胺萌趣 3D、黏土定格、笨拙感手绘简笔画、忧郁蓝调简笔画、柔和彩铅萌趣、清爽线描蜡笔)和 4 款内置音色(明亮高亢青年音、沉静青年男声、温柔治愈成年女声、灵动活泼年轻女声),可直接选择风格与音色建立统一画面和声音,也可让 Agent 按需生成新风格和音色。

个人开发者把动画配音做成 Codex Skill,内置 7 套视觉风格和 4 款音色,配合 Codex 一小时能出数条成片,做短剧和批量起号的可以直接套用这套工作流。

点击打开原平台查看,能否访问取决于网络环境

Magnific 发布 38 页图像视频提示词手册

Magnific 发布 38 页图像视频提示词手册,核心观点是传统堆砌关键词的提示方式已失效,AI 已进入推理与导演对话时代。手册主张用明确的专业视觉语言(如镜头、光线、构图术语)指挥 AI,抛弃无用关键词。手册免费下载。

Magnific 官方出的 38 页提示词手册,核心是教你怎么用导演思维和视觉语言跟 AI 对话,而不是堆关键词。做 AI 短片和视觉的可以直接拿来做团队 prompt 规范参考。

点击打开原文,能否访问取决于网络环境

I've heard people say Seedance 2

Higgsfield 创作者 @maxescu 发布演示视频,用单个 prompt 让 32 位 AI 创作者同框打斗,展示 Seedance 2.5 的多角色一致性与动作生成能力,并预告该模型即将上线 Higgsfield 平台。

Seedance 2.5 即将登陆 Higgsfield,作者用 32 位 AI 创作者同框的 brawl 视频演示多角色一致性,做短剧和视觉的可以点开看单 prompt 多角色控制效果。

点击打开原平台查看,能否访问取决于网络环境

🚀DeepSeek V4 Flash全面实测:Claude Code接入后连续开发7个项目,真的已经接近Claude…

B 站 UP 主实测 DeepSeek V4 Flash 0731:284B 总参数、13B 激活参数、100 万 Token 上下文,官方基准接近 Claude Opus 4.8,价格更低。接入 Claude Code 连续开发 7 个项目(飞船复刻、骑马游戏、齿轮动画、手绘灯泡、数学动画、Godot 游戏、iOS 应用),并对比 Kimi K3,暴露性能、速度与真实短板。

DeepSeek V4 Flash 实测,284B 总参、13B 激活、100 万上下文,价格便宜,接入 Claude Code 连做 7 个项目。做 AI 编程和工具链整合的可以看它跟 Opus 4.8 的真实差距,值不值换。

点击打开原平台查看

接着奏乐,接着舞!眼神和克制的表情,跟真人没什么两样。很多AI视频不好看,就是过于追求完美和谐了,人物反而越觉得假…

X 用户 @0x404page 分享一条 10 秒 9:16 竖屏 AI 舞蹈直拍 demo,附完整分镜提示词:年轻亚洲女性模特、极简暖米色摄影棚、强暖色逆光+低强度柔光补脸,强调保留真实皮肤纹理、五官全程一致、动作连续流畅带音乐卡点,并给出 0-2 秒近景冷感开场、2-4 秒双臂展开、4-6 秒手臂 wave 与腰胯卡点等逐段分镜。作者观点:AI 视频过于追求完美和谐反而显假,克制表情和真实纹理更接近真人。

一条带完整分镜提示词的 AI 舞蹈直拍 demo,作者点出「别追求完美和谐,留点真实纹理和克制表情反而更像真人」——做人物镜头的可以照着这套 9:16 竖屏提示词跑一遍,看眼神和动作卡点怎么调。

点击打开原平台查看,能否访问取决于网络环境

ID-V2V:保留身份的视频重风格化

AK 在 X 上分享了一篇新论文《ID-V2V》,研究在视频重风格化过程中保留人物身份特征(ID)的技术方法。论文链接已公开,属于视觉生成领域的前沿研究,尚未有现成工具或工作流落地。

一篇关于视频重风格化时保留角色身份的研究论文,做 AI 视觉和角色 IP 的可以看看技术路线,但离直接可用还有距离。

点击打开原平台查看,能否访问取决于网络环境

With a great prompt comes great responsibility…

Alex Patrascu(@maxescu)分享一条中文提示词,设定 40 岁男性上班族角色(微胖、发际线后移、浅灰衬衫、灰色领带)及剪辑界面场景,并附成片视频。个人创作者提示词分享,重点在角色设定与场景描述的写法。

个人创作者分享一条中文提示词,设定了一个 40 岁上班族角色和剪辑界面场景,做角色一致性和场景控制的可以点开看提示词写法。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

这是《Penumbra》系列的第4集(第1部分)。 在为系列创作剧集时,生成好看的镜头是必须的——这是基本要求…

Invideo 官方发布《Penumbra》系列第4集(第1部分),常驻电影制作人 Vinu 主导。本集做两个实验:一是野生动物镜头按剧情需要编排,像戏剧而非素材库;二是编排一段他认为此前无人尝试过的动作戏。剧情上讲述主角 Isaak 的过往——1971 年 CIA 地中海任务出岔子,十年后他成为职业杀手,本集是这一切的开端。

Invideo 官方系列《Penumbra》第4集,常驻电影制作人 Vinu 用两个实验讲系列叙事:野生动物按剧情需要编排、以及一段他认为没人试过的动作戏。做系列短剧的可以拉片看镜头如何服务故事流动,而不是只堆好看画面。

点击打开原平台查看,能否访问取决于网络环境

The titan looks invincible. But every giant has one place…

@CharaspowerAI 使用 Minimax Hub 的 Seedance 模型生成一段黑暗英雄奇幻风格场景,关键词:Premium dark heroic-fantasy、insane sakuga、hyper-dynamic camera choreography。个人创作者作品,展示了 Seedance 在高动态镜头和风格化视觉上的表现力。

一段 Seedance 生成的黑暗英雄奇幻场景,动态镜头和作画质感拉满,视觉师可以拉片看这种风格的镜头调度和光影处理。做 AI 短剧的当视觉参考不错。

点击打开原平台查看,能否访问取决于网络环境

Opus 5 单提示词生成 6.9 亿 token 游戏

X 用户 @kimmonismus 展示用 Opus 5 单条提示词生成 6.9 亿 token 的游戏内容,成本 423 美元,耗时几小时。评论区指出这并非完整游戏,而是游戏片段。展示了单提示词生成超长内容的可能性,对 AI 叙事和互动内容创作有参考价值。

一个人几小时用 Opus 5 单提示词生成 6.9 亿 token 的游戏片段,成本 423 美元。做 AI 短剧和互动叙事的可以看看这个 demo,验证了单提示词长内容生成的边界。

点击打开原平台查看,能否访问取决于网络环境

He woke up in a psychiatric hospital

@CharaspowerAI 与 Agent One 合作创作的 AI 恐怖短片预告片,剧情设定为精神病院里所有人消失、黑暗中有未知存在。影片采用电影级恐怖片视听风格,侧重心理悬疑与气氛渲染,叙事节奏紧凑。

AI 恐怖短片预告片,心理悬疑气氛到位,适合编导和视觉师拆解叙事节奏和镜头语言。

点击打开原平台查看,能否访问取决于网络环境

这个AI做的很真实。 抖音起号,两个视频增1万粉。 后期走穿搭做达人变现。 52 16 149 1.8万

博主「领哥LingGe」分享用 AI 制作穿搭类视频在抖音起号,两个视频涨粉 1 万,计划后期走穿搭达人变现。评论区有讨论称吸引的多为低质粉丝,目标人群 20-35 岁女性可能不买账。

抖音起号案例,两个视频涨 1 万粉,走穿搭达人变现路线。做 AI 短剧和账号运营的可以看看这个涨粉路径和粉丝画像,评论区还有关于目标人群的讨论。

点击打开原平台查看,能否访问取决于网络环境

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索