← 全部专题
每周精选 · WEEKLY PICKS
7 期日报 · 16 条

AIGC 创作每周精选

7 月 27 日 — 8 月 2 日

从本周日报中按创作价值与信息完整度筛选,保留可直接试用、复现或拆解的内容。

本周怎么选:从 7 期日报中筛选 16 条;每个板块最多 4 条,并尽量分散到不同日期。专题页只做二次整理,原始来源与当天日报均保留。

行业与平台

Industry · 4 条

美国年轻人最常用的社交平台之一的 @Snapchat ,正式…

Snapchat 宣布完全由 AI 生成的视频将无法进入 Spotlight 推荐流,不是贴标签或降权,而是直接取消推荐资格。理由为低质量重复 AI 内容泛滥,流量留给真人创作。使用 AI 剪辑、增强和辅助创作的视频仍可获推荐,但需明确标注。

为什么值得看:Snapchat 把完全 AI 生成的视频直接挡在 Spotlight 推荐池外,AI 辅助创作仍可推荐但需标注。做 AI 短剧和批量内容分发的团队,得重新掂量纯自动生成路线的流量风险。

点击打开原文,能否访问取决于网络环境

Building abundant intelligence

OpenAI 官方博客发布《Building abundant intelligence》,阐述其全栈方法:从芯片、数据中心到模型与产品,目标是让高级 AI 更强大、更便宜、更广泛可用。文章为战略方向性概述。

为什么值得看:OpenAI 官方发了一篇全栈路线图,讲怎么把高级 AI 做得更便宜更好用。做 AI 短剧和批量生产的可以扫一眼成本趋势,但没具体参数,信息密度一般。

点击打开原文

NVIDIA Cosmos3 蒸馏版登顶开源文生图/视频榜首

NVIDIA 发布 Cosmos3-Super-4Step 蒸馏模型,将文生图推理步数从 50 步降至 4 步,图生视频从 35 步降至 4 步,并去除了无分类器引导(CFG),登顶开源文生图/视频榜首。

为什么值得看:NVIDIA 把文生图推理步数从 50 步压到 4 步,图生视频从 35 步压到 4 步,还去掉了无分类器引导。做视觉和短剧的可以接 API 测一下出片速度和废片率,省时间就是省钱。

点击打开原平台查看,能否访问取决于网络环境

The rumors are true

Pika 官方 X 账号宣布,Seedance 2.5 即将登陆 Pika 平台。Seedance 2.5 是即梦(Dreamina)的视频生成模型迭代版本,此次集成意味着 Pika 用户将能在其界面内直接调用该模型进行视频生成。具体上线时间和功能细节尚未公布。

为什么值得看:Pika 官宣即将接入 Seedance 2.5,做 AI 视频的可以蹲一波,看即梦模型在 Pika 上的出片质感有没有新花样。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools · 4 条

SmolForge 新增皮肤与精灵表动画

swyx 宣布 SmolForge 新增 4 个功能,支持自定义皮肤和精灵表动画,面向游戏素材生成场景。

为什么值得看:SmolForge 加了自定义皮肤和精灵表动画,做像素风 AI 游戏素材的可以顺手看一眼,对影视创作工作流影响不大。

点击打开原文,能否访问取决于网络环境

Grok Imagine模板大更新,新增多项创意工具

xAI 的 Grok Imagine 模板迎来重大更新,内置现成预设和大量新创意工具,包括照片编辑、风格重绘、智能调整尺寸、背景移除、头像制作、表情符号生成器、周边产品制作器等。

为什么值得看:Grok Imagine 模板更新,新增照片编辑、风格重绘、背景移除、头像制作、表情符号生成器、周边产品制作器等一批创意工具,做视觉和 IP 周边的可以上手试一轮。

点击打开原文,能否访问取决于网络环境

Gemini 新增免费视频生成功能

Google 旗下 Gemini App 宣布限时免费提供 10 个 Omni 视频生成额度,截止太平洋时间 2026 年 8 月 4 日 23:59。用户可在工具菜单中选择「创建视频」进行生成、编辑和混剪。该活动面向所有用户,无需付费即可体验 Gemini Omni 的视频生成能力。

为什么值得看:Gemini 免费送 10 个 Omni 视频生成额度,截止 8 月 4 日。做短剧和视觉的可以趁免费期实测 Omni 的生成质量和风格一致性,零成本试错。

点击打开原平台查看,能否访问取决于网络环境

Video Podcast is live

HeyGen 上线 Video Podcast 功能,支持将文档、链接或创意自动生成为双人播客视频,包含演播室场景、多机位切换和 B-roll 素材,几分钟内即可出片,可直接发布。

为什么值得看:HeyGen 把播客做成带多机位和 B-roll 的成品视频,做短剧和后期剪辑的可以当自动化模板用,省掉传统剪辑环节。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods · 4 条

ID-V2V:保留身份的视频重风格化

AK 在 X 上分享了一篇新论文《ID-V2V》,研究在视频重风格化过程中保留人物身份特征(ID)的技术方法。论文链接已公开,属于视觉生成领域的前沿研究,尚未有现成工具或工作流落地。

为什么值得看:一篇关于视频重风格化时保留角色身份的研究论文,做 AI 视觉和角色 IP 的可以看看技术路线,但离直接可用还有距离。

点击打开原平台查看,能否访问取决于网络环境

Flux 3 夜间森林哥特教堂演示

X 用户 fofr 发布 Flux 3 的演示片段,场景为夜间穿越森林的业余录制视角,头灯发出刺眼白光,在森林中发现一座巨大的废弃哥特式教堂,无窗户,已被自然重新占据。

为什么值得看:Flux 3 的夜间森林哥特教堂场景演示,镜头语言和氛围感是看点,视觉师可以拉片看光影和场景一致性处理。

点击打开原平台查看,能否访问取决于网络环境

可灵 AI 助力戛纳获奖短片探索情感真实

可灵 AI 官方发布戛纳狮子奖获奖短片《L'Ultimo Uomo Reale》幕后案例。短片由 Lipstick 制作、导演 Sebastian Strasser 执导,使用可灵 AI 保持角色一致性与电影级画面细节,探索「何为真实」的命题。导演将 AI 称为「被引导的技术」,强调 AI 在可信角色表演和逼真视觉效果上的突破。

为什么值得看:可灵 AI 官方发布的戛纳狮子奖获奖短片幕后,导演把 AI 定位为「被引导的技术」。做 AI 短剧和视觉的可以拉片看角色一致性和电影级画面细节怎么在 AI 管线里落地。

点击打开原平台查看,能否访问取决于网络环境

Flux 3 生成复杂提示视频效果惊人

Ethan Mollick 用 Flux 3 生成了一段 19 秒视频,提示词包含宇航员、摄政舞会、罗斯科壁画、骑士与忍者打斗等复杂元素,模型实现了多场景切换与细节连贯。该测试展示了 Flux 3 在复杂视频生成任务上的能力。

为什么值得看:Flux 3 对复杂长提示的跟随能力,做 AI 短剧和视觉开发的可以直接拿这个 prompt 去测,看多场景切换和细节连贯性稳不稳。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works · 4 条

Opus 5 单提示词生成 6.9 亿 token 游戏

X 用户 @kimmonismus 展示用 Opus 5 单条提示词生成 6.9 亿 token 的游戏内容,成本 423 美元,耗时几小时。评论区指出这并非完整游戏,而是游戏片段。展示了单提示词生成超长内容的可能性,对 AI 叙事和互动内容创作有参考价值。

为什么值得看:一个人几小时用 Opus 5 单提示词生成 6.9 亿 token 的游戏片段,成本 423 美元。做 AI 短剧和互动叙事的可以看看这个 demo,验证了单提示词长内容生成的边界。

点击打开原平台查看,能否访问取决于网络环境

The soundtrack in this anime t…

fal 官方展示 MiniMax H3 能力:一段 prompt 同时生成动漫片头的配乐、动画、剪辑和清晰字幕,配乐由提示词逐秒指定(3 秒低音、6 秒爵士贝斯、10 秒萨克斯、紧张和弦定格),5 张静帧生成 15 秒成片,单次生成完成,已上线 fal 平台。

为什么值得看:MiniMax H3 用一段 prompt 同时生成配乐、动画、剪辑和字幕,5 张静帧直接出 15 秒片头,做片头和 MV 的可以拉片看提示词怎么同时驱动音乐和画面。

点击打开原平台查看,能否访问取决于网络环境

Flux 3 发布:金属乐队现场手机翻录

fofr 用 Flux 3 生成了一段金属乐队现场手机翻录视频,模拟小场地演出返场时的盗录质感,包含手抖、人群模糊等真实手机拍摄特征。评论区多位用户表示伪劣画质处理比单纯加噪点更自然,难以一眼分辨是否为 AI 生成。

为什么值得看:Flux 3 的伪手机翻录质感很到位,手抖和人群模糊不是简单加噪点,做视觉和后期的一眼就能看出区别。

点击打开原平台查看,能否访问取决于网络环境

当绝世美人,被喂下一颗神秘药丸……

B站UP主「月落乌啼丶丶」的AI古装短剧系列新一集,含AI生成内容,古装美人题材,趣味情景剧情向,系列共57集已更新至第54集。

为什么值得看:B站个人创作者的AI古装短剧系列新一集,做AI短剧的可以拉片看角色一致性和古装题材的视觉处理,但信息量有限,当个风格参考就行。

点击打开原平台查看