← 全部专题
每周精选 · WEEKLY PICKS
7 期日报 · 16 条

AIGC 创作每周精选

9 月 28 日 — 10 月 4 日

从本周日报中按创作价值与信息完整度筛选,保留可直接试用、复现或拆解的内容。

本周看点:从 7 期日报中筛选 16 条;每个板块最多 4 条,并尽量分散到不同日期。专题页只做二次整理,原始来源与当天日报均保留。

行业与平台

Industry · 4 条

谷歌 10 月 9 日起调整 Gemini 各档模型权限

谷歌将从 10 月 9 日起调整 Gemini 模型访问权限:免费版仅限 Flash-Lite,AI Plus 档失去 Pro 模型访问、只能用 Flash,AI Pro 与 Ultra 档保留 Pro 模型访问权限。该消息来自 @GeminiUpda0kkb 的转述,非谷歌官方账号发布。对依赖 Gemini 免费或低价档做批量生成、脚本调用的创作者和团队,需要提前核算升级到 Pro/Ultra 的成本,或把工作流迁到 Flash 档能覆盖的环节。

为什么值得看:免费版只剩 Flash-Lite,AI Plus 掉到 Flash,Pro 模型要 AI Pro/Ultra 才留得住。靠 Gemini 免费额度跑脚本、做批量生成的团队,趁现在算一下升级成本。

AI 长片《6分钟》入围伦敦 AI 电影奖

创作者 @misslaidlaw 宣布其 AI 剧情长片《6 Minutes》入围 2026 年伦敦 AI 电影奖(AI Movie Awards London 2026),最终入围名单将于 10 月 17 日公布。据其自述,该片从创意到成片经历了数周的写作、实验、生成、剪辑和问题排查。评审团由《哈利·波特》《黑客帝国》《碟中谍》《星球大战》《壮志凌云》等影片的制片人和主创组成。

为什么值得看:个人创作者用数周时间从剧本到剪辑做完一部 AI 剧情长片,入围伦敦 AI 电影奖,评审团里有《哈利·波特》《黑客帝国》的制片和主创。做 AI 长片的可以关注 10 月 17 日入围名单,看同行都在什么水平线上。

Microsoft AI 推出三款语音模型

微软 AI 发布三款新模型:MAI-Transcribe-2-Streaming 主打准确的流式转录,MAI-Voice-2.1 与 MAI-Voice-2.1-Flash 主打自然语音表达和更短的对话轮次等待时间,官方定位是构建持续对话的语音代理。做配音、虚拟角色对话、实时字幕和语音交互类内容的团队可关注其流式转录与低延迟表现。

为什么值得看:微软一口气放出流式转录加两档语音模型,主打对话轮次等待更短,做 AI 配音、虚拟角色对话和实时字幕的可以接 API 测一轮延迟。

OpenAI 升级 GPT-6.1 Sol 代理式编码

OpenAI 开发者账号宣布 GPT-6.1 Sol 更新(该产品 9 月 23 日已发布),升级了代理式编码和计算机使用能力,性能接近 Astra,缓存输入按标准输入定价的 95% 折扣计费,官方定位是复杂重构、深度代码库调查和跨应用长期运行的 Agent 场景。对做自动化创作流程的团队来说,这类长时运行的 Agent 能力可用于批量素材处理、跨工具调度等环节,但本条未涉及图像/视频/音频生成能力。

为什么值得看:OpenAI 的 GPT-6.1 Sol 更新(该产品 9 月 23 日已发布),主打代理式编码和计算机操作,缓存输入按标准价 95% 折扣计费,做自动化工作流和 Agent 的可以接 API 测一轮。

工具与能力

Tools · 4 条

Vidu S2 更新实时编辑 风格服装主体背景即时切换

Vidu 官方介绍 Vidu S2 的 S2-Editing 功能(该产品 9 月 16 日已发布),支持实时切换风格、服装、主体和背景,编辑即时生效。使用方式有两种:在 Vidu 网站左侧边栏选择「Vidu S」,或下载最新 Vidu AI Pro 应用后点击「Vidu S」进入。官方提供邀请码 VIDUS2C 免费试用,官方标签含 #realtimeediting #travel。

为什么值得看:实时改风格、换服装、换主体和背景,改完立刻看到效果,做短剧和广告变体的可以拿邀请码 VIDUS2C 试一周,看能不能省掉反复重跑的时间。该产品的发布我们已在 2026-09-16 报过,这条是官方对已有能力的介绍,不是新上线。

@Pinsky 称移除工具升级可擦除阴影反射

Howard Pinsky(@Pinsky)发推称移除工具(Remove Tool)再次升级,现在可以擦除关联元素,比如阴影、反射等,并配了演示。原文未说明具体产品版本、上线平台或操作方式。对做视觉和后期的人来说,如果这条指的是 Photoshop 的移除工具,那么处理人物抠图、去杂物、清理背景时能少一步手动补阴影/倒影的活,值得在自己常用的版本里实测一遍确认是否已生效。

为什么值得看:修图师和后期可以留意:移除工具现在能连带擦掉阴影、反射这类关联元素,抠图去杂物少一道手工活。具体是哪个版本、哪端上线原文没说,先在自己那版里试一下。

Suno 语音功能进入 Beta:口播配背景音乐

Suno 官方宣布语音功能进入 Beta 测试版,称这是首个能生成带匹配背景音乐的口语音频的模型,用户更新 App 即可使用,官方博客同步放出介绍。对做短剧旁白、有声书、播客和 AI 配音的后期来说,口播与配乐一次出、不用再分两步对轨,是值得实测的一条流程。

为什么值得看:Suno 把「说话」和「配乐」合成一个模型,一次生成带背景音乐的口语音频,做短剧旁白、播客、有声书的后期可以更新 App 试一版。

ChatGPT 订阅可在 16 家合作产品中直接使用

OpenAI 的 Tibo(@thsottiaux)宣布,ChatGPT 订阅现在可以直接在超过 16 家合作产品中使用,官方说法是「没有繁琐规则,直接用掉全部包含的使用额度」,点名了 Devin、OpenCode、Notion 等产品,用 ChatGPT 账号登录即可。对做创作自动化流程的团队来说,如果常用工具在这份名单里,等于一份订阅能覆盖多个环节,省掉单独采购和额度管理的麻烦。

为什么值得看:OpenAI 把 ChatGPT 订阅额度打通到 Devin、OpenCode、Notion 等 16 家合作产品,用 ChatGPT 账号登录即可直接消耗订阅额度。做自动化流程和工具链的可以看看自己常用的那几个在不在名单里。

方法与经验

Methods · 4 条

@TanLuAI分享御剑飞行视频提示词

博主「探路AI」公开一段 30 秒、16:9 横屏、60fps 超写实真人动作视频的完整提示词:一镜到底长镜头,开场贴高速公路路面追拍拥堵车流,两秒内抬镜揭示戴粉色猪猪头盔的青衣女子空中直立飞行,随后并行拍面部特写、两指手势让头盔消失、加速飞往黄山景区,掠过游客、穿过桥洞、贴悬崖飞行。提示词分「人物与御剑飞行动作」「头盔」「0—2秒贴路追拍」等段落,明确要求锁定参考图的脸、五官比例、额间花纹、半束长发与浅灰绿交领长袍,全程同一张脸同一套衣服,右手始终握实体长剑、不踩剑不趴飞,衣袍发带被气流向后吹起且有重量和延迟摆动,头盔只消失一次、不爆炸不碎裂。开头还附了一句强制指令:不要拆解参数,直接按完整提示词生成,别再确认,直接生成。

为什么值得看:一条可直接抄的 30 秒一镜到底提示词,把贴路追拍、面部慢动作、加速甩镜和仙侠御剑两段参考动作缝进同一个长镜头,做 AI 短片和仙侠题材的可以拿去跑一遍看镜头衔接稳不稳。

Karpathy 分享理解语言模型输出的技巧

Karpathy 提出理解语言模型输出的递进方法:一是让模型用 ASD-STE100(原为航空维修文档开发的受控语言规范)重写内容,约束强、可读性高,也可要求「80% 接近该规范」;二是让模型画图代替文字;三是要求输出 HTML 得到可交互网页;四是他最看好的方向——按任意主题生成定制讲解视频,示例 prompt 为「Create a 3b1b style video explainer on X. Use my ElevenLabs API key for audio narration」,配音可接 ElevenLabs API 或用本地算力的免费替代。

为什么值得看:Karpathy 给了条具体路径:让模型用 ASD-STE100 受控语言重写、出图、出 HTML 网页、最后直接生成 3b1b 风格讲解视频。做 AI 讲解片和知识类内容的可以照这个顺序试一遍。

H3 生成张爱玲温州客栈一幕,附提示词

作者用 H3 生成张爱玲 1946 年初春在温州小客栈与胡兰成不欢而散的一幕,画面设定为低照度阴雨光、镜头近乎静止,情绪靠克制的唇线、躲闪的眼神与一步之距承载,并公开了视频提示词。做年代戏和情绪戏的编导可以看它怎么把「克制」翻译成可执行的画面描述。

为什么值得看:低照度阴雨光、近乎静止的镜头、靠唇线和眼神撑情绪——这条把「怎么用提示词写一场克制戏」拆得挺细,编导和视觉师可以照着 prompt 结构套一遍。

@umesh_ai 用一张图加一句提示词生成 30 秒视频

推特用户 @umesh_ai 发布一条 30 秒视频,称整段内容仅由一张图片和一句提示词生成,正文附有提示词(Prompt ⤵️),但抓取到的文本未展开具体提示词内容与所用模型。对做图生视频的创作者来说,单图驱动 30 秒连续画面的时长值得关注,可点开原帖看提示词写法与画面一致性表现。

为什么值得看:单图加一句提示词直接出 30 秒成片,做图生视频工作流的可以点开看提示词怎么写的,自己跑一遍对比废片率。

作品与案例

Works · 4 条

《永恒乐土》第3集精灵小姐的拷问技巧

B 站「AI 全民制作人」系列短片《永恒乐土》第 3 集《精灵小姐的拷问技巧!!》,作者在简介里说明后续两集会转向另外两条故事时间线,坠崖小队暂时不出场,本集以补充信息为主,剧情最终会收束。属于个人创作者的多集 AI 叙事作品。

为什么值得看:个人创作者做的 AI 系列短片,第 3 集走多线叙事,未来两集要切到另外两条故事时间线。做 AI 短剧的可以拉片看它怎么在多集里铺线索、收束剧情。

B站AI动画短片《奶蛙:一百分的家》第四集

B站 UP 主「轩月27」发布的 AI 动画短片《奶蛙:一百分的家》第四集,标注含 AI 生成内容,归入「AI 剧情大片」话题,标签为动画短片、治愈、温馨,属系列化作品。适合做 AI 动画和系列短内容的创作者参考角色一致性与分集叙事处理。

为什么值得看:B站 UP 主「轩月27」的 AI 动画系列第四集,治愈温馨向,做 AI 动画和系列化短内容的可以拉片看角色一致性和分集节奏怎么处理。

《困兽之战》第10集【AI全民制作人】

B站「AI 全民制作人」系列 AI 短剧《困兽之战》第 10 集,设定为外星文明把地球改造成巨型活体斗兽场,窃取人类典籍与网络数据解析神话传说和生物知识,批量制造血肉外观、内核为尖端科技的异兽造物投放大地,异兽彼此厮杀,人类在其中求生。题材偏科幻怪兽向,看点在世界观设定与神话生物视觉化。

为什么值得看:B站 AI 系列剧的第 10 集,世界观是外星文明把地球改成活体斗兽场、批量造神话异兽互斗。做 AI 短剧的可以拉片看它怎么把神话生物设定和连续剧集节奏撑到第十集。

B站AI短剧《道士也怕鬼》更新第十一集

B站 UP 主「旋转皮坨」的 AI 短剧《道士也怕鬼》第十一集,属「AI 全民制作人」标签下的系列化作品,题材为道士捉鬼向。系列能更到第十一集,说明该 UP 主已跑通一套可复用的角色与场景生产流程,做 AI 短剧的可以拉片看它的角色一致性和单集节奏处理。

为什么值得看:B站 UP 主「旋转皮坨」的 AI 短剧系列已更到第十一集,做 AI 短剧的可以拉片看它怎么把系列化叙事撑到两位数集数。