← 全部日报

AIGC 信息日报

2026 年 7 月 22 日 周三

行业与平台

Industry

Incredible application of our …

阿里 Wan 官方宣布推出 AnimeGen,一个基于 Wan 开源模型微调的视频 AI 模型,专攻动漫风格视觉与动态运动表现。该模型已发布,具体技术细节和下载链接需查看官方公告。

阿里 Wan 开源模型生态里长出了专攻动漫风格的微调版,做 AI 动画和短剧的视觉师可以直接下载跑跑看,动态和画风一致性是重点测试项。

点击打开原文,能否访问取决于网络环境

AlayaWorld 的完整技术细节刚刚发布。 AlayaW…

Alaya Lab 发布 AlayaWorld 全栈开源视频世界模型技术报告,支持 720p、24 FPS 流式视频生成,具备相机控制和文本驱动的事件生成功能,代码与报告已在 GitHub 开源。

全栈开源视频世界模型,720p/24fps 流式生成带相机控制,做 AI 短剧和视觉开发的可以直接拉技术报告看架构,跑通后能省掉不少后期合成工序。

点击打开原平台查看,能否访问取决于网络环境

阿里千问发布 Qwen-Image-3.0 图像生成基础模型

阿里发布 Qwen-Image-3.0 图像生成基础模型,核心能力是“实”:支持 4.5k token 超长输入,可一次生成含公式、几何图形、逻辑推导的知识图解和复杂 UI;支持 12 国语言及 20 多款字体原生渲染,10px 小字清晰可读。阿里云百炼、千问 AI 平台已开通 API 邀测,Qwen Studio 和千问 APP 即将上线免费体验。

阿里千问第三代图像模型,主打“实”——长文本输入、小字渲染、多语言字体原生支持。做海报、分镜、漫画、知识图解的美术和短剧团队可以直接接 API 测,看能不能省掉排版和后期加字的环节。

点击打开原文

HappyOyster实时世界模型上线Reactor

阿里云与 HappyOysterAI 联合推出的实时世界模型 HappyOyster 正式上线 Reactor 平台,支持用户探索任意想象世界或实时导演故事走向,已开放 API 调用。该模型主打实时交互生成,区别于传统文生视频的单向输出,创作者可边生成边调整叙事方向,适用于互动短剧、实时叙事体验、虚拟世界探索等场景。

阿里云实时世界模型 HappyOyster 上线 Reactor 平台,支持实时交互叙事和导演视角控故事走向。做 AI 互动短剧和实时叙事体验的可以直接接 API 试玩,看看实时生成的世界模型在叙事自由度上能走多远。

点击打开原平台查看,能否访问取决于网络环境

阿里云 WonderClip 实现脚本到视频全自动生成

阿里云宣布 WonderClip 实现企业级 AI 视频制作全自动化——输入脚本,直接输出成片,覆盖从脚本到最终剪辑的完整链路。7 月 23 日上午 10 点(UTC+8)将进行首场直播演示。目前仅开放注册,具体模型能力、输出分辨率、风格控制等参数尚未公布。

阿里云官宣 WonderClip 从脚本到成片全自动生成,做短剧和批量视频的可以蹲 7 月 23 日直播看实际出片质量,别只看宣传片。

点击打开原文,能否访问取决于网络环境

Martian 发布 Ship:50% 成本复刻模型输出

Martian 推出 Ship,一个 drop-in API 端点,能以 50% 更低成本复刻参考模型(如 Opus、GPT 5.6 Sol)的输出。核心是运行时推理路由特化,通过混合模型、工具、级联或集成来保证行为等价与能力等价,而非切换至更弱模型。已提供质量 SLA。

一个 API 路由层,承诺用混合模型/级联策略复刻 Opus 或 GPT 5.6 Sol 的输出,成本砍半。做 AI 制片或技术整合的可以关注,如果质量 SLA 靠谱,能直接压短剧/广告批量生成的推理成本。

点击打开原文,能否访问取决于网络环境

Less than two weeks left to su…

Runway 官方提醒其主办的「Another Big Ad Contest for Products That Don't Exist」AI 广告大赛距截稿不足两周,参赛者需通过指定链接提交 AI 生成的广告作品。该赛事面向 AI 视频生成创作者,获奖作品将作为行业案例展示。

Runway 的 AI 广告大赛截稿倒计时,做 AI 短剧和广告创意的可以冲一下,获奖作品是很好的行业案例参考。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools

Your best ad already exists

LumaLabs 宣布其 AI 广告变体生成功能已集成至 Google Ads 平台。用户可将已有的优质广告素材导入 Luma,自动生成多个投放版本,并直接推送至 Google Ads 账户投放。该功能面向效果广告场景,旨在缩短从创意到多版本投放的链路。

Luma 把广告变体生成直接接进 Google Ads 了,投放过效果广告的制片和短剧团队可以连账号跑一轮,省掉人工剪不同版本的时间。

点击打开原平台查看,能否访问取决于网络环境

RT @PixVerse4Biz: PixVerse jus…

PixVerse 正式接入 Shopify 平台,商家可直接从店铺选产品,一键生成可用的视频广告素材。该功能将 AI 视频生成与电商选品流程打通,降低了电商短视频广告的制作门槛。

PixVerse 直接接入 Shopify 选品出视频广告,做电商短视频和 AI 短剧的可以试一下这个自动化出片链路,省掉手动选素材的环节。

点击打开原文,能否访问取决于网络环境

Claude Cowork 发布"录制技能"功能,学习用户操…

Claude Cowork 桌面应用新增"录制技能"功能,用户可录制屏幕操作并配合语音讲解,Claude 会学习并转化为可重复执行的自动化技能。下次只需输入技能名称即可让 AI 模仿操作流程。该功能位于桌面端"+"菜单下,类似 Codex 的 Agent 能力,但面向更通用的桌面操作场景。

Claude 桌面端能录屏教学了,重复性操作(批量转写、统一调色、素材整理)可以录一次让 AI 自动跑。做后期和技术整合的可以装起来试试,省掉重复劳动。

点击打开原文,能否访问取决于网络环境

Glif can now inspect its own o…

Glif 上线「验证技能」功能,可让 AI 自动检查自身输出并自我修正。演示案例中,Glif 接收模型、服装和简单 prompt 作为输入,先生成、再自检修正,最后才合成多场景视频。该能力通过指令调用,适用于需要自动化质检和纠错的批量生成管线。

Glif 加了个自我校验技能,能自动检查生成结果并修正,做批量出图和自动化工作流的可以接进去省一轮人工质检。

点击打开原平台查看,能否访问取决于网络环境

Introducing ElevenMusic's Summ…

ElevenLabs 旗下音乐生成工具 ElevenMusic 宣布「夏日之声」活动,即日起将免费用户每月生成额度大幅提升至 400 首曲目,鼓励用户免费创作、实验和分享。

ElevenLabs 音乐生成免费额度从几十首涨到 400 首/月,做后期配乐和音效的可以当免费素材库用,省一笔版权费。

点击打开原文,能否访问取决于网络环境

Gemini Batch API 重大基础架构升级

Google 为 Gemini Batch API 完成基础架构升级:p95 延迟降低 80%,p99 延迟降低 68%,批量成功率超 99.998%,批量过期减少 98%,新增对部分批次的支持。

Gemini Batch API 延迟降了八成、成功率超 99.998%,做批量生成和自动化管线的技术整合者可以接 API 测一周,看实际吞吐能提多少。

做最好用的反推插件!「照样拍」新版本来啦!这次新增了两个呼声…

AI 反推插件「照样拍」更新,新增资产库(自动存档反推提示词与创作内容,支持导出导入)和积分系统(免配置 API key,邮箱绑定跨设备使用)。插件付费用户已超 200 人,Chrome 商店同步上架,支持在线更新。29.9 元买断。

AI 视觉师做图时常用的反推插件更新,新增资产库和积分系统,方便存档提示词和免配 API key。

点击打开原平台查看,能否访问取决于网络环境

方法与经验

Methods

兄弟们,上周预告的“故事转手绘视频”Skill,今天正式开源…

知识猫图解开源「故事转手绘视频」Skill,输入中文故事或上传本地图片,自动完成分镜拆解、黑白线稿逐渐上色、手写体字幕生成,输出3:4竖屏静音MP4(正式版1080×1440)。支持直接切换和翻页两种转场,底层用Image2生成分镜、Remotion完成动画渲染。项目已完整开源在GitHub。

中文故事一键转手绘日记动画,自动分镜、上色、配手写字幕,做情感叙事和短剧的可以直接跑开源项目试效果。

点击打开原平台查看,能否访问取决于网络环境

Same prompt, two AI directors …

Lovart 平台发起同 prompt 双模型对比:GPT 5.6 SOL 与 Kimi K3 使用相同创意简报,均通过 Seedance 2.0 渲染输出,呈现截然不同的执行结果。该对比直接展示了不同语言模型在相同指令下的叙事与视觉风格差异,对编导和视觉师选择模型有参考价值。

Lovart 搞了个同 prompt 双模型盲测,GPT 5.6 SOL 和 Kimi K3 都走 Seedance 2.0 渲染,编导和视觉师可以直接拉片对比两家在相同指令下的镜头语言差异。

点击打开原平台查看,能否访问取决于网络环境

The best results come from col…

Luma Labs 官方发布一条工作流演示,由 Joshua Hoole 制作,展示 Luma Skill 功能的协作式创作方法:设定 Skill 后让模型自主探索创意方向,再从返回的素材中选取片段构建叙事,而非逐帧精确指令。

Luma 官方展示 Skill 功能的工作流——不是命令模型,而是设定 Skill 让它探索想法、从返回的素材里构建故事。做 AI 短剧和编导的可以看看这种协作式创作思路,跟传统 prompt 调参是两套逻辑。

点击打开原平台查看,能否访问取决于网络环境

用户用Qwen 3.8-Max做出3D幻灯片放映机

用户 Berry Xia 用 Qwen 3.8-Max Preview 模型制作了一个 3D 幻灯片放映机,支持本地上传 PDF、MP4、PPT 等文件,实现动画交互与细节刻画。Qwen 3.8-Max-Preview 是一个 2.4 万亿参数的开源权重模型,预览版已上线 Token Plan 和 Qoder 平台供普通用户试用。

个人创作者用 Qwen 3.8-Max 做了个 3D 幻灯片放映机,支持本地上传 PDF/MP4/PPT 做动画交互。做视觉和美术的可以看看这个 3D 交互玩法怎么落地,当个灵感参考。

点击打开原平台查看,能否访问取决于网络环境

Codex剪辑,这6个神级Skill就够了!! 41 77 …

铁锤人(@lxfater)分享6个Codex剪辑Skill,以视频形式演示具体操作。Codex是AI编程+剪辑工具,这6个Skill可嵌入自动化剪辑工作流,提升批量处理效率。

后期和剪辑师可以点开视频看是哪6个Skill,能直接装进Codex工作流里用。

点击打开原平台查看,能否访问取决于网络环境

关于我如何逆向 Kimi 的宣传片,还被投 Kimi 官方投…

独立创作者 Yihui 发布视频教学,讲解如何逆向拆解 Kimi 官方宣传片,并复现其镜头语言和视觉风格。该教学被 Kimi 官方投了广告,验证了其拆解方法的实用性和参考价值。

逆向拆解官方宣传片的工作流教学,视觉师和后期可以拉片看具体怎么复现镜头和风格。

点击打开原平台查看,能否访问取决于网络环境

三个起始画面。三个镜头类型 中远景、中景,全程静态镜头。你设…

Magnific 官方发布静态镜头构图控制演示:三个起始画面分别对应中远景、中景,全程固定机位,用户设定的构图即为最终输出构图。附有完整 prompt 示例(如“中远景,静态镜头仰视普通住宅公寓楼外墙,浅色混凝土阳台,柔和日光,晴朗天空,一个阳台上的黄 T 恤男子抛小球”)。

Magnific 官方演示静态镜头构图控制——中远景/中景固定机位,构图即所得。做 AI 短剧和视觉开发的可以拉片看 prompt 怎么写才能锁死画面结构。

点击打开原平台查看,能否访问取决于网络环境

KARABO a 45-second AI short fi…

创作者@MayorKingAI 发布45秒AI短片《KARABO》,使用GPT Image 2生成角色与场景,Seedance 2.0(在Leonardo AI内)做动画,Suno配乐,CapCut剪辑。推文附完整工作流链接,可复现。

45秒AI短片,工作流拆解:GPT Image 2 + Seedance 2.0 + Suno + CapCut,做短片的可以直接套这个管线跑一遍,看成品质感稳不稳。

点击打开原平台查看,能否访问取决于网络环境

假如古建筑大门上的门神是活的,那在监控中就可能拍到这样的场景…

创作者 @PixelAigc 发布 AI 短片,创意设定为古建筑门神在监控中活过来并摸鱼。使用豆包生成视频,Seedance 处理 prompt,prompt 已公开可一键复制。视频为监控视角风格,展示门神打哈欠、伸懒腰等拟人化动作,整体偏轻松幽默的国风创意短片。

门神摸鱼的监控视角创意,豆包+Seedance 出片,prompt 已公开可一键复制。做 AI 短剧和视觉创意的可以直接套用这个 prompt 跑一遍,看看风格化效果和角色一致性。

点击打开原平台查看,能否访问取决于网络环境

给AI黑客们的一点“燃料”:这是42秒未经剪辑的AI素材,几…

创作者NΞXUS发布42秒未经剪辑的AI原始素材,展示模型生成素材中频繁出现的动作、时机、连续性和表演问题,强调电影制作的核心在于人工筛选、拒绝和重建,而非模型自动生成。

42秒AI原始素材,每几秒就出一次动作/连续性/表演问题。做AI短剧和长片的编导可以拉片看哪些坑是模型自己填不了的,剪辑和后期也能当素材修复的参考。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

来自奥斯卡提名电影《第九区》的导演 @NeillBlomka…

《第九区》导演尼尔·布洛姆坎普与 Barleystudiosai 合作,使用 Dreamina Seedance 2.0 4K 制作的全新短片。短片由 BytePlus 发布,展示了 Seedance 2.0 在 4K 分辨率下的视觉叙事能力,是知名电影导演深度使用 AI 视频生成工具进行长篇幅创作的案例。

《第九区》导演尼尔·布洛姆坎普用 Dreamina Seedance 2.0 4K 做的新短片成片。做 AI 短剧和长片的可以直接拉片看大导演怎么用 AI 工具处理叙事节奏和视觉风格,参考价值比普通创作者作品高一个量级。

点击打开原平台查看,能否访问取决于网络环境

《大爱仙尊》动画第49集【我可是班头啊!】

B站UP主「炽焰」个人使用AI工具全流程制作的《大爱仙尊》动画第49集,已形成持续更新的长篇AI动画系列。该集,延续了前48集的角色风格和叙事节奏,是个人创作者在有限资源下完成AI长篇连载的典型案例。

个人创作者用AI全流程做到第49集,做AI短剧和长系列的可以直接拉片看角色一致性和叙事节奏怎么撑住长篇连载。

点击打开原平台查看

150w算力做的原创IP《一万个平行宇宙|第一季01集「稻草…

新片场AIGC分类作品,原创IP《一万个平行宇宙》第一季第一集《稻草人导演》。个人创作者用150万算力完成的长篇AI叙事尝试,题材为平行宇宙世界观下的剧情向短片。

原创IP系列第一集长叙事,做AI短剧和长片的可以拉片看角色一致性和世界观构建怎么撑住一季的体量。

if you spot something wrong, i…

导演 Brett Stuart 发布 AI 恐怖短片《THE NOT KNOW》第一集,使用 InVideo 的 Agent One 工具全流程制作,由 The Infinite Productions 制片。短片定位睡前不宜观看的恐怖题材,验证了单一 AI 工具链完成短篇叙事成片的可行性。

AI 恐怖短片第一集,导演 Brett Stuart 用 InVideo Agent One 全流程制作。做 AI 短剧和恐怖题材的可以拉片看叙事节奏和氛围控制,尤其适合研究单工具链出成片的可行性。

点击打开原平台查看,能否访问取决于网络环境

ChatGPT Work 制作视频庆祝 2M 订阅

ChatGPT 官方账号发布一支庆祝视频,全程由 ChatGPT Work 制作,从创意到最终剪辑在一个工具内完成。视频展示了 ChatGPT Work 整合创意、生成画面、剪辑成片的能力,官方将其定位为「从想法到成品」的一站式创作演示。

ChatGPT 官方用自家 Work 工具做了一支庆祝视频,从创意到成片全在一个地方完成。做 AI 短剧和后期剪辑的可以拉片看成品质感,判断这个工作流能不能套进自己的项目里。

点击打开原平台查看,能否访问取决于网络环境

One man

创作者@CharaspowerAI 使用Agent One协作完成AI动画短片《齐格弗里德战龙》,从分镜到最终战斗场景全程与AI Agent迭代打磨,验证了人机协作在神话题材动画短片中的可行性。

AI动画短片,齐格弗里德战龙传说,视觉师和编导可以拉片看AI在神话题材中的镜头调度和角色一致性处理。

点击打开原平台查看,能否访问取决于网络环境

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索