← 全部日报

AIGC 信息日报

2026 年 5 月 9 日 周六

行业与平台

Industry

Recraft V4 can generate logo styles for pretty much any vibe

Recraft 发布 V4 模型,支持直接生成多种风格的矢量 Logo(极简、复古、吉祥物、奢侈、科技等),输出即矢量格式,无需后期转描。官方已放出项目链接,包含所有图片和 prompt 示例。

Recraft V4 能直接生成矢量 Logo,极简/复古/科技/奢侈风都能出,做视觉和 IP 的可以直接当素材库用,省掉转矢量这一步。

genmedia CLI is here 🚀

fal 发布 genmedia CLI 工具,支持在终端中直接调用 1000+ 模型生成图像、视频、音频和 3D 内容,可连接 Claude 等 AI 代理项目,并安装可复用的技能和工作流。

终端里直接调 1000+ 模型生成图/视频/音频/3D,做工具链整合的可以直接装起来跑工作流。

点击打开原文,能否访问取决于网络环境

Building with HyperFrames

HeyGen 宣布将 HyperFrames 项目开源,相关代码已上传至 GitHub 仓库。HyperFrames 是 HeyGen 此前推出的用于生成角色一致性的 AI 视觉框架,支持多帧角色保持、风格迁移等能力。开源后开发者可自行部署、修改和集成到自有工作流中,适用于 AI 短片、短剧的角色视觉开发与批量生成场景。

HeyGen 把 HyperFrames 开源了,做角色一致性和视觉开发的可以直接拉代码跑 demo,省掉自己搭底层的时间。

RT @agermanidis: Runway added more than $40M in net new ARR…

Runway 官方 X 账号透露,本季度至今新增净年度经常性收入(ARR)超过 4000 万美元,且季度尚未过半。这是 Runway 首次公开披露如此具体的季度营收增长数据,表明其视频生成平台在 B 端和创作者市场的商业化正在加速。

Runway 本季度新增 ARR 超 4000 万美元,且才过了一半。做 AI 制片和短剧的可以看看这个增速,判断平台生态的成熟度和商业化潜力。

With Nano Banana Pro, you can edit like you mean it

FLORAai 发布 Nano Banana Pro 视频编辑工具,核心功能是局部精准修改——改画面中某元素(如物体、颜色、纹理)时不影响其他区域,支持 Nano Banana 2 和 Pro 两个版本,即日起至 7 月 1 日免费使用。

FLORAai 的 Nano Banana Pro 主打精准局部编辑,改一处不动全局,做后期和视觉的可以装起来用,免费到 7 月 1 日。

工具与能力

Tools

GPT-5

OpenAI 最新前沿模型 GPT-5.5 现已集成至 ComfyUI,支持推理、结构化输出与单次可靠结果,适用于 prompt 合成、逻辑密集型转换及一次性生成干净结构化输出,可直接在 ComfyUI 节点中调用。

GPT-5.5 直接塞进 ComfyUI 节点,做 AI 视觉和自动化工作流的可以接 API 跑一遍,看单次推理的稳定性和结构化输出能不能省掉后处理步骤。

点击打开原文,能否访问取决于网络环境

Love to see it

ComfyUI 官方宣布原生支持 FBX 格式导入,3D 动画数据可直接接入 AI 视频生成管线。这意味着用户可以将外部 3D 软件(如 Blender、Maya)制作的动画骨骼、摄像机运动、角色动作等 FBX 数据,直接作为 AI 视频生成的输入控制信号,无需手动逐帧对齐或额外转换流程。

ComfyUI 原生支持 FBX 导入,3D 动画数据直接进 AI 视频管线。做角色动画和镜头控制的编导、视觉师可以装起来跑一遍,省掉手动逐帧对齐的功夫。

RT @livekit: Add a face to your voice agent

HeyGen 的 LiveAvatar 实时数字人功能正式集成到 LiveKit Agents 平台,开发者可在语音 Agent 基础上直接添加实时面部动画和口型同步的虚拟形象,支持自定义角色外观,适用于虚拟主播、AI 客服、交互式短剧角色等场景。

HeyGen 的实时数字人 Avatar 现在能直接嵌入 LiveKit 语音 Agent 里,做虚拟角色直播或交互短剧的可以接上跑一遍,看延迟和表情同步到什么程度。

RT @jamesyeung18: NEW: Topaz Image Web

Topaz Labs 推出 Topaz Image Web 网页版,将原本需要本地 GPU 运行的图像超分辨率、降噪、锐化等增强功能迁移至云端浏览器端,用户无需高性能显卡即可在线处理图片。该更新降低了后期和视觉制作中图像修复的门槛,尤其适合没有本地算力或需要快速出图的场景。

Topaz 把图像增强工具搬到了网页端,不用本地显卡也能跑超分和降噪,后期和视觉师可以直接收藏链接当在线工具箱用。

Another @HyperFrames_ catalog update

HyperFrames 更新特效目录,新增纹理和着色器效果,支持通过 npx hyperframes add <name> 一条命令直接添加到视频中。此前已推出 html-in-canvas 效果。该工具面向 AI 视频后期和视觉创作者,提供可复用的特效组件,降低手动编写 shader 的门槛。

HyperFrames 更新了纹理和着色器特效库,一条命令就能加到视频里。做 AI 后期和视觉的可以装起来当素材包用,省掉自己写 shader 的时间。

方法与经验

Methods

Seedance 2

ComfyUI 官方发布 Seedance 2.0 工作流,支持基于单段源视频,通过 prompt 和参考图替换环境、服装和整体视觉风格,同时保留原始动作与运动轨迹。工作流已开放下载链接,适用于 AI 短片后期重绘、角色换装、场景迁移等场景,无需重新生成或补拍。

Seedance 2.0 的 ComfyUI 工作流,能保留原视频动作的同时换环境、换装、改整体视觉风格。做 AI 短剧和视觉开发的可以直接套用,省掉重拍和后期重绘的功夫。

GPT Image 2 + Seedance 2

创作者 @MayorKingAI 分享了一条 AI 电影制作工作流:先用 GPT Image 2 生成电影级分镜方案(包含镜头、构图、色彩计划),再将方案输入 Seedance 2.0 直接输出最终成片序列。该流程将前期视觉开发与后期生成打通,减少了传统 AI 视频制作中反复调整 prompt 和参数的时间,适合短剧、MV、广告等需要快速出片的场景。

一条工作流分享:GPT Image 2 出分镜方案,Seedance 2.0 直接转成成片。做 AI 短剧和视觉开发的可以跑一遍这个链路,省掉中间反复调参的环节。

作品与案例

Works

爱在寻常间【AI文艺微电影】

新片场发布 AI 文艺微电影《爱在寻常间》,获编辑精选,文艺向短片定位。完整成片,主打 AI 风格一致性下的叙事节奏与镜头语言处理,未公开具体工作流或工具栈。

AI 文艺微电影完整作品,编导和视觉师可拉片看叙事节奏和 AI 风格一致性。

See what happens when creative legends use AI to make ads…

Google 发布创意项目,邀请 Susan Credle、Jayonta Jenkins、Tiffany Rolfe 三位广告界传奇人物,使用 AI 工具为三家小企业制作广告短片。项目展示了资深创意人如何将 AI 融入从概念到成片的完整广告制作流程,包括文案生成、视觉风格探索、镜头语言设计等环节,最终产出可投放的广告成品。

Google 请了三位广告界传奇用 AI 给小店做广告,看的是创意人怎么用工具而不是工具本身。做 AI 广告和品牌短片的可以拉片看他们的 prompt 思路和成片质感。

can you make a pop song using only your voice

Suno 官方发布一条演示视频,展示仅用纯人声(无乐器、无伴奏)通过 Suno 平台生成一首完整流行歌曲的全过程,包含人声采样输入、AI 编曲、混音、母带处理等环节,验证了纯人声到成品歌曲的端到端工作流可行性。

Suno 官方用纯人声做了一首流行歌,AI 后期和音乐制作人可以直接拉片看人声采样到成品的工作流,收藏当 prompt 模板用。

《流量菩萨》我用AI做了一部批判流量的短片

新片场发布 AI 短片《流量菩萨》,主题批判流量文化,是一部带批判性立意的同行作品,重点在叙事结构、视觉风格一致性以及 AI 生成内容如何支撑批判性主题,而非纯炫技。

AI 短片同行作品,编导和短剧团队可当案例拉片,看叙事和视觉怎么落地。

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索