SmolForge 新增皮肤与精灵表动画
swyx 宣布 SmolForge 新增 4 个功能,支持自定义皮肤和精灵表动画,面向游戏素材生成场景。
为什么值得看:SmolForge 加了自定义皮肤和精灵表动画,做像素风 AI 游戏素材的可以顺手看一眼,对影视创作工作流影响不大。
按创作使用场景整理 AI 视频、图像、声音和工作流工具更新,重点保留能直接试用、比较或纳入制作流程的信息。
swyx 宣布 SmolForge 新增 4 个功能,支持自定义皮肤和精灵表动画,面向游戏素材生成场景。
为什么值得看:SmolForge 加了自定义皮肤和精灵表动画,做像素风 AI 游戏素材的可以顺手看一眼,对影视创作工作流影响不大。
xAI 的 Grok Imagine 模板迎来重大更新,内置现成预设和大量新创意工具,包括照片编辑、风格重绘、智能调整尺寸、背景移除、头像制作、表情符号生成器、周边产品制作器等。
为什么值得看:Grok Imagine 模板更新,新增照片编辑、风格重绘、背景移除、头像制作、表情符号生成器、周边产品制作器等一批创意工具,做视觉和 IP 周边的可以上手试一轮。
Google 旗下 Gemini App 宣布限时免费提供 10 个 Omni 视频生成额度,截止太平洋时间 2026 年 8 月 4 日 23:59。用户可在工具菜单中选择「创建视频」进行生成、编辑和混剪。该活动面向所有用户,无需付费即可体验 Gemini Omni 的视频生成能力。
为什么值得看:Gemini 免费送 10 个 Omni 视频生成额度,截止 8 月 4 日。做短剧和视觉的可以趁免费期实测 Omni 的生成质量和风格一致性,零成本试错。
HeyGen 上线 Video Podcast 功能,支持将文档、链接或创意自动生成为双人播客视频,包含演播室场景、多机位切换和 B-roll 素材,几分钟内即可出片,可直接发布。
为什么值得看:HeyGen 把播客做成带多机位和 B-roll 的成品视频,做短剧和后期剪辑的可以当自动化模板用,省掉传统剪辑环节。
Kling AI 官方发布 Kling 3.0 的15秒视频生成能力,新增主叙事控制(Master Narrative Control)和自定义时长功能,用户可更精确地支配视频的剧情走向与时间长度,此前 Kling 默认时长较短,此次更新面向更完整的短场景创作。
为什么值得看:Kling 3.0 的核心叙事控制给了创作者对视频走向的直接干预权,15秒时长可以随意卡点或拉长,拍短剧和广告的这周上手测一下编导和美术的一致性。
PixVerse Mini Apps 新增深度图控制功能,支持从参考视频自动提取深度图,再结合参考图生成更精准遵循原运动轨迹和空间结构的新视频。工作流:参考视频→深度图视频→参考图+深度视频→输出。72小时内转发关注可获积分。
为什么值得看:深度图控制上线 PixVerse Mini Apps,操作简单,运动一致性提升明显,做 AI 视频的可以马上装上试试。
Suno 官方宣布更新 10 项新功能,包括高级分轨分离(支持导出 MIDI)、歌词协作与自动保存、截图生成歌曲、Apple CarPlay 及 Android Auto 车载支持等。官方同步发布了完整教程视频,适合需要 AI 音乐创作与后期处理的团队直接调用。
为什么值得看:Suno 一口气放了 10 个新工具,最香的是高级分轨分离和 MIDI 导出,做 AI 音乐后期或音效设计的可以直接冲着教程视频上手试。
Glif 平台新增技能,集成 Google Omni 模型,可自动为视频添加运动图形(motion graphics),适用视频特效、包装与动态标题等场景。具体操作门槛和效果需在平台内实测。
为什么值得看:Glif 出了个新 skill,拿 Google Omni 给视频自动加动态图形,后期和视觉师可以直接上手试效果。
OpenAI联合创始人Greg Brockman在X上宣布ChatGPT桌面版语音功能上线,桌面应用新增语音交互能力,用户可直接通过桌面端进行语音输入和实时对话。
为什么值得看:桌面版终于能直接用语音了,做配音和对话脚本生成可以边说话边出结果,后期和编导装起来实测语音流畅度和转写质量。
HeyGen 推出 Video Translation API,支持将一条视频批量翻译并生成 10 个本地化语种版本,宣称 24 小时内完成全渠道分发。提供 API 接口和批量处理入口,适用于多语种内容出海、短剧本地化、MCN 多语种分发等场景。
为什么值得看:HeyGen 把视频翻译做成批量 API 了,一条原片 24 小时内出 10 个语种版本。做短剧出海和 MCN 多语种分发的可以直接接 API 跑一轮,省掉人工配音和字幕重做的时间。
HeyGen 推出 Audio to Video 功能:用户只需上传语音(或直接说话)加一张图片,一次 API 调用即可生成对口型视频。支持同一张图片搭配 100 段不同语音的批量处理,适用于多语言配音、口播视频、短剧批量生成等场景。
为什么值得看:HeyGen 把配音和视频生成合成一步 API 调用,做短剧批量配音、多语言版本、口播视频的可以直接接进流水线,省掉先录再对的步骤。
Google 为 Gemini Batch API 完成基础架构升级:p95 延迟降低 80%,p99 延迟降低 68%,批量成功率超 99.998%,批量过期减少 98%,新增对部分批次的支持。
为什么值得看:Gemini Batch API 延迟降了八成、成功率超 99.998%,做批量生成和自动化管线的技术整合者可以接 API 测一周,看实际吞吐能提多少。