Grok 发布 Imagine Image 2.0 图像模型
Grok 官方发布 Imagine Image 2.0 图像模型,主打精准编辑、清晰文字渲染、提升事实性和真实世界实用性,定位为面向实际工作场景的图像生成工具。
为什么值得看:官方发布下一代图像模型,主打精准编辑、清晰文字渲染和真实感提升,做视觉和 KV 的可以直接上手测一轮出图质量。
8 月 3 日 — 8 月 9 日
从本周日报中按创作价值与信息完整度筛选,保留可直接试用、复现或拆解的内容。
Grok 官方发布 Imagine Image 2.0 图像模型,主打精准编辑、清晰文字渲染、提升事实性和真实世界实用性,定位为面向实际工作场景的图像生成工具。
为什么值得看:官方发布下一代图像模型,主打精准编辑、清晰文字渲染和真实感提升,做视觉和 KV 的可以直接上手测一轮出图质量。
阿里云官方账号宣布 Wan 视频模型公开测试版(Public Beta)正式上线,提供阿里云 Model Studio 和 Qwen Cloud 两个接入入口。这是阿里自研视频生成模型的公测开放,创作者可通过官方云平台直接调用,用于 AI 视频生成、短剧制作等场景。
为什么值得看:阿里 Wan 视频模型公开测试版正式上线,官方提供两个云平台入口,做 AI 视频和短剧的可以直接上手实测出片效果。
据 @synthwavedd 独家消息,OpenAI 即将推出新预训练模型 Astra,目标下周发布。这是 OpenAI 自 GPT-4.5 以来训练的最大模型,最近内部狗粮测试检查点(内部代号 mewfour)已是发布候选版本。
为什么值得看:OpenAI 自 GPT-4.5 以来最大的预训练模型,内部狗粮测试已到发布候选阶段。做 AI 长片和短剧的可以蹲一下,看它会不会改变现有视频生成工作流。
MiniMax 官方账号转发员工 RyanLeeMiniMax 的推文,称模型发布首日及前 48 小时属于开源社区,并点名感谢 ComfyUI 等工具的接入。这是对社区生态响应的致谢表态,非新功能发布。
为什么值得看:MiniMax 官方转发自家员工推文,感谢开源社区在模型发布首日就接入 ComfyUI 等工具。做工具链整合的可以看看社区生态的响应速度。
马斯克(@elonmusk)在 X 上预告 Grok 图像编辑新版本上线试用,未透露具体功能细节或参数。对视觉创作者来说,可关注其图像编辑能力与风格一致性表现,需等实际出图效果验证。
为什么值得看:马斯克亲自预告 Grok 图像编辑新版本,做视觉和短剧的可以蹲一下实际出图效果,看编辑能力和一致性有没有升级。
Claude官方账号宣布本周为托管代理推出四项更新,首项为会话预算功能:可为会话设置预算以控制支出,达到限制的会话会暂停并触发budget_reached事件,可提高预算恢复会话。对用Claude托管代理跑批量生成、自动化剪辑等长任务的创作者,预算控制能有效管理成本,避免任务中途因额度耗尽中断。
为什么值得看:做AI短剧批量生产或自动化剪辑链路的,托管代理的预算控制能帮你把成本锁死,跑长任务不怕超支,值得接API实测。
Elon Musk 在 X 宣布 Grok 现已集成至 Blender。具体集成方式、可用功能(如生成、编辑、材质、脚本辅助等)尚未披露,需查看官方后续说明。
为什么值得看:xAI 官方宣布 Grok 接入 Blender,做 3D 视觉和 AI 工作流整合的可以关注下具体能调哪些能力。
Magnific 官方宣布插件升级:Speak 功能现已内置于 Premiere、After Effects 和 DaVinci Resolve,支持直接下载 Getty 视频素材,并修复多项性能问题。
为什么值得看:做后期和视觉的可以关注,Speak 直接嵌进 Premiere、AE、达芬奇,不用切工具就能用,还接了 Getty 视频素材库,跑一遍看效率提升多少。
澜森(@lansenai)分享 15 秒 AI 追逐镜头设计,附完整提示词:白天,成年男性手提沉重黑色旅行袋,以冲刺速度穿过繁忙现代城市街道,摄影机位于街道斜对面,以手持长焦镜头横向追踪,营造街头纪实感。
为什么值得看:一条带完整提示词的 AI 追逐镜头设计,手持长焦横向追踪的运镜思路可以直接套用,做动作戏和短剧的编导可以收藏当分镜参考。
A.I.Warper 个人观点:看过成千上万 AI 视频后,能立刻分辨创作者是否真正理解叙事和导演技巧,这种理解源于 AI 知识出现之前对基础原理的掌握,在 Seedance 时代更加明显。
为什么值得看:个人观感分享:AI 视频看多了,能一眼分辨创作者是否真正懂叙事和导演技巧,尤其在 Seedance 时代更明显。编导可当闲聊参考。
X 用户 fofr 分享用 Flux 3 生成的零重力空间站内高速移动片段,20 秒 demo,画面穿过一个个截然不同且怪异的房间,永不停歇。fofr 本人评价「Flux 3 让这个画面变得如此奇异」。
为什么值得看:fofr 用 Flux 3 跑了一段零重力空间站穿越的 20 秒 demo,画面奇异感是看点。做视觉和短剧的可以点开看看 Flux 3 在这种高速运动场景下的表现力,当风格参考。
深度体验大模型纯代码建模:用自然语言描述需求,十几分钟即可得到基于 Three.js 加 Cannon-es、零依赖、可交互的 3D 物理原型,具备真实刚体物理与电影级渲染。作者认为 SolidWorks、Fusion、AutoCAD 将从必备建模工具沦为 AI 生成后的后处理工具,早期验证成本从几周压到几十分钟。
为什么值得看:用自然语言十几分钟出可交互 3D 物理原型,做工业设计验证、数字孪生、游戏原型的可以上手跑一遍,看纯代码建模能不能替代传统 CAD 早期验证。
新片场AIGC分类下的国风木偶动画长片《琴中魄》完整成片。题材为传统木偶戏风格,主打国风视觉与长篇幅叙事,是AI生成长片在风格化美术和角色一致性上的一个完整样本。
为什么值得看:AI长片,国风木偶题材,做AI短剧和长片的可以拉片看长叙事下的角色一致性和美术风格统一怎么处理。
B站UP主「星海大明锦衣卫AIGC」的AI短片《大明14444:赛车装上大炮,还能叫赛车吗?》,属于「AI全民制作人」参赛作品。题材为明朝背景与赛车、大炮元素的混搭脑洞,偏向喜剧或动作向的短剧风格。
为什么值得看:B站AI全民制作人参赛作品,题材是明朝背景加赛车大炮的混搭脑洞,做AI短剧的可以拉片看题材创意和视觉风格。
B站AI影视区作品《小明修仙传》优化纯享版,将学历对应网文战力境界的设定贯穿全片,属于AI长片级成片。
为什么值得看:AI长片纯享版,把学历梗套进修仙战力体系,做AI短剧的可以拉片看长叙事节奏和梗的密度处理。
B站UP主「数字游牧人」发布视频《强迫两个AI互殴!》,播放量过万。内容为让两个AI进行对抗性对话的娱乐向实验,非完整叙事作品,无公开工作流细节。
为什么值得看:标题党玩法,实际是让两个AI对话/对抗的娱乐向内容,对创作工作流参考价值有限,做AI短剧的可以当个脑洞看看。