01
公众号
Anthropic 发布 Claude Opus 5,支持 100 万上下文,知识截止至 2026 年 5 月,已全量上线。ARC-AGI-3 得分 30.2%,接近 GPT-5.6 Sol(7.8%)的四倍;输入每百万 Token 5 美元、输出每百万 Token 25 美元,价格同 Opus 4.8,仅为 Fable 5 的一半。
Claude Opus 5 以一半价格达到 Fable 5 级别的性能,ARC-AGI-3 得分 30.2% 直逼 GPT-5.6 Sol。做 AI 剧本和 Agent 工具的团队直接接 API 测适配,成本可能降一半。
点击打开原文
02
@midjourney
Midjourney 发布 V8.2 模型并设为默认,改进集中在美学、个性化和图像质量,新风格更创意、大胆、锐利、新鲜,个性化效果显著增强。对 AI 视觉创作者,可直接更新体验新风格在概念图和角色设计中的表现;对影视前期团队,可评估其在风格参考和美术定调上的适用性。
Midjourney V8.2 今日上线并设为默认模型,美学和个性化显著提升,风格更锐利大胆。做视觉概念和角色设计的直接上手测风格表现,前期团队可当新参考工具。
点击打开原文,能否访问取决于网络环境
03
@PixVerse_
PixVerse 上线 VibeMV 功能,支持上传任意歌曲一键生成完整音乐视频,提供 15 种风格,具备角色一致性与唇同步歌词,无需拍摄或剪辑。官方同时推出关注转发获 150 积分的限时活动。
PixVerse 把音乐视频生成做成了一键工具,上传歌曲、选风格、出片,带角色一致性和唇同步。做 MV 和短视频的可以直接上手试,15 种风格覆盖主流调性,省掉拍摄和后期环节。
点击打开原平台查看,能否访问取决于网络环境
04
@rohanpaul_ai
Higgsfield 推出新“超级计算机”功能,通过 MCP 协议让 Claude 直接读取并修改 Adobe After Effects 实时项目,支持图层、关键帧、效果和表达式操作。用户描述任务后,Claude 自动编写 ExtendScript 或生成可编辑的表达式,所有操作在 Claude 内通过 Higgsfield MCP 执行。
后期团队可以躺平了:用自然语言让 Claude 直接改 AE 图层、关键帧和表达式,不用手动写脚本。做后期和技术整合的,现在就去试 Higgsfield MCP,看实际出片稳不稳。
点击打开原平台查看,能否访问取决于网络环境
05
@berryxia
Google 发布可微分 3D 头部模型 gmn,参数化设计,支持精细控制所有面部动作和表情,无需 GPU 在 CPU 上即可运行。模型已在 Hugging Face 提供交互式 demo,可微分特性使其能无缝接入神经网络训练,用于表情迁移、逆向渲染等任务。
Google 开源了一套可微分 3D 头部模型,所有面部动作和表情都能精细实时控制,CPU 就能跑通。搞角色动画、面部驱动或表情迁移的,直接上 HuggingFace 试交互 demo。
点击打开原平台查看,能否访问取决于网络环境
06
@alibaba_cloud
阿里云发布Qwen-Audio-3.0-TTS模型,已上线OpenRouter平台,开发者可通过API直接调用,适用于AI配音、有声内容生成等场景,降低TTS部署门槛。
阿里云最新TTS模型上线OpenRouter,做AI配音和有声书的可以直接接API测一听,省掉本地部署的功夫。
07
@AntLingAGI
蚂蚁百灵发布Ling-3.0-flash模型并免费开放一周,集成Hermes框架,支持记忆功能(保留对话上下文)。模型可用于文本生成、角色对话等创作辅助场景,免费期适合开发者测试效果和集成。
蚂蚁百灵Ling-3.0-flash免费开放一周,做AI编剧和对话系统的可以趁免费期跑测试,看看生成质量和记忆功能的表现。
点击打开原平台查看,能否访问取决于网络环境
08
@alibaba_cloud
阿里云推出Token计划,整合通义千问、Wan、HappyHorse、DeepSeek、GLM等模型计费,从按订阅付费改为按交付内容付费,首月起价4美元。对使用阿里云API的创作者(短剧、视觉、配音等)来说,成本结构更统一透明,可试算对比。
阿里云把通义千问、Wan等模型计费统一成Token积分池,首月4美元。做AI应用集成或自用API的可以算算成本降幅。
点击打开原平台查看,能否访问取决于网络环境
01
@HeyGen
HeyGen 官方发布研究更新,提出无需共同标注数据集的多行为虚拟人控制方法,可独立训练每种行为(如表情、手势等),并融合控制。当前为研究阶段,未公布具体产品化时间。
HeyGen 发了多行为虚拟人控制的研究,做 AI 角色和虚拟 IP 的可以盯着后续产品化,省去被多个数据集绑定的麻烦。
点击打开原平台查看,能否访问取决于网络环境
02
X 关注流
GitHub 仓库 video-shotcraft 整理汇总了 106 个镜头配方、162 种风格、161 个动态预览,并将分镜、运镜、节奏、音效及 Remotion 实现封装成 Agent Skill,适合作为 AI 影视制作的镜头灵感库和自动化素材。
做视觉和短剧的可以拉一下这个仓库,106 个镜头配方直接当素材库用,还打包了 Remotion 实现和 Agent Skill,省掉自己试参数的时间。
点击打开原文,能否访问取决于网络环境
03
Claude
Anthropic 产品设计师 Nate Parrott 分享了在 Claude Design(beta)中利用 HTML 交互能力进行产品原型、幻灯片、动画等视觉创意探索的方法,并将 Anthropic 品牌规范提炼为提示词,使输出自动符合品牌指南。Claude Design 不含图像模型,不适合 Logo 设计,但可与 Claude Code 协同,将早期创意与生产开发衔接。
Claude Design 产品设计师亲自拆解如何用 HTML 交互做产品原型、动画和视觉探索,还把品牌规范写成提示词让输出自动对齐。做视觉/品牌设计的可以边看边试这套工作流。
点击打开原文
04
Luma AI Blog
Luma AI 官方博客发布客户案例,介绍创意机构 Serviceplan MAKE 如何将 Luma 视频生成工具融入广告创意流程,优先把精力放在创意本身而非技术门槛。案例展示了从概念到品牌成片的落地路径,涉及 AI 生成广告短片和视觉素材。
Luma 官博发了家创意机构的真实案例,做广告和品牌向 AI 内容的可以点开看看对方怎么把 AI 嵌进工作流,不啰嗦,值得两分钟翻一遍。
点击打开原文
05
@PixVerse_
PixVerse 官方发布 15 秒 AI 短片《SEA BEASTS》,史前海怪题材,完全使用 PixVerse Canvas 功能生成,并公开了逐镜头(shot-by-shot)的 prompt 工作流。短片为 15 秒生存惊悚风格,展示了 Canvas 在分镜级控制下的出片效果。
PixVerse 官方用自家 Canvas 功能跑了个 15 秒史前海怪短片,并公开了逐镜头 prompt 工作流。做 AI 短片的可以直接套这个 shot-by-shot 流程测出片稳定性。
点击打开原平台查看,能否访问取决于网络环境
06
@lovart_ai
创作者 @helenyuanai 用 Gemini Pro 写脚本和提示词,结合 Lovart 平台,2 小时内完成一支油画风格 AI 视频。展示了从文本到成片的快速工作流,Lovart 负责视频生成环节。
个人创作者 2 小时出片,油画风格+AI 全流程,做视觉和编导的可以当工作流参考,看看 Lovart 的生成效果稳不稳。
点击打开原平台查看,能否访问取决于网络环境
07
@rohanpaul_ai
Limestone Digital 团队用 2 名工程师在 3.5 个月内重建了 FedEx 供应商的交付编排平台,原估计需 7-8 个月。首周未写代码,先构建覆盖模块、依赖、数据流和领域术语的全仓库知识图谱(markdown 文件),AI 智能体据此生成代码,最终约 90% 的代码由模型编写,122 个合并 PR 均经人工审查。AI 计算成本约每名开发者每月 200 美元。
AI 编程 Agent 的实战案例,2 人 3.5 个月干完 5 人 8 个月的活。做 AI 短剧/动画的团队可以看他们怎么用知识图谱让 Agent 理解项目全貌,这套思路套到创作管线里也能省掉大量沟通和返工成本。
08
X 关注流
创作者 Abdul Șhakoor 展示用 Higgsfield AI 配合 Claude 技能,仅用 3 个提示词(角色表、生物表、视频提示)复刻皮克斯风格的飞行场景。工作流涉及 GPT Image 2 生成角色参考图,再通过 Higgsfield AI 生成视频片段。
用 Higgsfield AI 加 Claude 技能,3 个提示词复刻皮克斯级飞行场景。做 AI 短剧和视觉开发的可以拉一遍工作流,看角色表+生物表+视频提示怎么串。
点击打开原平台查看,能否访问取决于网络环境
09
@heyglif
推文分享一个自定义图像生成工作流:常规质量用 Grok Imagine + Gemini 组合,高质量输出则改用 GPT Image 2 + Seedance 2.0。推文附有链接指向具体生成页面。
一条工作流分享:用 Grok Imagine + Gemini 做常规图,GPT Image 2 + Seedance 2.0 出高质量图。做视觉和美术的可以收藏当 prompt 参考。
点击打开原文,能否访问取决于网络环境