01
@SiliconFlowAI
智谱 GLM-5.3-Flash 开源并上线硅基流动,总计 320B 参数、仅 18B 激活,原生多模态,MIT 许可,性能强于 GLM-5.2,成本降低 90%,编码与智能体任务接近 Opus 4.8 且成本降低超 95%。硅基流动提供优化推理、高可用性和生产级规模容量,支持 Day-0 调用。
开源大模型,320B 参数只激活 18B,成本降 90%,编码和智能体任务接近 Opus 4.8。做 AI 短剧和工具链的可以接 API 跑一遍,看能不能把批量生成和自动化流程的成本再压一档。
点击打开原文,能否访问取决于网络环境
02
Hacker News 热门
Google 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 提供面向专业用途的生成视频能力。新功能包括场景扩展(可分析最多 10 秒先前上下文,以 10 秒为增量延长至累计 40 秒)、首尾帧插值、360p 快速草稿(比 720p 快至多 60%、成本为其三分之一)以及最高 4K 分辨率升级。
Google 把视频生成的控制力又往前推了一步,场景扩展、首尾帧、4K 升级都是做片子最常用的操作,做 AI 短剧和后期剪辑的可以直接接 API 试一周。
点击打开原文
03
The Decoder
据 The Information,Nvidia 以 129 亿美元收购开源 AI 平台 Hugging Face,约为其年收入 1.5 亿美元的 80 倍。Hugging Face 运营十年,托管开源模型并提供云服务,接近盈利。此举正值 OpenAI、Anthropic 等闭源厂商自研芯片、减少对 Nvidia 硬件依赖之际,Nvidia 或借此扩大云业务,打造开源模型路由平台。
行业级并购,对创作工作流短期无直接影响,但开源模型生态的走向会影响未来工具链选择,技术整合者可以关注。
点击打开原文
04
@MiniMax_AI
MiniMax 官方账号转发 RenLeanna 的推文,宣布 H3-Max 模型发布。该模型将 SOTA 视频质量与生成速度的阶跃式提升相结合,使高质量视频生成更实用。具体参数、价格和开放方式未在推文中详述,需查看官方后续公告。
MiniMax 官方转发的 H3-Max 发布消息,主打 SOTA 视频质量加生成速度跃升。做短剧和视觉的可以蹲一波实测,看废片率和出片速度到底提升多少。
点击打开原文,能否访问取决于网络环境
05
@lipdubai
LipDub 2.0 正式发布,主打短视频本地化场景。核心升级:口型同步更自然、无需训练、速度提升 8 倍。面向 AI 短剧出海、多语言配音对口型等后期环节,可显著缩短本地化制作周期。
做短剧出海和本地化的后期团队直接受益,口型同步不用再训练模型,速度翻倍,接 API 跑一批样片看效果。
点击打开原平台查看,能否访问取决于网络环境
06
@magnific
Magnific 推出桌面版应用,支持 macOS 和 Windows,提供文件夹同步、原生快捷键、标签页记忆和本地处理能力,将图像放大与增强流程整合到桌面端。
做视觉和后期的工作流能省不少事,本地处理不用来回传图,装一个试试顺手不顺手。
点击打开原平台查看,能否访问取决于网络环境
07
@WonderStudiosX
Wonder Studios 出品的 AI 短片《The Trials》获澳大利亚 AI 电影节最佳国际短片奖,由工作室常驻导演兼后期负责人 Hal Watmough 执导,该片也是 Beyond the Loop 第二季的开篇作品,探索电影人如何用新兴 AI 工具推动创作。
AI 短片在国际电影节拿奖,导演是工作室后期负责人,做 AI 短剧和编导的可以看看获奖作品的叙事和后期处理思路。
点击打开原文,能否访问取决于网络环境
08
@Thom_Wolf
Hugging Face 联创 Thomas Wolf 宣布推出 Microduck,一款 25 厘米、15 个执行器的开源双足机器人,配备摄像头、扬声器、LiDAR 等传感器,支持用户通过强化学习自行训练。它开箱即用,内置行走、坐下、轮滑、拾物等多项预训练策略,售价低于 400 美元。
当天有 6 家独立信源在报同一件事,属于行业动向本身。对具体创作流程没有直接用处,但这个量级的消息值得知道。
点击打开原平台查看,能否访问取决于网络环境
09
@alibaba_cloud
阿里云Qwen Conference Hong Kong 2026落幕,吸引600+行业领袖、16个解决方案展台。会上展示Qwen3.8-Max、QwenWork、Wan3.0、Qwen-Image-3.0等模型,官方释放信号:Agentic AI已从可能性走向生产落地。活动获AMD、Cyberport等合作伙伴支持。
阿里云官方复盘香港站大会,核心信号是Agentic AI从概念走向生产落地。做AI短剧或内容整合的可以关注QwenWork、Wan3.0这些模型在业务场景里的实际接入,但这条本身是活动总结,信息密度一般。
点击打开原文,能否访问取决于网络环境
10
@Alibaba_Wan
阿里 Wan 官方发起「Wan Skill Challenge」技能挑战赛:创作者用 Wan 做出作品后,将其封装为技能并发布到 Wan Video 的 Skills 平台,每周评选 3 个最佳技能,每位获奖者获得 1 个月 Wan 高级会员。活动面向所有 Wan 用户,鼓励把单次创作沉淀为可复用的技能模板。
做 AI 短剧和工具链的可以关注,把 Wan 玩法沉淀成技能模板,既能拿一个月会员,也是给团队攒可复用工作流的机会。
点击打开原文,能否访问取决于网络环境
01
@magnific
@magnific 发布 MiniMax H3 Max 实测:用一段 16:9 电影级提示词生成 15 秒 techno-disaster 喜剧短片,包含三个精确镜头、原生同步英语对白和完整音效设计,场景为蓝色水电站控制大厅内的巨型铜感应线圈。提示词结构完整,可直接复用。
一条带完整 prompt 的 H3 Max 实测,15 秒三镜头带原生对白和音效,做短剧和视觉的可以直接抄这个提示词结构跑一遍。
点击打开原平台查看,能否访问取决于网络环境
02
Luma AI Blog
Luma AI 官方博客发布教程,提供 8 条 AI 角色提示词模板,解决同一角色在多个镜头中保持一致性的问题。教程面向 AI 视频创作者,重点在于通过提示词工程控制角色外观、服装、发型等视觉特征,使其在连续镜头中不漂移。
官方出的角色一致性提示词模板,做短剧和视觉的可以直接套用,省去自己反复试 prompt 的时间。
点击打开原文
03
@magnific
Magnific 官方分享 AI 视频中文字稳定的四条提示词技巧:将需要显示的文字用引号精确框出;明确说明文字位置(如杯子上、屏幕上);保持字符串简短,句子易碎而标签不易;靠近需要阅读的文字时放慢镜头。
做 AI 视频的都知道文字容易飘,这条给了四条实操口诀:引号框住原文、说清位置、短句优先、镜头放慢。视觉师和后期可以直接收藏当 prompt 模板用。
04
@magnific
Magnific 官方分享单条提示词内构建叙事升级的方法:给镜头编号并打时间戳、全程保持一个元素恒定、只升级一个变量而非多个、把揭示放在最后两秒。
做 AI 短剧和编导的可以收藏这条,讲的是怎么在一条提示词里写出有层次的升级戏:镜头编号、固定一个元素、只升级一个变量、最后两秒揭晓。
05
@GeneralistAI
Generalist AI 官方发布 GEN-1.5 物理提示词可控性示例,展示相同环境下不同提示词产生不同行为,并附博客文章链接。
官方演示物理提示词如何控制画面行为,做 AI 视频的可以看看提示词怎么影响生成结果,当个参考。
点击打开原平台查看,能否访问取决于网络环境
06
@pika_labs
Pika 官方账号发布对比演示:用同一 prompt 生成两段自拍视角视频,分别由 WAN 3.0 和 Seedance 2.5 完成,重点展示模型模拟 UGC 内容(如意外猫闯入)的临场感与真实度。
两条模型生成同一 prompt 的自拍视频,模拟 UGC 的临场感是看点,做短剧和视觉的可以拉片对比两家在真实感上的差距。
点击打开原平台查看,能否访问取决于网络环境
07
@meAsifAi
M. Asif 分享一套超写实 3×3 摄影肖像联系表提示词,核心是身份锁定:九个画面保持同一年轻女性,锁定面部结构、脸型、灰绿色眼睛、肤色等特征,禁止身份漂移和换脸。九个候选瞬间覆盖咖啡馆、书店、户外等场景,统一黑色针织上衣造型。适合用来测试图像模型在多人格/多机位下的角色一致性表现。
做角色一致性测试的视觉师可以直接抄这套提示词,九个机位锁定同一张脸,跑一遍就知道模型身份漂移控制得怎么样。
点击打开原文,能否访问取决于网络环境
08
@Framer_X
Framer(@Framer_X)公开发布一段 9 分钟完整教程,讲解如何为 AI 角色创建最佳唇同步效果。教程面向 AI 角色动画制作,覆盖从口型匹配到同步优化的完整流程,适合 AI 短剧、虚拟主播和角色动画后期环节直接参考使用。
做 AI 短剧和虚拟角色的后期可以收藏,9 分钟讲清唇同步工作流,直接照着跑一遍。
点击打开原平台查看,能否访问取决于网络环境
09
@Dora_Rabbit_
个人开发者「兔崽 Dora」开源了一个 SKILL(personal-ip-image-pack),可产出多种风格的 IP 形象,并支持用户自行添加任意形象到其中,代码托管在 GitHub。
个人开发者开源了一个能产出多种风格 IP 形象、还支持自定义形象加入的 SKILL,做角色 IP 和视觉开发的可以拉下来跑一遍看风格覆盖度。
点击打开原平台查看,能否访问取决于网络环境
10
@KinGao476942
开发者 Kin 开源一个 Agent Skill(GitHub: KinGao294/wechat-video-skill),让 Claude Code / Codex / Cursor 等 Agent 学会自动下载微信视频号视频,输入链接几秒后返回无水印 MP4 到微信/飞书,全程本机运行、登录态不出设备,完全免费。
做 AI 短剧和素材收集的可以装一个,把视频号链接丢给 Agent 几秒出无水印 MP4,省掉手动扒素材的功夫。
点击打开原文,能否访问取决于网络环境