01
@testingcatalog
字节跳动推出 SeedRealtime,原生音视频全双工大语言模型,统一架构融合音频、视频与文本,支持连续多模态流上的实时交互,可同时看、听、说,对标 GPT Live。已免费上线豆包 App,支持语音和视频对话。对 AI 配音、虚拟角色对话、实时互动短剧团队来说,这是可直接体验的实时多模态交互方案,值得上手测交互延迟和自然度。
字节把音视频全双工对话模型免费塞进豆包,能边看边听边说,对标 GPT Live。做 AI 配音、虚拟角色对话、实时互动短剧的可以直接上手试,看交互延迟和自然度够不够用。
点击打开原平台查看,能否访问取决于网络环境
02
@alibaba_cloud
阿里云发布 Qwen-Image-3.0-Pro,在 Text-to-Image Arena 以 1263 分位列全球第 5,较前代 Qwen-Image-2.0-Pro 的 1191 分(第 15 名)大幅跃升。模型已在阿里云 Model Studio 和 Qwen Cloud 开放试用及 API 调用。对视觉师和美术来说,这是文生图能力的一次显著升级,值得实测出图风格和一致性;对技术整合者来说,API 已开放,可直接接入创作流水线。
阿里云官方发布 Qwen-Image-3.0-Pro,Text-to-Image Arena 1263 分排全球第五,比前代跳了 10 名。做视觉和美术的可以接 API 实测出图质感,做工具链的看它和 Model Studio 的集成。
点击打开原文,能否访问取决于网络环境
03
IT之家
京东开源实时流式视频编辑模型 JoyAI-Video-Edit,基于自研 JoyAI-Video,720P 分辨率下实现每秒 30 帧推理,支持任意时长稳定流式编辑,可边播放边修改人物、场景、物体与风格。在 OpenVE-Bench 通用评测中超越 SANA Streaming、LiveEdit 等所有流式编辑方法,全局风格、局部替换、局部删除、字幕编辑任务优势突出。已开源至 HuggingFace 与 GitHub。
720P 下 30 帧/秒推理、支持任意时长边播边改,后期和视觉师可以接开源代码实测,看实时改场景换服装的稳定性。
点击打开原文
04
@JeffDean
Jeff Dean 在谷歌任职 27 年后宣布离职,明日正式离开。他称谷歌已从 25 人发展到 19 万余人,拥有十三款用户超十亿的产品。他将与 Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 共同创办 DiscoLoop AI。
AI 圈人事大地震,Jeff Dean 27 年谷歌生涯落幕,新公司方向未明。做 AI 的可以关注后续,但对创作工作流暂无直接影响。
点击打开原文,能否访问取决于网络环境
05
@higgsfield_ai
Higgsfield 全球电影节宣布,曾掌镜《极速车王》《当幸福来敲门》《芝加哥七君子审判》的摄影指导 Phedon Papamichael 加入评审团。他是 2 次奥斯卡提名、2 次 BAFTA 提名得主,也是 ASC 成员,将参与首届电影节评审。
《极速车王》摄影指导 Phedon Papamichael 出任 Higgsfield 全球电影节评委,做 AI 影像的可以关注这个赛事的评审口味和获奖标准。
点击打开原平台查看,能否访问取决于网络环境
06
@xingsthatmatter
Sophia Xing(@xingsthatmatter)与 Joey Daoud(@C47)对谈,讨论 AI 剧、混合 AI,以及观众和制片厂如何应对这个讲故事的新时代。对谈提到上月有超 1 万部全 AI 制作的剧集上线,且用户付费意愿高于 Netflix。Sophia Xing 是 AI 微短剧制作公司 CEO,该公司同时销售相关工具。
做 AI 短剧的可以听听头部公司 CEO 怎么判断观众和制片厂的态度,顺带了解全 AI 剧的付费情况。
点击打开原平台查看,能否访问取决于网络环境
07
@MiniMax_AI
MiniMax 官方账号转发员工 RyanLeeMiniMax 的推文,称模型发布首日及前 48 小时属于开源社区,并点名感谢 ComfyUI 等工具的接入。这是对社区生态响应的致谢表态,非新功能发布。
MiniMax 官方转发自家员工推文,感谢开源社区在模型发布首日就接入 ComfyUI 等工具。做工具链整合的可以看看社区生态的响应速度。
点击打开原文,能否访问取决于网络环境
01
Runway
Runway 官方客户案例:Chime 执行制片人 Shayla Love 透露,团队用 Runway 定制工作流,将原本需约 30 万美元、涉及 80 多名真实会员的电视广告尾卡制作压缩至 3 万美元以内,几乎无制作开销。该工作流将质量参差的 UGC 照片转化为稳定、达到电视播出标准的动态画面。团队还计划用 Runway 制作概念故事板,以加速广告审批流程。
Runway 官方客户案例,制片人最该看:80 人实拍尾卡被定制工作流压到 3 万美元内,还计划用 AI 做概念故事板加速审批。做商业广告和品牌片的团队可以直接套这个降本思路。
02
@magnific
Magnific 官方演示:在 Magnific Space 内凭空虚构一个辣酱品牌,完成品牌命名、瓶身设计和电视广告拍摄全流程,并附教程与 prompt。对视觉师和广告导演来说,这是一套从零到成片的品牌广告工作流参考。
官方演示从零造品牌、设计瓶身到拍出 TVC 的完整流程,附教程和 prompt,做广告和视觉的可以直接抄作业跑一遍。
点击打开原平台查看,能否访问取决于网络环境
03
@magnific
Magnific 官方账号展示 MiniMax H3 的 FPV 无人机运镜能力:单条连续镜头穿越丛林、水下洞穴、水晶洞和浮空遗迹,所有运镜、速度、转场均由 prompt 控制,现已上线 Magnific 平台。
一条连续镜头穿越丛林、水下洞穴、水晶洞和浮空遗迹,运镜、速度、转场全写在 prompt 里。做 AI 短剧和视觉的可以拉片看 H3 的镜头控制上限,想复现的可以直接抄 prompt 思路。
点击打开原平台查看,能否访问取决于网络环境
04
@AYi_AInotes
深度体验大模型纯代码建模:用自然语言描述需求,十几分钟即可得到基于 Three.js 加 Cannon-es、零依赖、可交互的 3D 物理原型,具备真实刚体物理与电影级渲染。作者认为 SolidWorks、Fusion、AutoCAD 将从必备建模工具沦为 AI 生成后的后处理工具,早期验证成本从几周压到几十分钟。
用自然语言十几分钟出可交互 3D 物理原型,做工业设计验证、数字孪生、游戏原型的可以上手跑一遍,看纯代码建模能不能替代传统 CAD 早期验证。
点击打开原平台查看,能否访问取决于网络环境
05
@CharaspowerAI
创作者 @CharaspowerAI 分享用 Agent Two 以电影工作室方式工作:输入剧本和制作资产,产出 1 分 15 秒科幻电影级序列,Agent Two 全程记住每个角色、生物和场景。
把 Agent Two 当电影工作室用,从剧本到成片一条链路,角色和场景记忆贯穿全程。做 AI 短剧和编导的可以点开看这条工作流怎么跑通的。
点击打开原平台查看,能否访问取决于网络环境
06
@Khazix0918
数字生命卡兹克开源「活人感写作.skill」,针对2026年AI写作普遍存在的「AI味」问题,提供一套去除AI腔的写作方法论。该skill面向所有依赖AI生成文字内容的创作者,旨在让AI产出的文字更接近人类自然表达。
做AI短剧和编导的,剧本和旁白最容易一股AI腔,这个skill直接拿来套用,能省不少改稿时间。
点击打开原文,能否访问取决于网络环境
07
@Tono_Ken3
TonoKen3 将 MiniMax-H3 文本编码器重新量化至 NVFP4,体积从 26.4GB 降至 15.7GB,实测峰值占用 9.9GB VRAM,可在单张 16GB 显卡运行,可直接替换官方 Comfy-Org NVFP4 编码器。基于 ethanfel 的 Heretic 权重构建,重新量化前需对 ConvRot 权重反旋转,否则输出与提示无关。
把 26.4GB 的 MiniMax-H3 编码器压到 15.7GB,单张 16GB 显卡就能跑,做本地 ComfyUI 工作流的可以直接替换官方 NVFP4 编码器,省显存还带无审查权重。
点击打开原文,能否访问取决于网络环境
08
@Changfuncafe
创作者 Changfuncafe 用 Seedance 2.5 制作两段各 30 秒的片段,之后手工剪辑,剪掉了动作不自然的部分。目标是复刻《300》式慢动作战斗编排,做一个不间断的长镜头,带速度渐变,场景是温暖的阳光洒在寒冷雪地上。作者表示如需提示词可在评论区留言,之后会分享。
个人实测分享:Seedance 2.5 两段 30 秒长镜头手工剪辑,动作不自然的部分直接剪掉,目标复刻《300》式慢动作战斗编排。做动作戏和长镜头的可以看看这个剪辑思路。
点击打开原平台查看,能否访问取决于网络环境
09
@gdb
OpenAI 联合创始人 Greg Brockman 用 Codex 应用协助运营业务,让 AI 自动完成广告投放全流程:剪辑视频、发布内容、建立受众、设置预算,并在点击付款按钮前停下请求人工许可。他全程在应用内实时观看整个执行过程。
OpenAI 联合创始人 Greg Brockman 用 Codex 跑自家广告,从剪片、发布到设预算全自动,只在付款前停下征求同意。做 AI 制片和工具链整合的可以看看 Agent 在真实商业场景里的自动化边界。
点击打开原平台查看,能否访问取决于网络环境
10
@emollick
Ethan Mollick 演示 Codex 自主开发游戏:输入一句话需求(玩家扮演水獭,可进入动物形状机甲服),Codex 自动调用 Blender 和 Unity,生成完整游戏素材并接管电脑完成制作。展示了 AI Agent 从需求到成品的全自动开发能力。对创作者来说,这类 Agent 能力可迁移到自动化生成视觉素材、批量处理媒体文件等创作流水线环节。
Ethan Mollick 演示 Codex 自主调用 Blender 和 Unity 做完整游戏,从一句话需求到成品全自动。做 AI 短剧和视觉的可以看看 Agent 自主完成复杂任务的边界在哪。
点击打开原平台查看,能否访问取决于网络环境
01
@WonderStudiosX
WonderStudios 发布 AI 短片《One story, a hundred directions》,演示同一故事的多方向分支叙事,使用 HappyHorse 1.1 与 Wan2.7 模型制作,并开放阿里云 Model Studio 与 Qwen Cloud 的 API 接入。
做 AI 短剧和互动叙事的可以点开看,一个故事多方向分支的叙事结构,配合 HappyHorse 1.1 和 Wan2.7 的成片效果,值得拉片拆解分支叙事怎么落地。
点击打开原平台查看,能否访问取决于网络环境
02
B站「AI 短片/短剧/视频」搜索
B站UP主发布的AI短剧《我的兄弟是女神》,题材为性别互换喜剧,讲述好兄弟变成女生的故事。视频标注含AI生成内容,为个人创作者作品,篇幅为短片。
B站个人创作者的AI短剧,题材是兄弟变女生的性别互换喜剧,做AI短剧的可以拉片看这类轻喜剧题材的叙事节奏和角色一致性处理。
点击打开原平台查看
03
B站「AI 短片/短剧/视频」搜索
B 站发布《功夫2》续集全原班人员 4K 修复版,标注为 AI 生成、AI 换脸修复,时长 2 小时 34 分,标题自称全网最清晰,并注明仅作测试用。属于老片 AI 修复与换脸技术的长片级应用案例。
老片 AI 修复+换脸的全片工程,做后期修复的可以拉片看换脸稳定性和 4K 修复效果,但版权风险高,仅作技术参考。
点击打开原平台查看
04
B站「AI 短片/短剧/视频」搜索
B站UP主「数字游牧人」发布视频《强迫两个AI互殴!》,播放量过万。内容为让两个AI进行对抗性对话的娱乐向实验,非完整叙事作品,无公开工作流细节。
标题党玩法,实际是让两个AI对话/对抗的娱乐向内容,对创作工作流参考价值有限,做AI短剧的可以当个脑洞看看。
点击打开原平台查看
05
B站「AI 短片/短剧/视频」搜索
B站作者「有史无终」发布的 AI 短片《你说说这ai怎么取代人类》,含虚构演绎内容。视频以 AI 能否取代人类为话题切入,评论区有观众误以为画面人物是真人,侧面反映角色写实度较高。
B站个人创作者作品,标题带争议性话题,播放量高但内容偏观点表达,对创作工作流参考价值有限,可当话题风向标看看。
点击打开原平台查看