01
@alibaba_cloud
阿里云官方介绍 Wan3.0 视频生成模型(该产品 8 月 7 日已发布),评测者称其质量持续高水准而非偶发,相较 Wan2.7 是全新模型。支持文生视频(T2V)、图生视频(I2V)和参考生视频(R2V),现已上线 fal 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。评测还分享了 30 秒视频生成时代的提示词技巧。
阿里云 Wan3.0 已上线 fal 平台,评测称质量稳定高水准,支持 T2V/I2V/R2V 三种模式,并开放 API。做 AI 视频的可以上手实测,对比 Wan2.7 看废片率降了多少。
点击打开原平台查看,能否访问取决于网络环境
02
Hacker News 热门
通义千问宣布 Qwen 3.8-Flash-Next 将于 2026-08-26 15:00(UTC)发布,参数规模 125B a6B,是基于下一代 Qwen4 架构的多模态 MoE 模型,提前放出架构进展为 Qwen4 家族预热。模型页面已上线 ModelScope,将开源 Qwen3.8-Flash-Next 及 FP8 版本。
通义千问新一代架构的先行版,125B 参数多模态 MoE,明天下午 3 点开源。做工具链整合的可以蹲一下,看能不能接进自己的生成流程。
点击打开原文
03
@elevenlabs
ElevenLabs 发布 Composer,一款分段式歌曲编辑器。支持从自己的歌词、已有音轨、空白页或一句提示词开始创作,然后逐段(section-by-section)塑造整首歌直至完成。面向音乐制作与声音创作场景,适合需要精细控制歌曲结构的创作者。
做 AI 短剧配乐和后期声音的可以直接上手试,分段编辑比整首生成好控制,能按段落打磨到满意为止。
点击打开原平台查看,能否访问取决于网络环境
04
Hacker News 热门
苹果发布搭载 M6 与 M5 Pro 芯片的新款 Mac mini。M6 版 AI 性能较 M4 提升最高 4 倍,CPU 快 40%,存储与图形性能翻倍;M5 Pro 版支持最高 64GB 统一内存与 307GB/s 带宽,LM Studio 中 LLM 提示词处理较 M2 Pro 快最高 8.5 倍,Blender 光线追踪渲染快 4.5 倍。两款均支持 Wi-Fi 7、蓝牙 6 与 2.5Gb 以太网,今日起预购,9 月 22 日开售。
做 AI 视频和短剧的,本地跑模型、批量渲染的硬件底座升级了,M6 版 AI 性能较 M4 提升最高 4 倍,M5 Pro 版 LLM 提示词处理较 M2 Pro 快最高 8.5 倍,预算够的可以蹲 9 月 22 日开售。
点击打开原文
05
IT之家
苹果发布 M5 Ultra 芯片,首次采用 UltraFusion 四芯片架构,最高 36 核 CPU、80 核 GPU,统一内存带宽 1.2 TB/s(比 M3 Ultra 高 50%),支持 512GB 统一内存,可在设备端运行数千亿参数大模型。AI 峰值 GPU 性能较 M3 Ultra 提升最高 4.5 倍,图形性能提升 40%,配备四路 ProRes 编解码引擎和硬件加速 AV1 解码,面向 3D 渲染、视觉特效和本地 AI 推理场景。
做 AI 视频和 3D 渲染的团队,本地跑大模型和重渲染的硬件天花板又抬高了,换机前值得看一眼参数。
点击打开原文
06
@perplexity_ai
Perplexity 发布 Portable Computer,这是 Perplexity Computer 的完全本地版本,整个运行时(调度 LLM、子代理 LLM、代理框架)都在本地硬件上运行,无云端依赖,支持 NVIDIA DGX Spark。对 AIGC 创作者来说,这意味着 Agent 工作流可脱离云端在本地跑,适合对数据隐私和成本敏感的场景,但当前与影视创作流程的直接关联有限。
本地化 Agent 运行时,不依赖云端,做自动化工作流的整合者可以关注,但对拍片创作本身影响有限。
点击打开原文,能否访问取决于网络环境
07
@tim_cook
苹果 CEO Tim Cook 官宣全新 Mac mini 发布,主打体积小巧、性能强劲,官方强调其能胜任从日常生产力到各类 AI 应用的任务。具体芯片型号、内存配置和价格未在推文中披露。对 AI 创作者来说,新款 Mac mini 的本地 AI 推理和视频处理性能值得关注,但具体规格需查看官方详情页。
苹果官方发布新款 Mac mini,主打小体积高性能和 AI 应用支持。做 AI 视频和本地推理的后期、技术整合者可以关注硬件升级对本地工作流的影响。
点击打开原平台查看,能否访问取决于网络环境
08
@SenseTime_AI
商汤官方介绍 SenseNova U1.5 Lite(该产品 8 月 22 日已发布),已开源并上线 Token 计划,提供免费公开测试,每 5 小时 1500 次请求额度。模型支持图像生成与编辑一体化,并支持参考图输入。
商汤把 U1.5 Lite 开源,还给了每 5 小时 1500 次的免费额度,做视觉和短剧的可以接 API 实测图像生成和编辑的稳定性。
点击打开原文,能否访问取决于网络环境
09
@ArtificialAnlys
Breeze TTS 2 在 Artificial Analysis Provider Voices 语音竞技场中成为排名第一的开源权重 TTS 模型,Elo 达 1215,领先 Fish Audio S2 Pro 90 分,总排名第 6。对做配音、短剧对白、有声内容的后期团队来说,开源权重意味着可本地部署、成本可控,值得实测对比现有配音方案。
开源 TTS 里目前最能打的,Elo 1215 领先 Fish Audio S2 Pro 90 分。做配音、短剧对白、有声内容的后期团队可以实测一下,开源意味着能本地部署,成本可控。
点击打开原平台查看,能否访问取决于网络环境
10
@realAkashAnand
Clueso 代理可完全自主捕获产品屏幕录像,并自动编辑视频,添加精准时机的放大效果、聚光灯突出 UI 元素,生成动态图形,产出精美的发布视频。面向产品演示和营销视频场景,主打自动化录屏与剪辑一体化。
做产品宣传片和教程的后期可以看看,自动录屏加剪辑、放大、聚光灯和动态图形,能省不少手工活。
01
@Alibaba_Wan
阿里 Wan 官方账号转发创作者 @NOSNOWISXVW 的 Wan3.0 全流程工作流分享,核心亮点是支持生成长视频,单次生成产出更多内容,创作者可按自己的意图控制故事节奏。该工作流基于 @openart_ai 平台。
官方转发的创作者实测,讲 Wan3.0 长视频生成怎么串进完整工作流,做 AI 短剧和长片的可以看看别人怎么控制叙事节奏。
点击打开原平台查看,能否访问取决于网络环境
02
@kyutai_labs
Kyutai 实验室开源 Pocket TTS 完整训练栈,包含数据工作流、训练配方和评估方法,支持在个人 GPU 上从零训练文本转语音模型,训练后可部署到任意设备的 CPU 上运行。对配音和后期团队来说,这意味着可以训练出专属音色的 TTS 模型,摆脱对云端 API 的依赖,实现本地化、低成本的语音生成。
做配音和后期音效的可以关注,官方开源了从数据到评估的完整训练流程,想自己训一个专属 TTS 模型的可以照着跑一遍。
点击打开原平台查看,能否访问取决于网络环境
03
@minuitIA
创作者 Minuit 发布 AI 短片《The Scarlet Priestess》,公开完整制作流程:Midjourney + GPT Image 2 生成画面,Seedance 2 做动态,Capcut 剪辑。附 15 秒多镜头 16:9 超写实真人电影幻想序列的完整提示词,核心设定是女祭司举杖冻结时间,雨滴、树叶、碎片悬停空中,唯她本人保持运动。提示词强调绝对摄影写实,明确排除 3D/CGI/游戏渲染质感,要求自然皮肤纹理、布料垂坠、真实重力与镜头光晕。
一条带完整提示词的 AI 短片创作分享,Midjourney + GPT Image 2 + Seedance 2 + Capcut 四工具串起来做超写实真人电影感,视觉师和编导可以直接抄提示词跑一遍看效果。
点击打开原平台查看,能否访问取决于网络环境
04
@mickmumpitz
Mickmumpitz 分享一套方法:用虚拟 360 度无人机在场景中飞行,绘制世界地图并生成合成数据集,用于高斯 splat 训练,从而将单张图像转化为可探索的 3D 世界。全程本地运行、完全免费。
把静态图变成能飞进去看的 3D 场景,本地免费跑,视觉师和做场景预演的可以收藏这套工作流。
点击打开原平台查看,能否访问取决于网络环境
05
@magnific
Magnific 官方分享跨场景一致性工作流:先单独生成一次空场景(无人物),再将其作为参考图回填到该房间的每个镜头中,实现同一厨房在三条时间线、相隔十五年的场景下保持视觉一致。
做 AI 短剧和视觉的可以学这招:先把空场景生成一次,再当参考图喂回给每个镜头,同一房间跨时间线也能保持一致性。
点击打开原文,能否访问取决于网络环境
06
@alibaba_cloud
阿里云官方发布案例:AtlasV 的 Collart 平台集成阿里云 Wan 2.7,将产品和模特静态照片转化为可扩展的高质量 AI 时尚视频,无需摄影棚,制作更快且无传统拍摄限制。Wan 2.7 可在阿里云 Model Studio 试用。
阿里云官方案例:AtlasV 的 Collart 平台把静态产品图转成动态时尚视频,做电商广告和品牌视觉的可以看这套工作流怎么落地。
点击打开原平台查看,能否访问取决于网络环境
07
@fabianstelzer
创作者 fabian 分享用 MiniMax H3 video2video 功能,将人物视频背景替换为车内(或城堡等)场景,并保留原始音频与唇同步。该功能通过 Glif 技能链接提供,适合短视频创作者快速制作场景变换内容。
用 MiniMax H3 的 video2video 把人物换到车里或城堡,音频和唇同步保留得不错,做短视频和短剧的可以拿这个 Glif 技能跑一遍试试。
点击打开原平台查看,能否访问取决于网络环境
08
@Sukiea1008
创作者 @Sukiea1008 分享解决 AI 真人剧主角图片被识别为真人面部问题的 Prompt 方案:masterpiece, best quality, 1 person, hyperrealistic but stylized, painted texture, not real photo, clean white background, character sheet, front view, soft brush strokes, slight illustration style --ar 3:4 --style raw。核心思路是通过加入 painted texture、not real photo、slight illustration style 等关键词,在保持超写实风格的同时明确区分于真实照片。
做 AI 真人剧的常被平台把主角图当真人脸卡住,这条给了现成 Prompt 模板,视觉师和短剧团队可以直接抄去跑一遍。
点击打开原文,能否访问取决于网络环境
09
@SynthesiaIO
Synthesia 官方客户案例:瑞安航空在航班延误等突发情况下,用 Synthesia 为乘客批量生成个性化通知视频,制作效率提升最高 90%,并支持多语言本地化分发。
Synthesia 官博客户案例:航班延误时给乘客发定制视频通知,制作提速 90%。做企业级 AI 视频交付的团队可以看这套批量生成+多语言本地化的流程怎么落地。
点击打开原平台查看,能否访问取决于网络环境
10
Claude
Anthropic 市场团队成员 Adam Ward 分享用 Claude Code 将每周销售报告转化为每位客户经理的个性化周一简报。通过 MCP 连接 BigQuery 和 CRM 数据,依据销售与经理反馈迭代提示词,加入"绝不编造 URL"等九条内容规则。该简报已推广至所有销售团队,每周一自动发送三条优先行动项及账户相关活动。
做 AI 工作流整合的可以看:用 Claude Code 接 MCP 连数据库和 CRM,把周报变成自动化的个性化简报,思路能直接搬到内容分发和客户运营场景。
点击打开原文
01
@pika_labs
Pika 官方账号发布一条由 Wan 3.0 单次生成(one generation)完成的短片,官方评价其准确理解了荒诞冷幽默(surreal deadpan comedy)的叙事意图。短片已发布可观看,属于单次生成叙事能力的官方演示。
Pika 官方用 Wan 3.0 单次生成讲完一个荒诞冷幽默故事,做 AI 短剧的可以点开看单次生成能承载多少叙事量。
点击打开原平台查看,能否访问取决于网络环境
02
@LumaLabsAI
Luma 官方账号转发创作者 Bryan Soegondo(@DreamLabLA)用 Luma 制作的 AI 短片《L'heure Bleue》,蓝调时刻一名杀手穿过大理石地板执行任务,主打光影氛围与叙事张力。
Luma 官方转发的 AI 短片,蓝调时刻杀手题材,做 AI 短剧的可以拉片看光影氛围和叙事节奏怎么用提示词带出来。
点击打开原平台查看,能否访问取决于网络环境
03
@magnific
Magnific 官方发布一条 AI 短片 demo:一位在灯塔独居 41 年的女性,人脸、声音、风声和房间环境音全部由 MiniMax H3 MAX 在单次 10 秒生成中完成。同时宣布 Magnific 平台限时 48 小时提供 MiniMax H3 MAX 无限量使用。
一条 10 秒的 AI 短片 demo,亮点是单次生成就把人脸、声音、风声和房间环境音全包了,做 AI 短剧和后期配音的可以看看这种全要素一次出的效果稳不稳。
点击打开原平台查看,能否访问取决于网络环境
04
@emmanuel_2m
创作者 Shaun 用 Scenario 平台制作了一部近的 AI 短片,被同行 @emmanuel_2m 评价为保持了惊人的连贯性,且讲述了一个真正感人的故事。该短片展示了在长叙事中避免常见 AI 伪影和垃圾内容的可能性。
有人用 Scenario 做出近连贯 AI 短片,被同行夸故事感人。做 AI 短剧的可以点开拉片,看长叙事下怎么压住 AI 垃圾和伪影。
点击打开原平台查看,能否访问取决于网络环境