← 全部日报

AIGC 信息日报

2026 年 8 月 15 日 周六

行业与平台

Industry

阿里云开源 Qwen3.8 系列,27B 多模态模型超越 3.7-Plus

阿里云开源 Qwen3.8 系列模型。Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已发布。对创作者来说,Apache 2.0 许可意味着可自由商用和二次开发,多模态能力可接入图像理解、视频内容分析等创作辅助流程。

开源多模态模型,27B 参数原生支持 262K 上下文,Apache 2.0 许可随便商用。做 AI 短剧和视觉的可以接 API 或本地部署,跑一遍看多模态理解和长上下文对创作工作流有没有实际提升。

点击打开原文,能否访问取决于网络环境

智谱发布 GLM-5.3:编程能力开源第一,权重两周后开源

智谱发布 GLM-5.3,基于与 GLM-5.2 相同的基座,通过后训练 Scaling 提升智能上界。编程能力较前代提升 50%,在 Terminal Bench 3.0 等公开基准中取得开源第一,接近 Claude Fable 5。模型在白盒代码审查等安全任务中表现持平 Mythos 5,在 CyberGym 测试中得分 84.5%。模型权重将在两周后开源,即日起上线 ZCode、AutoClaw 等工具。

编程能力开源第一,还涌现出网络安全能力,做 AI 工具链和自动化工作流的可以关注,权重两周后开源,届时可接入自建工作流实测。

点击打开原文,能否访问取决于网络环境

美团 LongCat-2.0 上线 Nous Portal 免费体验一周

美团 LongCat-2.0 上线 NousResearch 门户,可免费搭配 Hermes Agent 试用一周。1.6T 参数 MoE 模型,1M 上下文窗口,专为智能体编码打造,Terminal-Bench 2.1 得分 70.8,可一次性处理整个代码库。对 AIGC 技术整合者来说,这类强编码 Agent 模型可用于搭建自动化媒体处理、批量生成与发布流程,值得实测其工具调用与长上下文能力。

1.6T 参数 MoE 编码模型,1M 上下文能一次吞下整个代码库,Terminal-Bench 2.1 得分 70.8。做 AI 自动化剪辑、批量处理工作流的技术整合者可以接 Hermes Agent 免费试一周,看能不能把媒体处理流程自动化。

点击打开原平台查看,能否访问取决于网络环境

Dreamina API 将于 8 月 17 日登陆 BytePlus

BytePlus 官方宣布 Dreamina 的 API 将于 8 月 17 日在其平台上线,并附带限时上线优惠。对做 AI 短剧和批量视觉生产的团队来说,这意味着多了一个官方 API 接入渠道,可纳入自动化工作流评估。

字节的 API 渠道要上 Dreamina 了,做短剧和批量出图的团队可以蹲一下 8 月 17 日的上线价,接 API 跑自动化流程。

点击打开原文,能否访问取决于网络环境

Qwen 27B 模型可在 17GB 内存运行

阿里 Qwen 官方账号发文,确认 27B 参数模型可在 17GB 内存环境下运行,并感谢 @UnslothAI 的优化支持。这意味着本地部署大模型的硬件门槛显著降低,个人创作者和中小团队无需高端显卡即可在本地运行 27B 级模型,适合本地批量生成、私有化部署等场景。

Qwen 官方确认 27B 模型能在 17GB 内存跑起来,本地部署门槛大幅降低,做 AI 短剧和视觉的团队可以低成本本地跑模型,不用全依赖云端 API。

点击打开原文,能否访问取决于网络环境

Cursor 被 SpaceX 收购,加入 Grok 团队

Cursor 正式被 SpaceX 收购,加入 SpaceXAI 团队,共同打造 Grok 为全球最实用的 AI,并改进 Grok Build、Grok Bot、Grok API 及 Cursor 等产品。Lee Robinson 表示团队势头正盛,Grok 4.6 与 Grok Bot 进展加速。

行业大新闻:Cursor 并入 SpaceX 搞 Grok,跟 AI 编程工具生态强相关,但跟影视创作工作流关系不大,工具党可扫一眼。

FLORAai 推出 Fashion Studio:草图一键生成服装实拍渲染

FLORAai 发布 Fashion Studio,面向时尚行业:将手绘草图转化为服装实拍级渲染图,支持快速迭代面料与款式方案,主打降低时尚行业创意门槛。

做 AI 视觉和电商素材的可以看看,草图直接出服装实拍渲染,面料迭代也快,适合批量出款和概念验证。

点击打开原平台查看,能否访问取决于网络环境

OpenRouter 上线 Ori Prime Agent,直连 500+ 模型

OpenRouter 今日发布 Ori Prime Agent,可直接在 OpenRouter 上运行 PrimeIntellect Agent,支持访问 500+ 模型、自带凭证和环境配置,提供一键安装命令。对 AIGC 技术整合者来说,这意味着多模型调用和 Agent 调度的入口更统一,适合批量生成和自动化工作流测试。

OpenRouter 把 PrimeIntellect Agent 接进自家平台,一条命令就能在 500+ 模型上跑 Agent,做工具链整合的可以接 API 试一周看自动化效率。

点击打开原平台查看,能否访问取决于网络环境

Qwen3.8-27B 上线 vLLM,单卡支持百万上下文

Qwen3.8 同日在 7 个第三方平台上线可用:Together AI / Modal / DeepInfra / Ollama 本地可跑 / DigitalOcean无服务器推理 / vLLM / Nebius Token Factory。

Qwen3.8 当天在这 7 个平台都能用上,按手上已开通的账号挑一个直接测,不用等单一渠道。

点击打开原文,能否访问取决于网络环境

阿里云AI电影节征集3-5分钟短片,最高奖7500美元

阿里云新加坡举办 WonderClip × GenTube AI 电影节,面向全球征集 3-5 分钟 AI 短片,主题为「共同创造——你、我与 AI 的故事」,最高奖金 7500 美元。报名 8 月 13-23 日,提交 8 月 24-31 日,获奖名单 10 月 8 日在 AICon 2026 公布。

阿里云新加坡办的AI短片赛,主题明确、奖金7500美元、全球开放,做AI短剧和编导的可以当个练手和曝光机会,报名窗口就十天。

点击打开原文,能否访问取决于网络环境

Fish Audio 语音模型 S2.1 Pro 登陆日本

Fish Audio 宣布其语音模型 S2.1 Pro 在日本上线,主打日语场景,强调对 pitch accent、韵律、敬语及日英句内切换的处理能力,已在东京出租车内被听到。

做日配、日文字幕或日剧 AI 配音的后期可以关注,S2.1 Pro 主打日语声调、敬语和中英混说处理,接 API 试一段就知道效果。

点击打开原平台查看,能否访问取决于网络环境

工具与能力

Tools

阿里 Wan 上线 Agent Skills 自定义工作流

阿里 Wan 视频平台上线 Agent Skills 功能,支持探索社区构建的 Skills,或创建自定义工作流并分享,覆盖短剧生成器、MV 生成器等场景,可将创意转化为可复用的创作流程。

阿里 Wan 把 Agent Skills 搬上视频平台,支持社区共享和自定义工作流,短剧生成器、MV 生成器这类模板可以直接套用,做短剧和批量出片的团队值得上手试。

点击打开原平台查看,能否访问取决于网络环境

Magnific Designer 集成 Auto Layers 2.0 图层拆分

Magnific 官方宣布 Auto Layers 2.0 已完全集成进 Magnific Designer,对所有用户开放。该功能可将任意图像自动拆分为可编辑的独立图层(主体、文字、Logo、背景),支持上传或生成图像后逐层分离,并可对每层进行移动、重设样式或重建。

做视觉和海报的可以直接上手试:一张图自动拆成主体、文字、Logo、背景四层,改版式不用重画,省掉手动抠图的时间。

点击打开原平台查看,能否访问取决于网络环境

Pika 音频模型推理效率提升,成本降低 20 倍

Pika 官方宣布其音频模型(Soundtrack、Music、SFX、Speech)通过高效推理技术,将生成成本降至其他音频模型的 1/20,主打大规模可负担的音频生成。对 AI 后期和短剧团队来说,这意味着批量配音、配乐、音效的边际成本大幅下降,适合接入现有工作流测试实际出片质量与稳定性。

做 AI 短剧和后期配音的可以关注,音频成本降 20 倍意味着批量出片时音轨预算能省一大截,值得接 API 实测一轮。

点击打开原文,能否访问取决于网络环境

GPT-5.6 Sol 预览超快模式提速14倍

OpenAI 联合创始人 Greg Brockman 宣布 GPT-5.6 Sol 预览超快模式,速度最高提升至 14 倍。该模式将首先在 OpenAI API 中向部分客户开放,随着算力增长逐步扩大至更多企业。对 AIGC 创作者来说,这意味着未来批量生成、自动化处理任务的等待时间有望大幅缩短,但当前仅限部分 API 客户,普通用户暂不可用。

OpenAI 给 GPT-5.6 Sol 加了超快模式,速度最高 14 倍,先对部分 API 客户开放。做批量生成、自动化剪辑流程的可以关注下 API 开放进度,能省不少等待时间。

点击打开原平台查看,能否访问取决于网络环境

Gemini 3.7 Flash 向 Pro 与 Ultra 用户开放

Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放,提升了多步骤任务的推理与准确性,如整合数十个文件和邮件为一份主文档。Gemini Spark 也已运行于 3.7 Flash,改进了对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。对创作者来说,可将其用于素材整理、脚本初稿生成等文本处理环节,提升前期工作效率。

Gemini 3.7 Flash 上线,多步骤推理和工具调用增强,做 AI 短剧或内容生产的可以试试用它整合素材、生成脚本初稿,省点整理时间。

点击打开原平台查看,能否访问取决于网络环境

Krea 向企业客户免费开放无限额度至 8 月 21 日

Krea 官方宣布向所有企业客户提供无限额度,现有客户可前往指定链接在 Slack 工作区安装 Krea 并免费使用,活动持续至 8 月 21 日。

Krea 给企业客户送免费无限额度,还接进了 Slack,做 AI 视觉和团队协作的可以顺手装一个,免费期到 8 月 21 日。

点击打开原文,能否访问取决于网络环境

方法与经验

Methods

novel-storyboard 分镜 skill 开源,AI 短剧五件套收官

作者「烁皓」开源分镜 skill「novel-storyboard」,至此其 AI 短剧五件套(角色、大纲、场景、剧本、分镜)全流程开源。该 skill 将剧本节拍切成「段→分镜」,一段对应一次视频生成(≤15 秒),段内 3–5 刀、每刀 2–5 秒;两人对话正反打(全景/A 近景/B 近景)可一段内一次生成;每段单独打包成文件夹(关键帧图+提示词),可直接批量喂给视频模型。

做 AI 短剧的可以直接拿去跑:一本小说拆到关键帧+提示词,正反打一次出齐,每段打包成文件夹批量喂视频模型,省掉大量手工分镜时间。

点击打开原文,能否访问取决于网络环境

Runway 展示 Quigo:视频转可玩互动游戏

Runway 官方展示创作者 Parikshit Singh Bhati 的 Quigo 项目:把视频转成可玩的互动游戏,在应用内逐场景生成、用选择连接场景、发布链接即可分享。官方定位适用于培训、广告、教育或个人故事游戏化。

Runway 官方展示的互动叙事案例,把视频场景串成带选择的游戏,做短剧和互动叙事的可以看看这个形态能不能套到自己的项目上。

点击打开原文,能否访问取决于网络环境

硅基流动实测:DeepSeek V4 Flash 0.1美元完成8项开发任务

硅基流动实测 DeepSeek V4 Flash 0731,4 小时内以 0.1 美元成本完成 8 项真实开发任务,包括修复 3 个 bug、从零构建含 6 个 KPI 卡片和 7 张图表的成本分析仪表盘,并编写运行 18 个单元测试和 28 个 E2E 测试,还生成了 API 文档、变更日志、PR 描述及 8 页报告。

做 AI 自动化生产工作流的技术整合者可以看:0.1 美元跑完 8 项真实开发任务,成本数据很实在,能直接用来评估把 DeepSeek V4 Flash 接进批量生成流程的性价比。

点击打开原平台查看,能否访问取决于网络环境

Seedance 2.5 动画提示词指南:实测四种风格

Magnific 官方发布 Seedance 2.5 动画提示词指南,实测黏土动画、定格动画、2D 和 3D 四种风格,提示词已公开。对 AI 视觉师和动画创作者来说,可直接套用这些经过验证的提示词模板,快速实现不同动画风格。

做 AI 动画和视觉的可以直接抄作业,四种风格(黏土、定格、2D、3D)的提示词都实测过,收藏当模板用。

点击打开原平台查看,能否访问取决于网络环境

MiniMax H3 多角色一致性实测:全剧组跨场景保持

Magnific 官方账号用 MiniMax H3 测试多角色一致性,让整个剧组角色在多个场景中保持形象统一,并附带了示例和 prompt。对做 AI 短剧和角色 IP 的创作者来说,这是验证 H3 多角色一致性能力的直接参考,可套用其 prompt 思路跑自己的项目。

用 MiniMax H3 做多角色短剧的可以点开看,官方给了角色一致性示例和 prompt,直接抄作业验证跨场景稳定性。

点击打开原平台查看,能否访问取决于网络环境

创作者用 Firefly Boards 跑通整条动漫制作工作流

创作者 @CharaspowerAI 分享用 Adobe Firefly Boards 完成 1 分钟动漫风格短片的工作流:先在 Board 内搭建角色表、场景表、分镜等全部制作资产,再基于这些资产生成成片。核心思路是把传统动漫制作工作流压缩进单一画布,强调资产统一管理与风格一致性。

把角色表、场景表、分镜全塞进一个 Firefly Board 再出片,做动漫和短剧的可以拉片看这套资产组织方式能不能套进自己的流程。

点击打开原平台查看,能否访问取决于网络环境

FOID AI Studio 用 Luma 实现无限制导演

Luma 官博发布客户案例,介绍 FOID AI Studio 如何借助 Luma 工具链实现导演向的 AI 创作,核心是「无限制导演」的工作流思路。对 AI 编导和视觉创作者来说,可参考其如何用 Luma 组织镜头语言与视觉风格。

Luma 官博客户故事,讲 FOID AI Studio 怎么用 Luma 做导演向创作,做 AI 编导和视觉的可以看看工作流怎么落地。

点击打开原文

Hitem3D 浏览器内 2D 转 3D 模型实测

创作者实测 Hitem3D:一张平面 2D 图像约 5 分钟生成清晰高细节 3D 模型,全程浏览器内完成、零配置,无需手动修复网格。对视觉师和 AIGC 技术整合者来说,这是把 2D 概念图快速转成可用 3D 资产的轻量方案,适合批量产出道具、场景元素,能显著压缩资产制作时间。

做视觉开发和 3D 资产整合的可以看看,5 分钟出高细节模型、零配置,省掉手动修网格的功夫,适合批量出道具和场景资产。

点击打开原平台查看,能否访问取决于网络环境

创作者用 3060 本地跑通 Minimax Music 3 + LTX 2.5

创作者 @deadsun_0 分享个人工作流:用 Minimax Music 3 生成音乐、LTX 2.5 生成视频,全程在 RTX 3060 上本地免费完成,并附上了歌曲提示词。

个人实测:Minimax Music 3 配 LTX 2.5,一张 3060 就能本地免费生成音乐和视频,后期和做短剧的可以照着这套工作流跑一遍。

点击打开原平台查看,能否访问取决于网络环境

作品与案例

Works

Runway 大奖作品:Ciro Kavouras《This is not Norway》

Runway 官方账号公布大奖(Grand Prize)作品,为 Ciro Kavouras 创作的《This is not Norway》,链接指向成片。作为官方赛事获奖作品,其视觉风格与叙事手法具有参考价值。

Runway 官方公布的大奖作品,做 AI 影像的可以点开拉片,看评委认可的视觉风格和叙事处理。

点击打开原平台查看,能否访问取决于网络环境

Magnific 推 AI 视频第二集:强调角色一致性

Magnific 官方发布 AI 短片系列第二集,强调从单镜头到完整故事的跨越。核心看点在于跨镜头角色一致性保持、以导演思维而非提示词驱动场景,以及构建连贯叙事的处理方式。

做 AI 短剧的可以点开拉片,重点看跨镜头角色一致性和叙事怎么撑住,比单镜头 demo 有参考价值。

点击打开原文,能否访问取决于网络环境

B站AI电竞短剧第2集:三年之期恭迎世一上

B站UP主发布的AI生成电竞题材短剧系列第2集,以LPL/TES等真实电竞选手为演员形象,台词和动作基于短剧模仿设计,非真实事件。系列包含大量分集片段,如《TES世界赛单曲》《LPL山海经》等,主打电竞梗和选手形象还原。

电竞题材AI短剧系列第2集,做短剧的可以拉片看真人选手形象还原和台词梗的密集度处理。

点击打开原平台查看

AI 全民制作人系列第 15 集,单集算力成本 2500 元

B 站 UP 主「AI 全民制作人」系列《躲在交易所后门买差股票的五人》第 15 集,财经题材 AI 短剧,单集算力成本 2500 元,工具支持 updream,已更新至第 15 集,属长系列连载。

B 站 AI 全民制作人系列更新到第 15 集,单集算力成本 2500 元,做 AI 短剧的可以拉片看长系列的角色一致性和叙事连续性怎么撑住。

点击打开原平台查看

微信公众号 光影漫游AI 二维码
觉得日报有用的话,欢迎关注微信公众号,AI 影视创作的内容都在那里。
光影漫游AI
微信内长按二维码识别,或复制名称到微信搜索