一个月要出三十条投放素材,素材却散在下载文件夹、剪映、网盘和三个 AI 网页里?MiniMax Design 想治的就是这段手忙脚乱。海螺团队把 H3 视频模型和 GPT Image 2、Nano Banana Pro 塞进同一张节点画布,你只管说清要什么,四路 agent 分头干活。实测下来流程层确实跑通了,官方最主打的语义改视频却翻了车。
产品概述
MiniMax Design 不是又一个 AI 视频生成网页,而是海螺团队在 2026 年 8 月 21 日正式端上桌的桌面软件。它的身世有点绕:五月亮相时叫 MiniMax Hub,八月十号改名,二十一号才拿到正式名字。严格说这是个打磨了三个多月才定名的产品,不算横空出世。
定位一句话讲清楚:由 AI agent 驱动的商业内容产制平台。底层跑的是 MiniMax 自家刚开源的多模态视频模型 H3,上面再包一层编排逻辑,你提需求,它负责拆任务、选模型、生成、修改,一路做到交付。官方点名的四个场景是短剧、电商内容、品牌 TVC 和广告素材,全是量产物。
跟传统工具最大的差别在操作对象。你在剪辑软件里动的是时间线和参数,在这里动的是意图,说人话就行。代价是它只做桌面端,macOS 13 以上和 Windows 10 以上各一个安装包,没有 Linux,也没有网页版,想在浏览器里玩 H3 得走海螺 AI。

核心功能
名字听着挺重,拆开看其实就两层,一层管调度,一层管执行。
官方把整套流程切成五步:接需求、建画布、套 Skill、管素材、过审查。前两步是 agent 的活,中间两步归资产和复用,收尾那一步留给人。听着像流水线,真跑起来五步会来回跳,比如审查不过关就退回分镜重来,这也是它跟一次性生成工具最不一样的地方。
第一层是主 agent。你丢进去一句话需求或者一份 brief,它先读意图,再把任务拆成一张任务地图,然后自动挑该用哪颗模型,想自己指定也留了手动入口。这一步的质量基本决定后面所有产出,brief 写得越像真的 brief,出来的东西越能用。
第二层是四个专职 agent 并行开工。文案 agent 写脚本和口播,图像 agent 出生图,视频 agent 拼时间轴,音频 agent 做配音和配乐,四条线同时跑,收尾时汇到画布上合并剪辑。别人卖的是单次生成,它卖的是并发,四路一起开工也是它跟单模型网页拉开体感差距的地方。
模型池是跨家的。自家有 H3 视频、Music 2.6 音乐、Speech 2.8 语音,第三方接了 GPT Image 2 和 Nano Banana Pro,同一包点数通吃,用不完的额度可以挪去生图或者配音。这也顺带解释了它为什么不可能本地推理,第三方闭源模型根本没法跑在你机器上。

画布把所有产物都变成节点。脚本、分镜、视频、音乐、剪辑各自是节点,自动连线,需要细调时 ComfyUI 节点就开在同一个 app 里,不用跳出去。更值得说的是项目级记忆,多轮聊下来你问它”我们确认过的人设和品牌信息有哪些”,它能完整复述,角色和场景还能存成资产跨项目复用。
Skill 广场目前列了八个官方技能,覆盖短剧、分镜、商业广告、电商、音乐、平台工具六类,全都带版本号。调用有三种方式:点”去对话中试试”直接带走、对话框敲斜杠唤起、或者干脆不说让 agent 自己判断。跑顺的流程也能包成 Skill 存起来。
3D 导演台是这次最实用的插件。你用自然语言摆角色站位和机位,系统先在 3D 空间里给你看构图,确认后再拿这个分镜去生成视频,等于把抽卡试错提前到分镜阶段。描述不出来的运镜还有虚拟摄像机,手机扫码比划一遍传回来。
上手体验
功能表看得再熟,不如真丢一个需求进去跑一遍。
安装没什么门槛。官网按芯片分了三个包,M 系列 Mac、Intel Mac、Windows 各一个,当前版本号 3.0.9,装完用 MiniMax 账号登录,跟海螺网页版、MiniMax Audio 是同一套账号。客户端是三栏结构,左边 Skill 广场、模板中心、插件和资产中心,中间画布,右边 agent 对话区,第一次打开不会迷路。
我按官方手册的示例走了一遍:上传一张无线耳机产品图,输入”做一条 15 秒竖屏广告,突出轻便和降噪,风格简洁有科技感”。它没有直接开干,反过来先确认画幅、卖点、受众,再规划步骤、生成人物形象、写分镜,才出片。整个过程你能做的只有两件事,确认和等。
成片质量比直接在网页端生成好一截,原因是 agent 会自己扩展提示词、补充分镜,等于替你做了一遍功课。对完全没碰过 AIGC 的人,这种”不用理解工具、只要说清楚要什么”的体验,确实是门槛最低的一档,新手连画布怎么连线都不用先学。
批量生产我又试了一轮。上传两张产品图要两条 15 秒竖屏 KOC,每条不同人设和开场。它先建人物锚和产品锚锁住外观,再分别生成,两条都成了,人物跨镜头一致性很稳。VR 眼镜那条更有意思,整条视频只字不提产品名,只讲佩戴感受,像是模型自己绕开了可能说错的坑。

翻车翻在官方最主打的地方。我把成片喂回去,说”调暖色调、氛围温馨一些”,改完肉眼几乎看不出差别;再说”背景换成明亮咖啡馆,人物产品不变”,背景换了,耳机变形了。听得懂做到了,改得准还差得远,视频编辑要求模型该变的变、该不变的像素级不变,后者现在还没过关。
使用技巧
很多人不知道的是,这工具最烧点数的不是生成,是重试。
-
brief 一次写全:画幅、时长、受众、卖点、风格一次说清,agent 追问的轮次越少,浪费在确认上的点数越少。 -
先建锚再批量:批量出片前让人物和产品的锚点先定下来,跨镜头一致性会明显好于每条单独生成。 -
分镜阶段拦一道:复杂运镜先用 3D 导演台确认构图再生成,能省掉大量抽卡重跑的点数。 -
跑通立刻存 Skill:某类片子跑顺后马上用对话把它包成 Skill,下次同类需求直接复用,省的不只是点数还有试错时间。 -
绑定微信或飞书:扫码接入后能在 IM 里直接派活,适合临时改需求、手边没开客户端的场景。
竞品对比
这条赛道今年挤得满满当当,同类大概分三路:国内平台拼画质,海外聚合器拼模型广度,它拼中间那段还要不要人。
| 对比维度 | MiniMax Design | 可灵 Kling 3.0 Omni | 即梦 Seedance 2.0 | Higgsfield |
|---|---|---|---|---|
| 核心定位 | Agent 编排的桌面产线 | 影视级视频生成 | 剪映闭环的内容生产 | 多模型聚合平台 |
| 交付形态 | 桌面客户端 | 网页 + App | 网页 + App | 网页 |
| 入门月付 | 65 元 / 1 万积分 | 58 元起 | 69 元起 | 15 美元 / 200 积分 |
| 跨模型调用 | 是,H3 + GPT Image 2 + Nano Banana Pro | 否,仅快手模型 | 否,仅字节模型 | 是,15 款以上 |
| 工作流复用 | Skill 可自建可分享 | 无 | 模板 | 无 |
| 本地素材直连 | 支持,画布资产存本机 | 不支持 | 不支持 | 不支持 |
| 开放工作流 | 可导入自有 ComfyUI 流程 | 不支持 | 不支持 | 不支持 |
可灵与即梦档位参考申万宏源 2026 年 2 月行业整理(可灵黄金 58 / 铂金 234 / 钻石 586 / 黑金 1149 元每月,即梦基础 69 / 标准 199 / 高级 499 元每月),Higgsfield 参考 2026 年年中公开整理,各家价格随时调整,以官网当日为准。
它跟这三家不在一个平面上打。可灵和即梦比的是单条视频的画质与镜头控制,Higgsfield 比的是模型覆盖广度,MiniMax Design 比的是从 brief 到成片中间那几步还要不要人插手。一个月只出一两条片子,可灵的日常免费额度和即梦的每日积分更划算;一个月要出三十条,差距立刻就出来了。
反过来说,你要的是单帧级的控制力,它现在给不了。语义编辑在实测里没过关,这一块反倒是可灵的运动笔刷和即梦的局部重绘更实在,改一处而不动其余才是刚需。选之前先想清楚自己的瓶颈到底是画质还是流程接缝。
用户反馈
官方说自己好不算数,看看真上手的人怎么讲。
正面评价:
-
“批量 KOC 那条链路是完整的,两张产品图两条片,人物跨镜头没崩,VR 眼镜那条还自己绕开了产品名。”(电商内容团队,2026 年 8 月实测) -
“3D 导演台把抽卡提前到了分镜,摆位和机位说一句话就调好,省掉的试错比我预想的多。”(短视频工作室,2026 年 8 月) -
“免费开始就能真出片,不是只能预览界面,这一点比多数平台厚道。”(海外评测整理,2026 年 8 月)
负面评价:
-
“语义级视频编辑没兑现,调色调不动,换背景把产品换变形了。”(光子星球实测,2026 年 8 月 23 日) -
“稳定性和渲染偶发卡顿,长镜头和细节镜头上 H3 会抖。”(海外评测整理,2026 年 8 月)
多维评分
前面拆得够细了,这里把账一起算清。
| 维度 | 权重 | 评分 | 一句话解读 |
|---|---|---|---|
| 功能完整性 | 20% | ⭐⭐⭐⭐☆ | 五步产线闭环,语义编辑这一环没补齐 |
| 易用性 | 15% | ⭐⭐⭐⭐⭐ | 只说话就能出片,小白零门槛 |
| 性能表现 | 15% | ⭐⭐⭐☆☆ | 稳定性偶发卡顿,本地部署门槛偏高 |
| AI 能力 | 15% | ⭐⭐⭐⭐☆ | 项目级记忆扎实,画面保真仍会失手 |
| 价格合理性 | 10% | ⭐⭐⭐☆☆ | 65 元约 83 秒 2K,重试几次就见底 |
| 生态集成 | 10% | ⭐⭐⭐⭐☆ | ComfyUI 与 IM 接入开放,API 文档偏薄 |
| 文档与支持 | 10% | ⭐⭐⭐☆☆ | 上手手册够用,进阶与本地部署说明不足 |
| 更新频率 | 5% | ⭐⭐⭐⭐☆ | Skill 带版本号持续迭代,插件还在补 |
综合评分:7.2 / 10
优缺点
优点
-
流程语义化真的做成了,从 brief 到成片不用自己接线 -
项目级记忆可用,多轮之后能复述人设、风格、品牌信息 -
点数跨模型通吃,H3、GPT Image 2、Nano Banana Pro 共用一包 -
3D 导演台把抽卡试错提前到分镜,省时间也省点数 -
支持导入自有 ComfyUI 工作流,给有显卡的人留了成本下探的口子
缺点
-
语义级视频编辑名不副实,调色几乎无效,换背景主体变形 -
Starter 档 1 万积分只够约 83 秒 2K,重试几次就见底 -
只做桌面端,没有网页版也没有 Linux 版本 -
稳定性与渲染偶发卡顿,长镜头上 H3 会抖 -
官方宣称的”本地优先”只指素材,算力全在云端
适用人群
那到底谁该掏这个钱,谁该绕着走。
-
电商与投放团队:每天要出几十条素材,批量链路已经完整,建议 Plus 档起跳,Starter 只够试水。 -
MCN 与短剧工作室:短剧、分镜、KOC 口播是官方重点场景,Skill 复用的价值在这里最高。 -
品牌市场部:一份 brief 出全套海报、视频、文案,适合活动期集中产出。 -
AIGC 零基础个人:不想学专业工具,只愿意说话,这是目前门槛最低的一档。 -
有显卡的专业创作者:能导入自己的 ComfyUI 工作流,把生成成本压到本地电费级别。
不适合两类人:要把界面间距调到对的 UI 设计师,以及想要单帧级精修的剪辑师。前者它帮不上忙,后者它现在还接不住。官方从头到尾讲的是短剧、电商和广告素材,卖点从来是”量”不是”精”,认清这点再决定要不要装。
定价方案
点数怎么算,直接决定它便宜还是贵。
截至 2026 年 8 月 22 日,国内版分三档:Starter 65 元每月给 1 万积分,Plus 499 元给 8.7 万,Pro 1399 元给 27 万。按官方换算,1 万积分大约能生成 83 秒 H3 的 2K 视频,或者 143 秒 768P、125 张 GPT Image 2、500 首 Music 2.6。翻译回人民币就是,65 块钱够出五到九条 15 秒短视频,还不算重试。国际版是同一套积分体系,年付均摊下来更便宜。
| 档位 | 月付(国内) | 月付(国际) | 每月积分 | 约合 H3 2K |
|---|---|---|---|---|
| Starter | 65 元 | 10.5 美元 | 10,000 | 83 秒 |
| Plus | 499 元 | 76 美元 | 87,000 | 725 秒 |
| Pro | 1399 元 | 215 美元 | 270,000 | 2,250 秒 |
国内价格为 2026 年 8 月 22 日公开报道口径;国际价格为 2026 年 8 月 21 日官网订阅页口径,年付均摊分别为 8.4 / 60.8 / 172 美元。价格随时调整,下手前以官网当日为准。

真正该算的是单价。H3 的 2K 视频随用随付大约 0.13 美元每秒,Starter 年付降到约 0.081 美元,Plus 约 0.067 美元,Pro 约 0.061 美元,规模效应很明显。年缴还有个 9 月 2 日截止的八折,官方写的是年卡有效期内全年适用,不是永久有效。点数不够能加购,十个到五百美元四档,有效期一年。
FAQ
评论区问得最多的几个,集中回一下。
Q1:MiniMax Design 和 MiniMax H3 是一回事吗?
A1:不是,H3 是引擎,Design 是外壳。 H3 是开源的 33B 多模态视频模型,Design 是把它和 GPT Image 2、Nano Banana Pro 等模型包进节点画布的桌面软件。想自架模型去下 H3 权重,想省事就用 Design。
Q2:装了它就等于在本机跑 H3 吗?
A2:不等于,算力全在云端。 官方说的”本地优先”只指画布素材自动存本机、agent 能读你电脑里的文件,所有生成仍然打云端 API。第三方闭源模型更不可能本地跑,它本质上是个装进桌面的多模型聚合器。
Q3:一个月到底能出多少东西?
A3:Starter 档约五到九条 15 秒短片。 1 万积分换算成 H3 的 2K 视频是 83 秒,768P 是 143 秒;同一包点数也能拿去生图、做音乐和配音,用途自己分配,重试同样扣点数,所以试稿建议先用 768P。
Q4:Skill 是什么,和 Claude 的 Skill 一样吗?
A4:概念同源,内容不同。 都是把验证过的做法包成可安装、可分享、带版本号的模块,区别是这里包的是整条影片产线,比如 3D 动画短片、品牌宣传片、MV 字幕。可以对话自建,也能从官方 Plaza 一键装。
Q5:语义级视频编辑现在能用吗?
A5:能用,但别抱太高期待。 实测里”调暖色调”改完肉眼几乎无变化,”换背景”成功了但主体变形。意图理解没问题,像素级保真还没过关,关键镜头建议留人工兜底。
Q6:能接自己的 ComfyUI 工作流吗?
A6:可以,这是它比同类开放的地方。 官方提供轻量版和满血版 H3 工作流,也支持导入你自己的流程,Agent 还能按对话调节点和参数。代价是本地硬件门槛不低,官方文档写得也不够细。
Q7:做 UI 或品牌视觉的人需要吗?
A7:目前基本不需要。 官方点名的场景是短剧、电商内容、品牌 TVC 和广告素材,强项在”一个月出三十条”,不在”把一个细节调对”。这类工作用 Figma 更合适。
Q8:免费额度够用吗?
A8:够试,不够用。 客户端免费下载,新用户赠 3000 积分,H3 还有若干次免费生成额度。真想验证它能不能进你的工作流,建议直接上 Starter 档,拿一个月的真实需求去跑。
Q9:和即梦、可灵怎么选?
A9:先看清瓶颈在哪。 瓶颈是单条画质和镜头控制,选可灵或即梦;瓶颈是素材搬来搬去、对时间轴、找文件,选 MiniMax Design。一个月只出一两条片的话,前者的日常免费额度更划算。
Q10:Skill 会锁死在它家生态里吗?
A10:会,这是最大的隐性成本。 Skill 存在它的画布里,换平台就得重做。跨模型钱包听着自由,实际是把你的流程绑在 MiniMax 的编排层上,评估时要把这点一起算进去。
结尾
这波生成模型公司都在做同一件事:往模型上面长一层工作流,把用户留在自己家里。MiniMax Design 是这套思路里动作最快的一个,画质领先会一直换人,产线顺不顺才是留人的东西。
它现在的状态很清晰。流程这一层已经能交差,批量出片、项目记忆都跑通了;画面这一层还卡着,语义编辑的承诺和实测之间隔着一段距离。电商、投放、内容运营团队现在就能用,65 元的 Starter 够小团队试水;冲着”一句话精修视频”来的,建议再等等 H3 的下个版本。
值得盯的问题只有一个:下次 H3 更新,能不能让”改视频”变得和”说需求”一样便宜。到那天,剪辑软件的菜单栏才算真的进了博物馆,而这块骨头现在还卡在画面里,谁先啃下来谁就拿到下一张门票,整条赛道都盯着同一个位置。
