关于ZAKER Skills 合作
爱范儿 3小时前

MiniMax Design 来了,视频模型也有了自己的 Codex

当一个视频模型和 Seedance 2.5 同一天发布,似乎大概率要成炮灰,但 MiniMax H3 却成了一个例外。

MiniMax H3 在八月初正式开源之后,国内外的社交媒体上网友都玩疯了。其中最受关注的莫过于「中国仙境」系列,用 Midjourney 生成高质量的参考图,放到 MiniMax H3 中进行创作,震撼了大量网友。

高级的视觉审美、丝滑的动态效果以及连贯的角色一致性,都是网友们对 MiniMax H3 生成视频的评价。APPSO 当时也第一时间实测了 MiniMax H3 的视频表现,用来制作各式各样的品牌视频、特效视频,几乎都是一次性就可交付。

而现在 MiniMax 也开始把这种模型的能力,放到了具体的产品上,正式推出了 MiniMax Design,进一步把 H3 视频模型的能力放大,同时也让我们少折腾一些,可以更高效地制作各种商业化内容。

就像 GPT-5.6 Sol + Codex、DeepSeek V4 + DeepSeek Harness 才能发挥出模型真正的 Agent 能力,MiniMax Design 正在做的,也是把 H3 的生成能力,接入一套能够持续修改、协作和交付的完整工作流。

第一眼看到 MiniMax Design 的页面会觉得太「专业」了,ComfyUI 那套工作流和完整画布,在这里是基础的功能,但实际体验一段时间后,会发现 MiniMax Design 的 Agent 团队能解决大多数的问题。

不会使用画布,不理解 3D 导演台里的机位和动作调度,也不知道如何连接 ComfyUI 工作流,都没有关系。

我们只需要说清自己想做什么,MiniMax Design 会自动帮我们完成全部的制作,应用内大量的 Skills、模型、Agents 等能力会主动理解并拆解我们的需求,一步一步自动执行。

这也是 MiniMax Design 的核心作用:把这些专业能力组织成可执行的节点,再调动 H3、生图、音乐和语音模型完成后续制作,把 AI 视频创作这件事推向了真正的完整生产。

如果你不会写 AI 视频的提示词,每次都是从 ChatGPT 复制到海螺视频生成,或其他 AI 视频的网页,然后等它生成。

这次不妨替换到 MiniMax Design,不需要提示词,只是简单的需求,然后看着它自己创建画布、生成提示词、分镜板、图片、配乐、台词对话、剪辑、字幕、视频……

重拍《牛来》的一场戏

《牛来》这部从画面到台词,都集抽象文化于一体的电影已经成了一种文化现象。一些用视频模型「复刻」的同款《牛来》,甚至比电影原版还要更精致,网友们表示根本没有原片的味道。

我们也用 MiniMax Design 做了个片段复刻,输入提示词「帮我在导演台搭一场戏 : 男主和女主在草原上走,面前遇到一条很宽的河,女主纵身一跃跳过河对岸,男主在河这边来回踱步。」

生成这个视频对 MiniMax Design 来说其实挺复杂的,但是我们的操作就只有上传素材和对话。

点开 MiniMax Design 的页面,和大多数视频生成的首页类似,中间是一个对话框,我们输入需求,添加素材,选择项目、模型、Skills 等自定义选项。左侧边栏则是完整 Skill、ComfyUI 工作流、项目库和资产中心的入口,以及处理的项目列表。

输入需求之后,MiniMax Design 会自动打开一个画布,所有的素材、工作流都将在这块画布上呈现。

一般来说,MiniMax Design 会自动生成完整的 Markdown 格式 Brief 文档,或者提示词文档,以及使用生图模型生成可能用到的静态帧图片,接着它会结合文本文档、静帧图片,使用 MiniMax H3 生成视频。

在《牛来》这个案例中,我们使用了「3D 导演台」的功能,点击画布正下方的「+」,可以添加文本、表格、图片、视频、音频,以及 3D 导演台、视频剪辑和 ComfyUI 工作流几类节点。

选择「3D 导演台」之后,我们就会进入一个导演台 Agent。同样的,点击画布上的提示词文档,我们也能得到一个文本助理 Agent,帮助我们调整文本;点击图片或视频,也会自动展开图片 / 视频的生成对话框,可以调整提示词,选择模型、尺寸等内容。

在「3D 导演台」内,用户或 Agent 可以在 3D 场景中直接摆放角色素体、调度机位与姿态,快速搭建分镜参考,使画面的可控度能得到明显提升,抽卡和试错成本也能大幅降低。

这些复杂的导演台内容,又是要调整动作,调整角色,看起来就很复杂,但其实整个 3D 导演台都是由 MiniMax Design 自动帮我们搭建的,我们做的只是在侧边栏的导演台 Agent 给它下达各种需求。

这场戏的难点来自人物之间的空间关系:女主需要跃过河流,男主则要留在对岸来回踱步,同时还要保证动作方向和镜头调度前后一致。单靠一段文字直接生成,人物位置和运动轨迹很容易发生偏移。

最后它会先给我们一个导演台的运镜视频,MiniMax Design 再参考视频中的运镜,帮我们精准生成最后的视频。

3D 导演台的价值在于把模糊的自然语言要求,转换成明确的空间和运动参考。动作不对时,我们可以先在导演台里调整角色和机位,再重新生成对应镜头,减少围绕最终成片反复抽卡的次数。

能处理这类复杂的 3D 导演台,MiniMax Design 制作各种特效视频也是完全不在话下。

像是制作一个悬疑电影的片头,我们使用 MiniMax Design 内自带的 Skill,然后输入提示词要求它做一个中文电影,中文角色。它会自动生成多个关键帧的生图 Prompt,调用 GPT-Image-2 等生图模型,先生成分镜图。

最后的效果确实超出我的预期,这些复杂的特效和动画,如果要用 Adobe PR 或 AE 等软件去手搓,难度相当大。

如果一个 15s 的片头还不够考验 MiniMax Design 的能力,我们直接要它做了一个 1 分钟的 MV,从歌词、编曲到最后的成片,完全是由 MiniMax Design 一手操办。

我们只需要在侧边栏的 Agent 里对话,MiniMax Design 就会自动在画布上完成所有的工作:从歌词与编曲、视觉风格设定、分镜规划、关键帧生成、H3 视频生成,到最后的配乐、字幕和剪辑。

由于 H3 单次最多生成 15 秒视频,一分钟 MV 还需要被拆成多个镜头,再重新组织成一条风格和节奏相对连贯的时间线。

这里我们可以看到它对长视频的编排能力,H3 负责逐个生成镜头,Agent 负责拆分任务、统一风格,并把多个片段重新组织成一条完整时间线。模型的单点能力,在 MiniMax Design 内被扩展成了多模型协同的制作流程。

MiniMax Design 内置的 Skill 库中,还有大量预设的案例。我们可以直接与 Agent 对话,套用同样的风格,快速生成类似的视频。

像这个纸拼贴视频,整个的工作流程,我发送的提示词只有「我想用纸拼贴做一个故事剧情片,大致的情节是……」

一样是等着 MiniMax Design 自动完成所有的工作,我们就得到了这段 42s 的伤感故事。

把一套模板,变成一条视频生产线

纸拼贴案例更有价值的地方,在于这套工作流可以继续复用。第一支剧情短片确定了纸张质感、角色样式、转场方式和叙事节奏之后,同一个 Skill 还可以被套用到新的主题中。

我们直接利用那套纸拼贴模板,再做了一个科普日全食的版本。全程我们只是输入了一下提示词,「能不能用这种纸拼贴来解释一下什么是日全食」、「我觉得视频可能要 20s 左右比较好」、「要加 BGM、旁白和字幕」。

保留了原有的视觉包装,只调整内容主题、视频长度、旁白和字幕要求。原本的一支风格样片,因此变成了一套可以持续生产不同选题的频道模板。

成片之后,Agent 还将项目继续扩展成无字幕版、儿童旁白版和庄重科普版等分支。同一套素材和工作流,可以由此快速派生出面向不同平台与受众的版本。

如果需要其他的模板,MiniMax Design 也能生成类似轻科普的动漫短片,来解释为什么一帧一帧的图片放在一起就能变成视频。

以往制作这类动画,需要大量人工编辑,先是要画多个复杂的矢量图标,然后丢到动画渲染软件中,一步一步生成。而现在,MiniMax Design 几乎是把这种类型做成了批量式生成。

这类科普还能用在教育场景,例如我们只是上传一份课程 PPT,MiniMax Design 就能创作出对应的水墨画视频。

上传一首诗,它也会继续扩展其中的意象和叙事线索,最终组织成一部三分钟纪录片。

在电商场景,MiniMax Design 的作用更多体现在素材编排上。不同角度的产品图片会作为独立节点保留在画布中,再分别连接到关键帧生成、视频生成和剪辑等环节。

相比在多个网页之间反复下载、命名和上传素材,画布能够保留每张产品图与对应镜头之间的关系。需要修改时,我们可以直接回到相关素材或镜头节点,后续扩展不同卖点、尺寸和平台版本也会更加清晰。

例如这些复杂的工作流,由不同的产品图片,生成视频的不同静态帧,全部是由 MiniMax Design 帮我们连起来的。

甚至,上传一个 APPSO 的 logo,MiniMax Design 就能给一个酷炫的动态效果。

一份已有的品牌资产可以继续接入新的生成流程,扩展成视频片头、动态标识或其他包装素材。

应用 AI 化,模型应用化

相比此前我们单独测试 MiniMax H3,MiniMax Design 在完整创作流程和最终视频生成效果上的表现,给我们留下了更深的印象。

单一的对话式生成,似乎很多时候依赖我们自己的创意和想法,视频中出现的什么内容,都需要靠提示词在一开始指定,或者上传参考文件。

MiniMax Design 带来的变化是,输入提示词之后,这个项目才刚刚开始。我可以继续在画布上调整生视频用的参考图片,可以继续要求 Agent 调整提示词,甚至可以添加导演台这类专业化工具,让视频生成更可控,可交付。

这些变化,让我们想到过去几年创作软件的主旋律都是「应用 AI 化」:在原有工作流里加入生成图片、智能抠图、文本成片等功能。MiniMax Design 似乎展示了另一种同时发生的趋势——「模型应用化」

当 MiniMax Design 能围绕视频模型搭建画布、资产中心、3D 导演台、Skills 和 Agent,模型输出的单位也从一段素材,逐渐变成了一个可以继续编辑、修改和交付的完整项目。

▲ MiniMax Design 的视频剪辑 Agent 助理

过去的创作软件围绕工具组织界面,模型原生的创作软件则开始围绕创作意图组织工作流。用户可以直接描述自己要做什么,再由 Agent 决定需要哪些模型、素材和步骤。

MiniMax Design 把工作拆给一组 Agent,由它们理解 Brief、规划流程、调用模型,再把脚本、分镜、画面、配音、配乐、字幕与剪辑汇总到同一块画布上。

复杂度依然存在,只是其中很大一部分被 Agent 接管了。我们可以从一句自然语言开始,专业用户也能进入导演台、ComfyUI 工作流或任意素材节点继续干预。自然语言降低了创作的起点,画布和工作流则保住了专业生产所需要的控制力。

沿着这条路径,MiniMax Design 开始触碰到专业创作软件真正关心的部分:稳定、可控、可修改和可复用。

现阶段,帧级精修、复杂合成以及严格的品牌资产管理,依然需要 Adobe PR、AE 和成熟制作团队完成。但从概念、脚本、分镜到素材生成、粗剪和版本扩展,MiniMax Design 已经可以接管相当长的一段流程。

这也意味着,MiniMax H3 + Design 已经切入 Adobe 长期占据的专业创作工作流,开始替代其中最标准化、最高频的一部分。过去主要为 PR、AE 提供素材的视频模型,如今也开始争夺完整项目的制作入口。

尤其是对于科普视频、电商素材、品牌短片等需要高频交付的内容,这段流程往往恰好最耗时间。

当模型让创作软件的上限不断抬高,软件又把模型抽卡的惊艳,变成可以重复的交付时,MiniMax Design 走在了下一代专业创作总控台的路上。

爱范儿

爱范儿

发现创新价值的科技媒体

订阅

觉得文章不错,微信扫描分享好友

扫码分享

企业资讯

查看更多内容