MiniMax H3 Max
首帧(选填)
+
尾帧(选填)
5s
5s15s
生成配音
输出含音频
公开可见性
所需积分
15
视频

MiniMax H3 Max AI 视频生成器:基于 fal 的高速视频生成

在浏览器里直接运行 MiniMax H3 Max。输入提示词,或上传首尾帧,即可生成 5 到 15 秒、带原生立体声音频的片段。MiniMax H3 是开放权重的多模态生成模型;H3 Max 是 fal 面向速度调优、由我们在此托管的变体。

为什么用 MiniMax H3 Max 生成 AI 视频?

PixExact 把 fal 的 H3 Max 做成一套简单流程:写提示词,可选配图片,一次生成带同步音频的视频。

fal 的 H3 Max,源自 MiniMax H3 基座模型

MiniMax H3 Max 是 MiniMax 开放权重 H3 视频模型的后训练变体。fal Research 针对提示词遵循度和画面质感做了调优,并与自有推理栈共同设计了服务路径。

画面与声音一次生成

H3 Max 同时预测画面和声轨。你得到的是带原生立体声音频的视频——对白、音效、环境声都在里面,而不是还要后期配乐的静音片段。

文生视频与图生视频

描述一个镜头,或上传首帧,并可选尾帧。图生视频沿用源图的画幅;文生视频可选 16:9、9:16、21:9、4:3、1:1 或 3:4。

为 768p 快速迭代而生

H3 Max 默认 768p(16:9 时为 1344×768,24 fps)。fal 称 5 秒 768p 片段在其推理栈上可在 3 秒内完成——短镜头可快过实时。PixExact 同时提供 480p 和 1080p。

如何用 MiniMax H3 Max 生成视频

三步从提示词到可下载成片。在 PixExact 上无需搭建 ComfyUI 节点图,也不需要本地 GPU。

1

写提示词

在一条提示词里写清机位、动作和声音。图生视频请上传起始帧,需要的话再加结束帧。尽量写具体:镜头时长、运动方式和音频,都会帮到模型。

2

选择时长和分辨率

片段长度 5 到 15 秒。可选 480p、768p 或 1080p。768p 是 fal 为 H3 Max 调优的分辨率;15 秒 480p 是试镜头成本最低的方式。

3

生成并下载

点击生成。PixExact 把 MiniMax H3 Max 任务排到 fal,返回带同步音频的片段,可预览、下载,或在站内其他 AI 工具里继续用。

这款 AI 视频生成模型擅长什么

H3 Max 保留了 MiniMax H3 的多模态上下文理解——文本和图片可放在同一次请求里——同时用更快的 768p 生成换掉 2K 输出。实际表现如下。

用详细提示词做文生视频

相比不少早期 Hailuo 系 checkpoint,这套生成模型更能跟上分镜节拍,这也是 fal 后训练的目的。按顺序写分镜:谁在画面里、镜头怎么动、你该听到什么。

5 seconds, 16:9, 768p. A courier on a rain-slick night market alley, slow dolly forward under red neon. Wok sizzle, rain on tin, neon hum. No music.

图生视频与首尾帧

上传一张静帧作为第一帧。再加上结束图,H3 Max 会在两者之间插值过渡——这就是 MiniMax 文档中的首尾帧图生视频路径。输出画幅跟随你传入的图片。

Hold the camera locked. Morning light crawls across the room, dust in the beam, curtains lift once. Soft room tone, a distant kettle.

原生立体声音频,不是静音成片

MiniMax H3 的设计是音频与视频共享一次 omni transformer 前向(基座模型为 32 kHz 立体声)。H3 Max 沿用这一行为:口型、拟音和配乐可以一次生成到位,不必再走单独的音频管线。

A chef looks into camera and says, "Don't crowd the pan." Window daylight, white tile, pan sizzle under her voice. Medium close-up, 50mm.

短片段,5 到 15 秒

每次生成最长 15 秒、24 fps 的片段。适合社媒切片、产品循环和动态分镜。若要原生 2K 输出,MiniMax 与 fal 文档指向的是 MiniMax 的 H3 基座模型(不是 H3 Max)。

15 seconds, 9:16. Pixel-art endless runner along a steep city street, jump and duck on beat, chiptune and jump blips, score HUD in the corner.

MiniMax H3 Max 的使用场景

带同步音频的高速 768p 视频模型,最适合需要大量短镜头的时候,而不是一次出完整长片。

短社媒片段

生成 5 到 15 秒的竖屏或方形片段,用于 Reels、Shorts 和 TikTok。原生音频让开头就可以带人声或音效,不必再开第二个工具。

产品和投放测试

围绕一句口号、一张静帧或一对首尾图快速迭代。fal 公布的案例包括产品微距、动态海报,以及一次生成里完成的多镜头广告。

插画、像素风与风格保持

已经有既定画风时,图生视频很有用。fal 展示过 H3 Max 在整段片段里稳住像素跑酷、黏土动画和剪纸风——不是每条提示词都保证如此,但是现实可用的场景。

动态分镜与多镜头

H3 的多模态上下文就是为复杂分镜准备的:多个节拍、角色不跑偏、声音卡在接触点上。适合在长剪辑之前预演一场戏。

MiniMax H3 常见问题

什么是 MiniMax H3?

MiniMax H3 是 MiniMax 的通用多模态视频生成模型。它在同一上下文中读取文本、图片、视频和音频,并生成带原生立体声音频的视频,时长通常为 5 到 15 秒。MiniMax 在 Hugging Face 上发布了 H3-Base omni transformer 的开放权重(约 33B 参数)。完整 2K 交付还要经过额外的 regenerate 阶段(H3-Regenerate-2K);托管的 Context-IR 预处理器不在开源包里。

什么是 MiniMax H3 Max?

MiniMax H3 Max 是 fal Research 对 MiniMax H3 基座模型做后训练后的变体,跑在 fal 的推理栈上。它针对提示词遵循度和画面质感调优,默认 768p。PixExact 的 MiniMax H3 页面使用的就是这套 H3 Max,支持文生视频和图生视频(含可选尾帧)。

MiniMax H3 Max 和 MiniMax H3 有什么区别?

标准 MiniMax H3 是 MiniMax 的开放权重模型。在 fal 上它可以面向 480p、768p、2K 和 4K(fal 把 2K/4K 描述为从 768p 基座上放大),并包含 reference-to-video 以及编辑类接口。H3 Max 是 fal 的封闭后训练版本:768p 更快,没有单独公布权重,2K/4K 也不是它的定位。要在这个生成器上求速度,选 H3 Max;需要 2K 或完整参考包时,选基座 H3。

MiniMax H3 和 Hailuo 2.3 是同一个东西吗?

不是。Hailuo 是 MiniMax 的消费级视频品牌。Hailuo 01 和 Hailuo 02 是更早的代际。MiniMax 把 H3 作为下一代通用模型推出,并在 hailuoai.video 上演示。Hailuo 2.3 在 fal 上仍是独立产品线。请把 H3 / H3 Max 与 Hailuo 2.3 当作不同产品。

MiniMax H3 好用吗?H3 Max 真的是图生视频第一名吗?

取决于你看哪块榜。fal 引用 Design Arena 的图生视频 Elo(该榜上 H3 Max 为 1,341),以及 Artificial Analysis 的图生视频带音频排名(那里记为 MiniMax H3 Turbo 768p)。这些是第三方排行榜,不是 PixExact 的评测。短片、音画同步方面质量扎实;它并不能在每个镜头上替换所有模型。

MiniMax H3 会生成音频吗?

会。MiniMax H3 和 H3 Max 都会随画面一起生成音频——原生立体声,提示词要求时可以包含对白、音效和音乐。基础的文本或图片生成不需要单独的音频输入。参考音频属于基座 H3 / reference-to-video API 的能力,本 PixExact 页面尚未开放。

可以在本地运行 MiniMax H3 吗?怎么在 ComfyUI 里跑?

开放权重的 H3-Base checkpoint 可以本地部署;MiniMax 文档提供了 SGLang、vLLM、Diffusers 和 ComfyUI 方案。ComfyUI 也内置 MiniMax H3 API 合作节点(云端计费),覆盖文生视频、首尾帧和 reference-to-video。官方 Context-IR 和 2K regenerate 模块不在首批开源包里。H3 Max 本身是 fal 托管的后训练版本——没有可离线运行的公开 H3 Max checkpoint。PixExact 在云端运行 H3 Max。

MiniMax H3 开源吗?H3 Max 会开源吗?

MiniMax H3 以开放权重(H3-Base)发布,采用 MiniMax 社区许可证——不是完整训练栈,也不含 Context-IR。这是开放权重,严格意义上不是完整开源。fal 没有单独列出 H3 Max 的开放权重;它是对公开 H3 基座的后训练。H3 Max 目前没有宣布开源日期。

MiniMax 是中国公司吗?

是。MiniMax 是总部位于上海的 AI 公司(fal 的 MiniMax explorer 标注为 Shanghai, China)。它研发语言、语音、音乐和视频模型,包括 Hailuo 视频产品和 MiniMax H3。

MiniMax H3 / H3 Max 怎么收费?

在 PixExact 上,MiniMax H3 Max 按积分计费:480p 每秒 3 积分,768p 每秒 5 积分,1080p 每秒 10 积分。新账号有免费积分可试用。在 fal.ai 上,H3 Max 按秒计费(fal 公布了截至 14 September 2026 的促销价,之后为更高标价;请查看 fal 的实时定价)。MiniMax M3 是另一套语言模型——它的 API 价格不是这款视频模型的费用。

如何免费使用 MiniMax H3 Max?

PixExact 会给新用户免费积分,可以像站内其他视频模型一样花在 MiniMax H3 Max 上。fal.ai 也宣传过其沙盒每天五次免费 H3 Max 生成;那是 fal 的产品额度,不是 PixExact 的。没有不限量的免费 AI 视频档位。

如何在 PixExact 上使用 MiniMax H3 Max?

打开本页(默认模型是 MiniMax H3 Max),输入提示词,可选上传首尾帧,设置时长和分辨率,然后生成。若走 API,fal 文档中的接口为 minimax/h3-max/text-to-video 和 minimax/h3-max/image-to-video。把 H3 Max 接到自己的流程里,就是调用这些接口或使用本生成器——不是安装本地权重。

MiniMax H3 Max 要等多久,片段有多长?

输出为 5 到 15 秒、24 fps。fal 自己的推理耗时(8 September 2026)显示:H3 Max 文生视频从 5 秒 480p 远不到 1 秒,到 15 秒 1080p 可达数十秒;他们举的例子是 5 秒 768p 任务在其栈上 3 秒内出片。PixExact 端到端等待还包含排队和上传,实际等待时间会比 fal 的纯推理数字更长。

H3 支持哪些分辨率和画幅?

在本生成器上,H3 Max 提供 480p、768p 和 1080p,时长 5 到 15 秒。文生视频画幅为 16:9、9:16、21:9、4:3、1:1 和 3:4。图生视频跟随上传的帧。原生 2K / 完整 2K 是 MiniMax H3(基座)工作流,不是 H3 Max。

一次生成最多能用多少参考?

MiniMax 的 H3-Base 参考模式最多允许 9 张图片、3 段视频和 3 段音频,合计 12 个文件(音频不能单独使用)。fal 的 H3 Max reference-to-video 接口文档也写了类似的 12 文件上限。本 PixExact 页面目前支持文本加首尾静帧,不含完整参考包或音频参考。

MiniMax H3 能编辑我已有的视频吗?

MiniMax 把精准视频编辑视为 H3 体系的一部分。本页是生成器:从提示词和静帧创建新片段。要改已有素材,请用 PixExact 的 AI 视频编辑器或其他剪辑工具。在这里生成后,可以下载文件并在任意 NLE 中继续剪。

MiniMax H3 Max 可以用于商业项目吗?

fal 上托管的 H3 Max 文档写明可用于商业用途,但须遵守 fal 条款。PixExact 上的生成遵循 PixExact 服务条款。若自行托管开放的 MiniMax H3 权重,请阅读 MiniMax H3 Community License(MiniMax 在相关发布中使用过带营收上限的社区许可证——上线产品前请在 Hugging Face 核对当前文件)。

fal.live 是什么?就是这个生成器吗?

fal.live 是 fal 的实验性直播:频道运行 MiniMax H3 Max Director,这是一场实时 WebRTC 会话,你可以在视频持续播放时用新提示词操控。它不是本页的片段生成器。PixExact 使用的是标准 H3 Max 文生视频和图生视频接口,返回的是完整文件。

准备好运行 MiniMax H3 Max 了吗?

从提示词或一张静帧开始。生成 5 到 15 秒带原生立体声音频的 AI 视频,然后下载成片。新账号含免费积分。