写提示词
描述主体、镜头运动、光线与氛围。

暂未生成视频
输入提示词后点击生成即可开始
描述主体、镜头运动、光线与氛围。
可选添加最多两张首尾帧参考图。
选择 5/10/15 秒和五种画面比例之一。
查看结果,调整提示词后再次生成。
4
种输入模态
文字 · 图片 · 视频 · 音频
2K
原生模型输出
官方模型能力
24
帧每秒
电影感运动节奏
5–15秒
带声音片段
本站档位:5 / 10 / 15 秒
模型 / 01
MiniMax H3 是 MiniMax 推出的开源权重、通用多模态视频模型,可接收文字、图片、视频和音频,并生成 24fps 原生 2K 视频,在同一轮生成对话、音效与环境声。
成片工具 / 02
从结果卡片一键移交,或上传片段,在站内完成增强、换脸、换头与运动控制。
全能参考 / 03
MiniMax H3 可在一次生成中融合角色、运动、视觉风格和声音方向。
原生 2K 视频 + 同步声音
视频展示 / 04
六个 MiniMax H3 示例,覆盖品牌片、视觉创意、叙事、商品广告、交互设计与风格化动画。
协调角色、商品、场景与镜头语言的电影感时尚概念片。
实拍画面与发光手绘动画、环境声自然融合。
竖屏预告片保持角色连续性,逐步推进紧张氛围与镜头叙事。
快节奏剪辑中切换人物与构图,同时保持商品清晰可辨。
将产品界面转化为带有空间转场的精致交互演示。
英文漫画字幕与图形小说风格的英雄登场,构成紧凑的预告片节拍。
技术规格 / 05
应用场景 / 06
游戏 CG、角色 PV 与动画 UI 概念,跨帧保持视觉身份稳定。
黏土、像素、动漫与 3D 奇幻风格,逐镜头保持统一。
将产品静态图转化为展示、说明与广告概念视频。
面向社交、展示和联网电视的短广告方案。
用镜头语言和声音导演预告片、品牌片与短剧。
为 Shorts、Reels 与 TikTok 创作竖屏叙事片段。
模型对比 / 07
| 能力 | MiniMax H3 | Hailuo 2.3 |
|---|---|---|
| 最高分辨率 | 原生 2K | 1080P |
| 最长时长 | 15 秒 | 10 秒 |
| 原生音频 | 支持 | 不支持 |
| 参考输入 | 图片 + 视频 + 音频 | 首帧 |
| 提示词上限 | 7,000 字符 | 2,000 字符 |
| 权重 | 开源 | 闭源 API |
提示词实验室 / 08
复制提示词并粘贴到上方生成器中,MiniMax H3 已预选。
一名独行者在荒漠公路边走下复古轿跑车,迎风提起皮质手袋。从广角跟拍转入商品细节,午后暖光,保留克制的引擎声和荒漠环境声。
安静的厨房里,一只手放下玻璃杯,发光的手绘藤蔓从接触点向外生长。手机手持视角,自然早光,微弱室内环境声,动画延展时伴随轻柔闪烁音。
年轻吸血鬼与人类侦探在雨中的车站时钟下相遇,远处列车驶来。从紧张的双人镜头推进至特写,蓝色月光与红色实景灯交错,以两人对视结束。
创作一支竖屏眼镜时尚广告,三名模特通过匹配剪辑传递同一副银色眼镜。清晰影棚光、快速推镜与快门节奏,最后停在居中的商品主视觉。
将悬浮的 AI 助手卡片转化为高级网站交互演示。卡片展开成多层工作区,面板以平滑视差就位,冷色渐变与轻微界面音效,最后完整展示仪表盘。
一名剑修走过云端长桥,灵鹤环绕远处山中寺庙。从大幅度摇臂镜头转入快速侧向跟拍,青金色 3D 仙侠风格,风声与钟声交织,寺门打开时结束。
指令理解 / 09
H3 更擅长理解随时间发生的变化,而不只是一幅静态画面。让下列六个元素各自承担明确任务。
主体与意图
说清主体是谁、想要完成什么,以及哪些外观细节必须保持可辨。
时间线动作
依次描述开始状态、关键动作或变化,以及镜头最后如何结束。
场景与反应
设定地点、天气与氛围,再说明环境如何回应主体动作。
镜头语言
选择景别和运动:广角、特写、手持、跟拍、摇臂,或一次明确的镜头转换。
视觉与声音
同时指定光线、色彩、材质,以及对白、环境声、音效或音乐节奏。
参考一致性
说明每份参考素材负责控制身份、商品、构图、动作还是风格,并指出不能变化的部分。
常见问题 / 10
MiniMax H3 是 MiniMax 推出的通用多模态视频模型。它能理解文本与参考素材,规划镜头中的连续动作,并生成带同步对白、音效和环境声的视频。
在常见产品语境中,两者指向同一模型家族。MiniMax H3 是官方模型名;许多用户和第三方工具使用“Hailuo 3 / 海螺 3”与早期 Hailuo 版本衔接。
本站生成器提供 5、10、15 秒三档。对短视频来说,描述一条清晰的动作弧线,通常比塞入多个无关场景更容易获得稳定结果。
会。H3 可以随画面同步生成对白、音效和环境声。如果声音很重要,请在提示词中写明说话者、具体台词、所处环境和期望的声音质感。
本站提供 480P、720P、1080P,以及 16:9、9:16、4:3、3:4、1:1。竖屏社交内容选 9:16,横屏叙事选 16:9,目标平台需要方形素材时选 1:1。
全能参考是 H3 协同使用图片、视频和音频,约束身份、动作、视觉风格与声音的能力。本页当前提供文生视频和首尾帧图片引导,是完整模型能力中的聚焦子集。
MiniMax 将 H3 定位为开源权重模型。自托管仍需要合适的 GPU 资源、模型文件与兼容推理栈;偶尔生成时,本页的托管方式更直接。
相比 Hailuo 2.3,H3 增加了原生同步音频、更丰富的多模态参考控制、更长指令、更高原生分辨率能力与开源权重。实际价值是能控制一个完整镜头,而不只是生成一张更好的首帧。
可以先写提示词并准备参考图,无需提前登录。点击“免费生成视频”后会打开账号弹窗;新账号获得 20 积分,可完成两次默认 480P、5 秒生成。
先写主体和目标,再依时间顺序描述动作、环境、镜头运动、光线与声音,最后指定结束画面。一条连贯叙事通常比无关视觉形容词的堆叠更容易被模型准确执行。
开场构图、角色或商品必须精确时,使用首帧;镜头需要抵达某个特定构图时,再添加尾帧。提示词中要说明两张图之间如何运动和转换。
生成时间会受片段时长、分辨率和队列负载影响。任务被接收后,状态会保存到账号历史中;保持页面打开可查看实时进度,也可稍后回到历史页检查结果。
如果服务商返回了明确原因,失败任务会展示对应错误。未成功任务预扣的积分会自动退回;如果状态长时间停滞,联系客服时请提供任务 ID。
商用范围取决于模型与服务条款,以及你是否拥有提示词、Logo、人脸、声音和参考素材的必要权利。生成行为本身不会自动完成版权、商标、肖像或声音授权。
不可以。只能处理你拥有或获授权的素材,禁止未经授权的冒充和欺骗用途。