goenhance logo

MiniMax H3 AI 视频生成器

通过原生多模态理解创作电影级视频。利用文本、图像、运动参考、摄像机引导和音频输入来生成、编辑和转换视频。

试用 MiniMax H3

MiniMax H3 参数与核心功能

功能规格能力
视频生成5-15 秒 / 24 FPS / 最高 1440p通过文本、图像、视频和音频创作电影级 AI 视频
多模态输入文本、图像、视频、音频理解角色、动作、场景、风格、声音和叙事意图
参考控制最多 9 张图像 + 3 个视频 + 3 个音频文件结合角色、产品、运动、摄像机和语音参考
原生音频内置立体声生成生成对话、环境音、音效、音乐和情感音频
视频编辑局部精准编辑更改角色、物体、背景、服装、光影、特效和对话
运动迁移基于视频的运动和摄像机参考复制动作、表情、表演节奏、摄像机运动和剪辑风格
语音迁移语音克隆与迁移创建一致的角色声音和多语言对话
支持的宽高比21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16适用于电影、广告、社交媒体和电子商务
提示词理解最多 7000 个字符支持复杂的剧本、分镜脚本和详细的制作指令
商业创作广告、品牌、游戏、电子商务专为专业内容制作工作流而设计

H3 的核心功能

商业级多场景内容生成

H3 支持多种内容格式,包括文本、字幕、品牌信息、UI/UX 元素、游戏视觉效果和电商展示。它助力创作者快速探索视频概念、开发产品展示、扩展 IP 角色场景,并支持创意团队进行概念验证、故事板预览以及电影、广告、游戏、品牌推广和商业领域的内容提案。
提示词参考图像生成片段

原生多模态理解与生成

H3 支持多种输入类型,包括文本、图像、音频和视频。它将所有资产视为统一的语境,理解信息、声音、情感、视觉和创意意图之间的关系,从而实现整合的内容理解与视听生成。核心能力包括多源参考生成、角色与镜头引导、语音迁移与克隆,以及对视觉风格、叙事节奏、声音氛围和剪辑模式的理解。
提示词参考图像参考视频生成片段

全能型精准编辑与修改

H3 支持跨维度的精准编辑,包括角色替换、动作参考、背景更换、视觉特效、对话替换和氛围调整。凭借强大的指令遵循能力,它能准确执行创作者对视觉、音频和节奏的要求,同时保持未编辑元素稳定。核心功能包括对象与角色编辑、场景与视觉特效调整、语音与对话修改,以及高精度的局部控制。
提示词参考图像参考视频生成片段

探索 MiniMax H3 的功能

了解 MiniMax H3 如何通过多模态理解、智能编辑和视听同步生成技术,将创意转化为专业的 AI 生成视频。
文本与图像转视频

文本与图像转视频

通过文本提示词、图像或组合参考素材,生成高质量的电影级视频。H3 能够理解角色、环境、视觉风格和叙事意图,从而创作出连贯的场景。

尝试 MiniMax H3
常见问题

MiniMax H3 常见问题解答

什么是 MiniMax H3?

MiniMax H3 是一款多模态 AI 视频模型,能够利用文本、图像、视频和音频参考素材来生成及编辑视频。

H3 能生成带声音的视频吗?

可以。H3 生成的视频包含原生立体声音频,涵盖对白、音效、环境音和音乐。

H3 最多可以使用多少个参考文件?

H3 最多支持 9 张图像、3 个视频和 3 个音频参考文件,总计最多可混合使用 12 个文件。

H3 可以编辑现有视频吗?

可以。它能够替换角色、修改物体、更换背景、调整特效以及更新对白或音色。

H3 支持竖屏视频吗?

支持。它支持多种长宽比,包括适用于短视频平台的 9:16 比例。

H3 能保持角色一致性吗?

可以。通过角色参考、动作参考和音色参考,有助于在生成的内容中保持角色身份的一致性。

哪些行业可以使用 H3?

H3 适用于广告、娱乐、游戏、动画、电子商务和社交媒体内容创作等领域。

使用 MiniMax H3 创作专业 AI 视频

通过这一强大的多模态 AI 模型,生成电影级视频、编辑现有素材、迁移动作并创作同步的视听体验。

探索 MiniMax H3