多模态引导 • 原生立体声 • 2K 输出 • 最长 15 秒
MiniMax H3 AI 视频生成器
将文字概念或完整的创意简报转化为有导向的视频。MiniMax H3 将文本、图像、视频片段和音频参考整合到一个工作区,让您能更精准地塑造角色形象、动作、镜头语言、声音和视觉风格。
更可控的 MiniMax H3 工作流
告别简单的单行提示词,这个工作区专为可控的视觉开发、声音指导和生产迭代而设计。
一份简报,多种媒体类型
在一个请求中结合文字指令、图片、视频片段和音频。为每个参考素材分配明确的用途,无论是主体形象、艺术风格,还是镜头运动、时间节奏或声音表现。
768P 快速迭代,2K 细节呈现
在 768P 下高效探索创意,当产品纹理、文字排版、环境细节或演示质量更重要时,选择 2K 输出。
画面与立体声同步生成
在指导视觉的同时,同步指导对话、环境音、音效和音乐。原生音频生成让动作和声音感觉像是一个整体场景的规划,而非后期拼凑。
更长的创意节拍
生成 4 到 15 秒的片段,以适应揭示、镜头转场、产品演示和需要更多空间来展现的动作,而不是短促的视觉循环。
参考素材引导运动控制
使用视频片段传达运动,用图片固定构图,用图像保持主体一致性,或用音频影响表达和节奏——然后用自然语言解释这些关系。
透明的点数预估
生成前即可查看预计的点数消耗。时长、所选分辨率、输入视频长度和额外图片都会实时反映在预估中。
如何生成 MiniMax H3 视频
三步搞定,从概念到可下载的导演级视频。
选择合适的起始模式
开放式概念用文本模式;构图需要精确开头或结尾时用图片模式;现有视觉和音频素材需要引导镜头时,用多模态参考模式。
撰写制作导向的提示词
定义主体、动作、场景、镜头、光线、节奏、对话和声音。对于每个参考素材,解释 MiniMax H3 应该借鉴什么,忽略什么。
选择设置并生成
设置 768P 或 2K 画质,选择画面比例和 4-15 秒的时长,查看点数预估,然后生成并下载完成的视频。
Bimg AI 定价:Nano Banana 图片与 AI 视频
选择订阅或积分包,用于 Nano Banana 图片编辑、Nano Banana Pro/2、图片增强工具和 AI 视频模型。
可随时取消
入门版
节省30%适合体验 Nano Banana、图片工具和轻量创作项目。
包含功能
- 每年 4200 个 Bimg AI 积分
- Nano Banana 图片编辑模型
- Nano Banana Pro / Nano Banana 2 模型
- Seedream 4.5 模型
- Veo 3.1、Sora 2、Wan 2.5/2.6 AI 视频模型
- Flux Kontext 图片模型
- 最多上传 5 张参考图
- 最多创建 2 个批量任务
- Nano Banana Pro 最多支持 2K 分辨率
- 3x/4x AI 图片增强
- 标准处理速度
- 标准生成成功率
- 标准客服支持
- 商业许可
适合探索 Bimg AI 图片与视频创作流程。
专业版
节省50%适合需要 Nano Banana Pro、4K 输出和 AI 视频生成的创作者。
包含入门版所有功能
- 每年 19200 个 Bimg AI 积分
- Nano Banana 图片编辑模型
- Nano Banana Pro / Nano Banana 2 模型
- Seedream 4.5 模型
- Veo 3.1、Sora 2、Wan 2.5/2.6 AI 视频模型
- Flux Kontext 图片模型无限量使用
- 最多上传 10 张参考图
- 最多创建 10 个批量任务
- Nano Banana Pro 最多支持 4K 分辨率
- 3x/4x AI 图片增强
- 优先处理速度
- 高生成成功率
- 高速下载通道
- 优先客服支持
- 无限制的商业许可
Nano Banana Pro 与 AI 视频生成的高性价比选择。
高级版
节省50%适合团队、代理商和高频图片/视频商业工作流。
包含专业版所有功能
- 66,000 积分 / 年
- Nano Banana 图片编辑模型
- Nano Banana Pro / Nano Banana 2 模型
- Seedream 4.5 模型
- Veo 3.1、Sora 2、Wan 2.5/2.6 AI 视频模型
- Flux Kontext 图片模型无限量使用
- 最多创建 10 个批量任务
- 最多上传 10 张参考图
- Nano Banana Pro 最多支持 4K 分辨率
- 3x/4x AI 图片增强
- 最快处理速度
- 高级 Bimg AI 编辑能力
- 永久创作资产存储
- 专属客户经理
- 无限制的商业许可
适合团队和高频 Bimg AI 创作工作流。
有任何关于支付的问题,联系支持邮箱:联系我们
MiniMax H3 常见问题解答
关于 MiniMax H3 输入、输出设置、音频、参考素材和 Bimg AI 点数定价的实用解答。
MiniMax H3 主要用于什么?
MiniMax H3 是一个多模态视频生成模型,能将文本、图像、视频和音频解读为相互关联的创意指导。它适用于广告、产品场景、角色概念、社交视频、视觉开发和电影实验。
如何在 Bimg AI 上制作 MiniMax H3 视频?
选择「文本生成视频」、「图片生成视频」或「多模态参考」模式;编写场景描述;上传任何辅助媒体;选择画质、比例和时长;查看点数预估;然后开始生成。
MiniMax H3 可以同时使用图片、视频和音频吗?
可以。「多模态参考」模式可以结合这三者。为了更强的控制力,请告诉模型哪个文件定义外观,哪个展示动作,哪个提供声音、音乐、环境音或时间节奏。
MiniMax H3 能和视频一起生成声音吗?
是的。该模型可以与视觉内容一起生成原生的立体声音频。当对话、人声特征、环境音、音乐和音效等元素很重要时,请在提示词中包含这些指导。
有哪些分辨率和时长可选?
Bimg AI 工作区提供 768P 和 2K 输出,可选时长从 4 到 15 秒,画面比例有横屏、方形、竖屏、超宽屏或自动模式。
MiniMax H3 生成视频需要多少点数?
768P 每生成或输入视频秒数消耗 18 点数,2K 每秒消耗 29 点数。前 5 张输入图片免费,每增加一张图片消耗 8 点数,音频输入免费。最终总费用会向上取整。
如何获得更一致的 MiniMax H3 生成结果?
使用具体的视觉语言,描述镜头和时间节奏,保持指令内部一致,并为每个参考素材分配一个明确的作用。如果形象或构图很重要,优先使用强有力的图片参考,而不是添加不必要的文件。
让每个镜头都有声有色
生成细节丰富的2K视频,支持全模态参考、原生立体声,精准控制,让短片充满导演的意图。
