原生音频
对白、音效和空间环境声与画面在同一流程中生成
使用 MiniMax H3 AI 视频生成器规划 2K 视频,支持原生立体声音频、文生视频提示词、首帧或尾帧图像控制、多模态参考和自然语言编辑。
MiniMax H3 是用于创建 2K 短片的 AI 视频工作流,支持原生音频、文本提示词、图像控制和多模态参考。先用上方工作台生成,再通过下方规格了解模型能力。
对白、音效和空间环境声与画面在同一流程中生成
24 fps 原生输出分辨率
视频时长,按整秒生成
MiniMax 发布的开放权重视频模型
最多 9 个图像参考、3 个视频参考和 3 个音频参考
控制视频如何开始、在哪里结束,以及两帧之间的运动如何过渡
在一个生成镜头中呈现人物反应、面部节奏和细腻情绪
生成前先比较当前生产视频选项的积分消耗。Fast 适合多次尝试,Pro 适合需要更精修的最终镜头。
| 模型 | 定位 | 每秒积分 | 5 / 10 / 15 秒 | 输出说明 | 适用场景 |
|---|---|---|---|---|---|
MiniMax H3 Fast工作台默认 | MiniMax H3 工作台默认 | 8 积分 / 秒 | 5 秒 = 40 · 10 秒 = 80 · 15 秒 = 120 | H3 工作台显示为 2K;按当前快速视频链路扣费 | 适合使用 H3 落地页工作台、生成前明确看到消耗,并进行低成本草稿迭代。 |
Seedance 2.0 Fast同档消耗 | 同档消耗 | 8 积分 / 秒 | 5 秒 = 40 · 10 秒 = 80 · 15 秒 = 120 | 720p 生成 | 适合初稿、社媒广告、提示词测试、落地页短片和更快的创意迭代。 |
Seedance 2.0 Pro更高质量 | 更高质量 | 12 积分 / 秒 | 5 秒 = 60 · 10 秒 = 120 · 15 秒 = 180 | 720p Pro;1080p 为 30 积分 / 秒 | 适合最终首屏视频、品牌视觉、精修产品镜头,以及细节比成本更重要的场景。 |
为营销活动、界面动效、产品视频、人物场景和带参考素材的视频编辑编写提示词,并让声音与画面保持一致。
用导演式提示词描述快速推镜、恶劣天气、物体运动、人物动作和场景转场,让画面运动更明确。
写清主体、构图、镜头运动、灯光、情绪和节奏,用 MiniMax H3 AI Video Generator 生成完整短片。
适合让人物、产品、插画角色和概念图动起来,并关注面部表情、身体动作和镜头连续性。
三步完成:添加上下文、描述镜头,然后生成并优化 MiniMax H3 结果。
从提示词、首帧、尾帧或参考媒体开始,让图像、运动或音频为最终镜头提供方向。
告诉 MiniMax H3 哪些内容要保留、哪些要改变、镜头怎么动,以及音频氛围应该是什么。
生成 5-15 秒视频,检查结果后继续优化运动、画面和声音描述。
从这些 H3 提示词结构开始,把产品、主体、参考素材、运动语言和音频方向替换成你的素材。
一个高端 SaaS 落地页变成 2K 电影感产品短片。保留清晰排版,让仪表盘卡片有轻微视差,加入细腻光标移动、原生立体声点击声和稳定的发布节奏。
使用图片 1 锁定人物身份,视频 1 提供肩部高度手持镜头运动,音频 1 提供说话节奏。人物转向镜头说一句短句,室内环境声与参考音频一致。
保留视频 1 的街道背景,只把车辆替换成图片 1 中的产品,保持原镜头路径和阴影,并加入克制的立体声城市环境音。
MiniMax H3 支持多种 AI 视频工作流。根据你的素材、参考需求、音频计划和制作时间选择合适模式。
MiniMax H3 AI Video Generator 是面向文本、图像、视频和音频参考的多模态 AI 视频工作流,可用于生成或编辑短视频。fal 提供托管的 H3 文生视频、图生视频和参考生成接口。
可以。你可以在本页工作台输入提示词、选择视频设置、消耗积分并下载结果。当前工作台先接入快速生产视频链路,同时保留 MiniMax H3 的前台体验。
公开资料显示 MiniMax H3 支持 2K 视频和 5-15 秒时长。不同平台端点可能略有差异,批量生成前应以实际接口规则为准。
会。MiniMax H3 的特点之一是原生音频,可以根据提示词和参考生成配乐、对白、环境声或声音节奏。
fal 页面描述 reference-to-video 最多支持 9 张图片、3 个视频和 3 个音频参考,总文件数上限为 12 个。
适合。它很适合产品展示、发布短片、界面动效、社媒广告、动态海报和参考引导的品牌视频。