原生音频
对白、音效和空间环境声与画面在同一流程中生成
使用 MiniMax H3 AI 视频生成器规划 2K 视频,支持原生立体声音频、文生视频提示词、首帧或尾帧图像控制、多模态参考和自然语言编辑。
MiniMax H3 是用于创建 2K 短片的 AI 视频工作流,支持原生音频、文本提示词、图像控制和多模态参考。先用上方工作台生成,再通过下方规格了解模型能力。
对白、音效和空间环境声与画面在同一流程中生成
24 fps 原生输出分辨率
视频时长,按整秒生成
MiniMax 发布的开放权重视频模型
最多 9 个图像参考、3 个视频参考和 3 个音频参考
控制视频如何开始、在哪里结束,以及两帧之间的运动如何过渡
在一个生成镜头中呈现人物反应、面部节奏和细腻情绪
生成前先比较当前生产视频选项的积分消耗。Fast 适合多次尝试,Pro 适合需要更精修的最终镜头。
| 模型 | 定位 | 每秒积分 | 5 / 10 / 15 秒 | 输出说明 | 适用场景 |
|---|---|---|---|---|---|
MiniMax H3工作台默认 | MiniMax H3 工作台默认 | 8–16 积分 / 秒 | 2K:5 秒 = 80 · 10 秒 = 160 · 15 秒 = 240 | EvoLink 原生 2K:16 积分/秒;768p:8 积分/秒 | 适合使用 H3 落地页工作台、生成前明确看到消耗,并进行低成本草稿迭代。 |
Seedance 2.0 Fast同档消耗 | 同档消耗 | 8 积分 / 秒 | 5 秒 = 40 · 10 秒 = 80 · 15 秒 = 120 | 720p 生成 | 适合初稿、社媒广告、提示词测试、落地页短片和更快的创意迭代。 |
Seedance 2.0 Pro更高质量 | 更高质量 | 12 积分 / 秒 | 5 秒 = 60 · 10 秒 = 120 · 15 秒 = 180 | 720p Pro;1080p 为 30 积分 / 秒 | 适合最终首屏视频、品牌视觉、精修产品镜头,以及细节比成本更重要的场景。 |
为营销活动、界面动效、产品视频、人物场景和带参考素材的视频编辑编写提示词,并让声音与画面保持一致。
用导演式提示词描述快速推镜、恶劣天气、物体运动、人物动作和场景转场,让画面运动更明确。
写清主体、构图、镜头运动、灯光、情绪和节奏,用 MiniMax H3 AI Video Generator 生成完整短片。
适合让人物、产品、插画角色和概念图动起来,并关注面部表情、身体动作和镜头连续性。
三步完成:添加上下文、描述镜头,然后生成并优化 MiniMax H3 结果。
从提示词、首帧、尾帧或参考媒体开始,让图像、运动或音频为最终镜头提供方向。
告诉 MiniMax H3 哪些内容要保留、哪些要改变、镜头怎么动,以及音频氛围应该是什么。
生成 5-15 秒视频,检查结果后继续优化运动、画面和声音描述。
从这些 H3 提示词结构开始,把产品、主体、参考素材、运动语言和音频方向替换成你的素材。
一个高端 SaaS 落地页变成 2K 电影感产品短片。保留清晰排版,让仪表盘卡片有轻微视差,加入细腻光标移动、原生立体声点击声和稳定的发布节奏。
使用图片 1 锁定人物身份,视频 1 提供肩部高度手持镜头运动,音频 1 提供说话节奏。人物转向镜头说一句短句,室内环境声与参考音频一致。
保留视频 1 的街道背景,只把车辆替换成图片 1 中的产品,保持原镜头路径和阴影,并加入克制的立体声城市环境音。
MiniMax H3 支持多种 AI 视频工作流。根据你的素材、参考需求、音频计划和制作时间选择合适模式。
MiniMax H3 AI Video Generator 是面向文本、图像、视频和音频参考的多模态 AI 视频工作流,可用于生成或编辑短视频。fal 提供托管的 H3 文生视频、图生视频和参考生成接口。
可以。工作台通过 EvoLink 调用真实的 MiniMax H3,支持文生视频和首尾帧图生视频,可选择 768p 或原生 2K 输出。
公开资料显示 MiniMax H3 支持 2K 视频和 5-15 秒时长。不同平台端点可能略有差异,批量生成前应以实际接口规则为准。
会。MiniMax H3 的特点之一是原生音频,可以根据提示词和参考生成配乐、对白、环境声或声音节奏。
fal 页面描述 reference-to-video 最多支持 9 张图片、3 个视频和 3 个音频参考,总文件数上限为 12 个。
适合。它很适合产品展示、发布短片、界面动效、社媒广告、动态海报和参考引导的品牌视频。