Fal 将 MiniMax 的开源视频模型加速 35 倍,且质量没有损失
核心要点
- 该生成媒体平台的新 H3 Max 模型可在三秒内生成一个五秒的视频剪辑,使人工智能视频生成比实时拍摄更快。
- Fal 于 8 月 27 日推出了 H3 Max,这是 MiniMax 开源 H3 视频模型的训练后变体,其吞吐量约为 MiniMax 官方端点的 35 倍。
- Fal 专门为比实时更快的应用程序构

该生成媒体平台的新 H3 Max 模型可在三秒内生成一个五秒的视频剪辑,使人工智能视频生成比实时拍摄更快。
Fal 于 8 月 27 日推出了 H3 Max,这是 MiniMax 开源 H3 视频模型的训练后变体,其吞吐量约为 MiniMax 官方端点的 35 倍。
H3 Max 在不到 3 秒的挂墙时间内生成带有同步立体声音频的 5 秒 768p 视频剪辑。 Fal 表示,该模型的速度比同等质量水平的领先竞争对手快约 15 倍。
凯莱 询问有关任何股票的任何问题 — 凯莱财经在几秒钟内为您提供完整的、有数据支持的答案。询问格洛丽亚 →
在人类偏好评估中,H3 Max 在 Design Arena 图像到视频排行榜上的 Elo 评级为 1,341,在人工分析图像到视频与音频排行榜上的 Elo 评级为 1,201,在这两个类别中均排名第一。
MiniMax H3 团队认可了这一结果,并指出 Fal 的增强功能使得在更广泛的范围内生成实用视频成为可能,而无需从基本模型中剥离任何核心功能。
Fal 的方法涉及广泛的后期培训,重点关注两个领域:及时遵守和视觉保真度。从那里,一个专门的推理引擎优化了视频生成管道。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
H3 Max 的运行分辨率为 768p,低于 MiniMax 原始型号的 2K 输出。 Fal 专门为比实时更快的应用程序构建了 H3 Max,包括实时交互式流媒体、广播期间的实时内容生成以及社交平台的动态视频创建。
Fal 推出了 H3 Max,第一周提供 50% 的介绍性折扣,可通过其平台和 API 访问。
MiniMax 最初的 H3 模型旨在适应各种输入类型,包括文本、图像、视频和音频,能够以 2K 分辨率生成 15 秒的剪辑,并具有原生立体声音频输出。 Fal 最初托管 MiniMax 模型,采用开放权重并使用新数据集进行后期训练,该数据集专注于即时依从性和审美品质,强调强化学习技术。
