Copied


AMD GPU支持MiniMax-H3模型发布

realtime news   Aug 02, 2026 17:13 1 Min Read


AMD宣布,其Instinct MI355X和MI300X GPU将在零日支持来自中国AI公司MiniMax的最新视频生成模型MiniMax-H3。这一合作使这一强大的多模态模型能够高效运行在AMD的硬件上,标志着AI驱动的视频和音频生成领域的一个重要里程碑。

MiniMax-H3于2026年7月31日发布,代表了视频合成领域的一次代际飞跃。与其前身海螺系列不同,后者将文本转视频(T2V)和图像转视频(I2V)等任务分为独立的流水线处理,H3将文本、图像、视频和音频输入整合到一个框架中。该模型能够生成最长15秒的2K分辨率(1440p)视频片段,并配有同步的立体音频,超越了早期模型1080p、10秒输出的性能。它还引入了基于指令的视频编辑和参考驱动的动画等功能,使其成为最具多功能性的开源权重视频模型之一。

AMD的支持依靠其ROCm平台和SGLang框架来优化MiniMax-H3的高计算量架构。通过采用8路序列并行处理并利用AMD的AI Tensor Engine (AITER)内核,这些GPU确保了H3核心输出中视频-音频联合潜在空间的顺畅处理。这对于保持运动和声音之间的对齐至关重要,这是H3能力的一个显著特点。

模型架构本身具有高度的模块化。MiniMax-H3将任务分为两个模块:FL2VA用于文本转视频及帧条件输入,Ref2VA用于参考驱动的生成。每个模块都包括多模态文本编码器、专用的视频和音频VAE,以及一个同步去噪潜在空间的扩散变换器。这种设计不仅提高了性能,还使得部署在不同硬件配置上具有可扩展性。

除了技术上的进步,MiniMax-H3在MiniMax社区许可下的开源权重发布对开发者来说具有重要吸引力。它降低了视频生成实验的进入门槛,使H3在开放AI领域中占据了主导地位。该模型已在Atlas等平台上提供,用户可以以每秒$0.14的价格使用2K分辨率的服务。

对于AMD来说,此次发布突显了AI工作负载与其Instinct GPU产品线之间日益增长的协同效应。通过实现像MiniMax-H3这样尖端模型的高效部署,该公司展现了其在AI硬件市场上的竞争力,而这一市场长期以来一直由NVIDIA主导。这一合作还表明了对能够处理复杂扩散模型的高性能GPU的需求正在增加。

展望未来,AMD对MiniMax-H3的支持为进一步优化铺平了道路,包括批处理能力和内核性能的改进。随着AI驱动的视频生成日益受到关注,AMD和MiniMax似乎都已做好准备,抓住多模态内容创作日益增长的兴趣所带来的机遇。


Read More