AI资讯

英特尔为开源多模态视频模型MiniMax H3提供Day 0支持,实现8卡GPU部署方案

英特尔宣布为开源多模态视频模型MiniMax H3提供Day 0首发支持,并实现基于多卡GPU的部署方案,提升了视频生成全流程的计算效率。

AI云图智寻编辑部2026-08-03 15:46
阅读时间:约 3 分钟
英特尔为开源多模态视频模型MiniMax H3提供Day 0支持,实现8卡GPU部署方案
英特尔今日宣布,为新一代开源多模态视频模型MiniMax H3提供Day 0首发支持。通过使用锐炫Pro B70 GPU,英特尔团队实现了一种基于8卡GPU的部署方案,大幅提升了视频生成全流程的计算效率。

多卡GPU部署方案详解

英特尔团队采用了一种基于多卡GPU的部署方案,该方案包括Encoder 8卡张量并行(8TP)、DiT 8卡USP(Ulysses Sequence Parallel),以及VAE部署于B70 GPU的整体架构。这种架构实现了视频生成全流程的GPU加速。其中,Encoder采用8卡张量并行完成文本编码;DiT模块则通过8卡USP结合Layer-wise Offloading技术,使模型参数按层动态加载到GPU,在突破单卡显存限制的同时,支持更大规模DiT模型的部署。

混合并行方案提升性能

为进一步提升推理性能,英特尔团队开发了2TP×4USP的混合并行方案。相较于纯8卡USP,该方案将USP并行度由8降至4,并引入2路张量并行对计算进行协同加速。这在保持模型扩展能力的同时,减少了USP带来的通信开销,实现了计算负载与通信开销之间更优的平衡。此外,团队还结合llm-scaler-omni项目的XPU Kernel优化,对矩阵乘法、注意力等关键算子进行了持续优化,进一步提升了GPU的计算效率。

业务背景与影响

英特尔此次为MiniMax H3提供的Day 0支持,标志着其在多模态视频处理领域的进一步布局。MiniMax H3是一个支持多模态上下文和2K分辨率的通用视频模型,其开源版本已经发布。英特尔的这一部署方案不仅提升了视频生成的效率,还为大规模视频生成模型提供了更具扩展性的部署方式。通过这些优化,英特尔进一步巩固了其在AI硬件和软件生态系统中的地位,为未来更多复杂模型的部署奠定了基础。