核心信息
MiniMax M3 现已通过 vLLM 支持 NVIDIA Vera Rubin NVL72,由 Inferact、NVIDIA AI 与 Red Hat AI 共同推动上线。
要点
- vLLM 早期结果表明,MiniMax M3 在 AgentX 上的吞吐量是 GB200 的 7.8 倍以上
- vLLM 自 Vera Rubin 发布以来已更新以支持该硬件
- 多家合作伙伴参与了模型在新硬件上的部署
MiniMax M3 现已通过 vLLM 支持 NVIDIA Vera Rubin NVL72,由 Inferact、NVIDIA AI 与 Red Hat AI 共同推动上线。