RT vLLM vLLM现在支持NVIDIA的Vera Rubin了。初步结果显示,与GB200相比,在AgentX上的MiniMax M3上,吞吐量提高了超过7.8倍。自从Vera Rubin宣布以来,@inferact、@NVIDIAAI、@RedHatAI 和 vLLM 社区一直在努力将vLLM部署到Vera Rubin上。目前进展如何呢?👇 1/5
—— SemiAnalysis (@SemiAnalysis) X帖子|2026-10-10T01:49:50+00:00
原帖:https://x.com/SemiAnalysis_/status/2108745004625859047
SemiAnalysis:RT vLLM vLLM现在支持NVIDIA的Vera Ru…
RT vLLM vLLM现在支持NVIDIA的Vera Rubin了。初步结果显示,与GB200相比,在AgentX上的MiniMax M3上,吞吐量提高了超过7.8倍。自从Vera Rubin宣布以来,@inferact、@NVIDIAA
扫描二维码,在手机上阅读
