SemiAnalysis:RT vLLM vLLM现在支持NVIDIA的Vera Ru…


RT vLLM vLLM现在支持NVIDIA的Vera Rubin了。初步结果显示,与GB200相比,在AgentX上的MiniMax M3上,吞吐量提高了超过7.8倍。自从Vera Rubin宣布以来,@inferact、@NVIDIAA

RT vLLM vLLM现在支持NVIDIA的Vera Rubin了。初步结果显示,与GB200相比,在AgentX上的MiniMax M3上,吞吐量提高了超过7.8倍。自从Vera Rubin宣布以来,@inferact、@NVIDIAAI、@RedHatAI 和 vLLM 社区一直在努力将vLLM部署到Vera Rubin上。目前进展如何呢?👇 1/5

—— SemiAnalysis (@SemiAnalysis
) X帖子|2026-10-10T01:49:50+00:00
原帖:https://x.com/SemiAnalysis_/status/2108745004625859047



扫描二维码,在手机上阅读

X榜单(2026年10月10日 10:45 北京时间)

SemiAnalysis:我们把SGLang带到了NVIDIA的Vera Rubin上…

评 论
评论已关闭