Vera Rubin NVL72 추론 테스트는 1.6T DeepSeek 모델에서 Blackwell에 비해 MW당 토큰 처리량이 최대 7배 더 나은 것으로 나타났습니다. 이는 Huang가 1T-3T LLMs에 대해 주장한 3배보다 높습니다(Bryan Shan/SemiAnalysis).
Bryan Shan / SemiAnalysis : Vera Rubin NVL72 추론 테스트는 1.6T DeepSeek 모델에서 Blackwell에 비해 MW당 토큰 처리량이 최대 7배 더 나은 것으로 나타났습니다. 이는 Huang가 1T-3T LLMs에 대해 주장한 3배보다 높습니다. — Jensen Sandbag
Vera Rubin NVL72 inference tests show up to 7x better token throughput per MW vs. Blackwell on a 1.6T DeepSeek model, above Huang's 3x claim for 1T-3T LLMs (Bryan Shan/SemiAnalysis)
Bryan Shan / SemiAnalysis : Vera Rubin NVL72 inference tests show up to 7x better token throughput per MW vs. Blackwell on a 1.6T DeepSeek model, above Huang's 3x claim for 1T-3T LLMs — Jensen Sandbag
Techmeme, 한글로 옮겨왔어요