Le serveur IA Vera Rubin de Nvidia enregistre des gains de performance significatifs lors de tests
Le serveur IA Vera Rubin de Nvidia a été testé avec le modèle DeepSeek-V4-PRO 1.6T. Les résultats indiquent des améliorations substantielles du débit par mégawatt.

Nvidia a évalué son serveur IA Vera Rubin en utilisant la charge de travail SemiAnalysis AgentX et le modèle DeepSeek-V4-PRO 1.6T. Les tests révèlent que le système Vera Rubin atteint un débit jusqu'à 30 fois supérieur par mégawatt par rapport à la génération précédente Grace Blackwell.
Le débit par mégawatt (Tokens par Mégawatt) est une métrique clé pour mesurer l'efficacité énergétique des centres de données d'IA. Il quantifie le nombre de tokens d'IA pouvant être générés dans un budget énergétique fixe.
Lors des tests avec la charge de travail DeepSeek-V4-PRO 1.6T, le serveur GB300 NVL72 basé sur Grace Blackwell a démontré un débit 15 fois supérieur par mégawatt par rapport à la configuration H200 NVL8 Hopper. Le coût par million de tokens pour les serveurs Blackwell représente environ un dixième de la génération précédente, permettant ainsi plus d'agents IA dans le même budget énergétique et d'infrastructure, ou le maintien de la même capacité à des coûts opérationnels réduits.
Le système Vera Rubin renforce davantage cet avantage. Sur le modèle DeepSeek V4 Pro, le système Vera Rubin NVL72 offre environ 30 fois le débit par mégawatt du GB300 NVL72. De plus, le coût par million de tokens est rapporté comme étant 35 fois inférieur, ce qui permet une opération continue et à grande échelle des agents IA pour répondre aux diverses exigences de charge de travail des clients.