L'IA Claude d'Anthropic permet le déploiement de GPU AMD sans modification de code
Le modèle d'IA Claude d'Anthropic a été exécuté avec succès sur les nouveaux GPU MI355X d'AMD sans que les ingénieurs aient besoin de modifier du code. Cet événement remet en question l'écosystème CUDA de Nvidia.

Selon IT Home, le modèle d'IA Claude d'Anthropic a été déployé avec succès sur le nouveau matériel GPU MI355X d'AMD sans que les ingénieurs humains aient eu besoin de modifier le code.
Le processus rapporté impliquait qu'AMD livre un rack de processeurs MI355X à Anthropic. Le modèle d'IA a ensuite été chargé de configurer et d'exécuter la nouvelle plateforme matérielle. Au cours d'un seul week-end, Claude aurait accompli la tâche et continué à améliorer les performances sans intervention manuelle.
Ce développement pourrait constituer un défi pour l'écosystème logiciel CUDA de Nvidia, âgé de 20 ans et dominant la programmation GPU. La boîte à outils ROCm.AI d'AMD, dotée de AMD Skills et de connaissances ROCm vérifiées, est conçue pour permettre à l'IA de configurer des environnements, charger des modèles, lire des journaux et résoudre des problèmes de manière autonome.
AMD adapte également sa documentation, rendant son architecture de jeu d'instructions (ISA) lisible par l'IA pour chaque nouvelle génération de GPU. Cela permet aux agents d'IA, tels que Hyperloom, d'optimiser directement les performances en interprétant des manuels techniques. Hyperloom a déjà démontré des améliorations significatives de performance, comme une augmentation de 38 % de la vitesse de sortie pour le MiniMax M3.
L'entreprise vise à former des modèles avancés pour qu'ils s'intègrent de manière transparente au matériel AMD. Ce changement stratégique suggère que le développement futur des GPU ne se concentrera pas seulement sur la performance brute, mais aussi sur la capacité de l'IA à comprendre et optimiser le matériel, accélérant ainsi potentiellement l'adoption de nouvelles architectures.