Gcore améliore l'inférence IA avec une nouvelle technologie de routage
Gcore Labs a introduit le Routage d'Inférence Global, utilisant NVIDIA Dynamo pour accélérer les modèles d'IA. La nouvelle technologie vise à réduire la latence et à améliorer les performances des applications d'IA dans le monde entier.

Gcore Labs, un fournisseur mondial de services de cloud et d'edge computing, a lancé sa fonctionnalité de Routage d'Inférence Global. Cette technologie utilise NVIDIA Dynamo, conçue pour optimiser les performances des modèles d'intelligence artificielle.
Le nouveau mécanisme de routage vise à accélérer l'inférence IA, un processus essentiel pour de nombreuses applications d'apprentissage automatique. L'objectif est d'offrir une latence réduite et des performances améliorées pour les services qui dépendent du traitement de l'IA en temps réel.
Cette mise en œuvre soutient la stratégie de Gcore Labs visant à renforcer son offre en matière d'edge computing. L'entreprise ambitionne de fournir aux entreprises des outils plus efficaces pour exécuter des charges de travail d'IA plus près des utilisateurs finaux. Ceci est particulièrement pertinent pour les applications exigeant des réponses immédiates, telles que la conduite autonome ou l'analyse de données en temps réel.
Gcore Labs s'est récemment concentré sur l'expansion de ses services basés sur l'IA et les GPU. L'introduction de cette nouvelle technologie de routage fait partie d'une initiative plus large visant à répondre à la demande mondiale croissante en matière de capacités d'IA.