Google DeepMind lance de nouveaux modèles d'IA plus efficients
Google DeepMind a dévoilé trois nouveaux modèles d'IA, dont Gemini 3.6 Flash, visant à réduire les coûts des agents d'IA grâce à une meilleure efficacité des tokens.

Google DeepMind lance de nouveaux modèles d'IA plus efficients
Google DeepMind a annoncé la sortie de trois nouveaux modèles d'IA propriétaires : Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, qui, selon l'entreprise, figurent parmi les plus efficaces en termes de tokens à ce jour.
Ces modèles sont conçus pour rendre les agents d'IA plus rapides, plus intelligents et plus économiques à grande échelle. Gemini 3.6 Flash est proposé à 1,50 $ par million de tokens d'entrée et 7,50 $ par million de tokens de sortie via son API. Gemini 3.5 Flash-Lite est proposé à un tarif nettement inférieur de 0,30 $ et 2,50 $ par million de tokens d'entrée et de sortie, respectivement.
Ces nouveaux modèles offrent des économies de coûts considérables par rapport aux versions précédentes et à certains concurrents, en particulier pour les tâches nécessitant un traitement prolongé. Bien que l'ancien Gemini 3.1 Flash-Lite reste le modèle le plus rentable, le nouveau Gemini 3.5 Flash-Lite offre une vitesse deux fois supérieure, offrant aux entreprises qui privilégient la performance une option plus économique.
Gemini 3.6 Flash et Gemini 3.5 Flash-Lite sont immédiatement disponibles via l'API Gemini. Gemini 3.5 Flash Cyber est conçu pour la recherche en cybersécurité et sera accessible aux gouvernements et partenaires sélectionnés via la plateforme CodeMender. Tous les modèles sont propriétaires et à code source fermé.