Google DeepMind stellt neue, effizientere KI-Modelle vor
Google DeepMind hat drei neue KI-Modelle, darunter Gemini 3.6 Flash, veröffentlicht, die darauf abzielen, die Kosten für KI-Agenten durch verbesserte Token-Effizienz zu senken.

Google DeepMind stellt neue, effizientere KI-Modelle vor
Google DeepMind hat drei neue proprietäre KI-Modelle auf den Markt gebracht: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und Gemini 3.5 Flash Cyber. Das Unternehmen gibt an, dass diese Modelle zu den bisher token-effizientesten gehören.
Die Modelle sind darauf ausgelegt, KI-Agenten schneller, intelligenter und kostengünstiger im großen Maßstab zu machen. Gemini 3.6 Flash wird über die API zu 1,50 US-Dollar pro Million Eingabetokens und 7,50 US-Dollar pro Million Ausgabetokens angeboten. Gemini 3.5 Flash-Lite ist mit 0,30 US-Dollar bzw. 2,50 US-Dollar pro Million Ein- und Ausgabetokens deutlich günstiger.
Im Vergleich zu früheren Versionen und einigen Konkurrenzmodellen bieten diese neuen Modelle erhebliche Kosteneinsparungen, insbesondere für Aufgaben, die eine längere Verarbeitung erfordern. Obwohl das ältere Gemini 3.1 Flash-Lite weiterhin das kosteneffizienteste Modell ist, bietet das neue Gemini 3.5 Flash-Lite die doppelte Geschwindigkeit und stellt für Unternehmen, die Leistung priorisieren, eine wirtschaftlichere Option dar.
Gemini 3.6 Flash und Gemini 3.5 Flash-Lite sind ab sofort über die Gemini API zugänglich. Gemini 3.5 Flash Cyber ist für die Cybersicherheitsforschung konzipiert und wird ausgewählten Regierungen und Partnern über die CodeMender-Plattform zur Verfügung gestellt. Es handelt sich bei allen Modellen um proprietäre Closed-Source-Lösungen.