Google lanserar Gemini 3.5 Transcribe för AI-baserad tal-till-text
Google har lanserat Gemini 3.5 Transcribe, en ny AI-modell avsedd att förbättra tal-till-text-noggrannhet och hastighet. Modellen syftar till att producera renare, redigerade transkriptioner genom att ta bort utfyllnadsord och korrigeringar.

Google har introducerat Gemini 3.5 Transcribe, en artificiell intelligensmodell som syftar till att förbättra tal-till-text-funktioner genom att automatiskt redigera bort fyllnadsord som "öh" och egna korrigeringar. Denna nya modell, en del av Gemini 3.5-familjen, är utformad för att leverera polerade textresultat från talat språk.
Företaget anger att Gemini 3.5 Transcribe erbjuder betydande förbättringar i både hastighet och noggrannhet jämfört med sin föregångare, Chirp 3. Google rapporterar en 70-procentig hastighetsökning från röstinmatning till slutlig transkriberad text. Dessutom har felfrekvensen vid livesändning minskat till 5,5 procent, en förbättring jämfört med Chirp 3:s uppmätta felfrekvens på 7,32 procent.
Denna teknik är redan integrerad i Googles ekosystem och driver "Rambler"-funktionen i Gboard på Pixel-enheter. Den bredare utrullningen syftar till att göra röstinmatning mer effektiv och pålitlig för användare i olika Google-applikationer och tjänster.
Googles fortsatta utveckling inom AI-taligenkänning signalerar en fortsatt strävan att förfina användarinteraktionen med sina produkter, med målet att skapa smidigare och mindre felbenägna röstbaserade upplevelser.