Transcripción inteligente con Gemini 3.5 Transcribe
Resumen
Google ha presentado Gemini 3.5 Transcribe, su modelo de voz a texto más preciso hasta la fecha, diseñado para interacciones de voz inteligentes. El modelo convierte audio sin procesar directamente en texto pulido y con formato, manejando el ruido de fondo, las autocorrecciones y las muletillas. Disponible para desarrolladores en Google AI Studio y Gemini Enterprise Agent Platform, ofrece transmisión en tiempo real y procesamiento de audio pregrabado con atribución de hablantes. Sus características clave incluyen bajas tasas de error de palabras, soporte para vocabulario personalizado, llamadas a funciones y detección automática de más de 85 idiomas. Las integraciones abarcan Android, macOS, Gboard y próximamente Chrome.
(Fuente:Gemini)