Gemini 3.8 texto a voz dice hola
Resumen
Google introdujo dos nuevos modelos de texto a voz: Gemini 3.8 Flash TTS, diseñado para dirección creativa profunda y diseño de personajes, y Gemini 3.8 Flash-Lite TTS, optimizado para doblaje de alto volumen y agentes de voz eficientes. Flash TTS permite a los usuarios crear voces personalizadas desde cero usando prompts de lenguaje natural en más de 100 idiomas y dialectos, acceder a más de 2,000 voces listas para producción, replicar voces a partir de muestras de audio de 30 segundos con verificación de consentimiento y marca de agua SynthID, y dirigir actuaciones línea por línea con control granular sobre indicaciones de actuación, ritmo y cambios de dialecto. Ambos modelos admiten generación de audio largo, escenificación nativa de dos hablantes, y ráfagas vocales y interjecciones guionizadas para una textura conversacional realista. Gemini 3.8 Flash TTS obtuvo el primer puesto en el Voice Design Benchmark de Hume AI y en clasificaciones de modelado de acentos, mientras que ambos modelos se ubicaron primero y segundo respectivamente en el índice de calidad general de Hume AI. Los modelos están disponibles a través de Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook y Google Vids, con asociaciones que incluyen Figma, HeyGen, Linguana, Wondercraft, 99.co y Ollang.
(Fuente:Gemini)