Producto · 30 de agosto de 2026

También publicado en Deutsch

Google lanza el modelo Gemini 3.5 Transcribe para convertir voz en texto con alta precisión

group of people sitting beside rectangular wooden table with laptops
Christina @ wocintechchat.com M / Unsplash

Google presentó el modelo Gemini 3.5 Transcribe, diseñado para transcribir voz a texto con un rendimiento destacado. La herramienta está dirigida a usuarios que buscan convertir discursos espontáneos, entrecortados o con pausas naturales en frases claras y estructuradas.

Gemini 3.5 Transcribe forma parte de la familia de modelos de lenguaje avanzado de Google y se integra en funciones como Rambler, disponible en dispositivos Android y anunciado durante el Google I/O 2026. Su lanzamiento inicial se realizó con el Pixel 11, donde demostró capacidad para procesar hasta tres voces simultáneas en entornos ruidosos.

Según datos técnicos compartidos por la compañía, el modelo logra una tasa de error por palabra (WER) del 4% en transcripciones en tiempo real y del 2,6% en archivos de audio previos. Además, incorpora un vocabulario personalizable para mejorar la precisión en términos específicos y soporta 85 idiomas, con detección automática del idioma utilizado.

La herramienta ya está disponible en la aplicación Gemini para macOS, así como a través de API para desarrolladores. Google anunció que en las próximas semanas se integrará en el navegador Chrome, permitiendo a los usuarios completar formularios mediante comandos de voz.

El lanzamiento de este modelo se produce en un contexto donde Google continúa expandiendo su ecosistema de inteligencia artificial, aunque aún no ha lanzado la versión completa de Gemini 3.5 Pro, prevista para un futuro cercano.

Informado por Blognone.