ADVERTISEMENT
REDACCIÓN EN VIVO·Redacción de mercados globales·Last updated 14s ago
ADVERTISEMENT
Novara — A Smarter Way to Access Global Markets
Mercados/ForexArticle

Google presenta Gemini 3.5 Transcribe para convertir el habla en texto en tiempo real

El nuevo modelo reduce la latencia de transcripción a menos de un segundo y reduce las tasas de error hasta en un 70 %, en comparación con el modelo precedente Chirp 3, con soporte para más de 85 idiomas y detección de varios hablantes.

SL
Sophie Laurent · FX & Rates Desk · 30 Aug 2026 · 14:42 · 1 min de lectura
Compartir
Google presenta Gemini 3.5 Transcribe para convertir el habla en texto en tiempo real

El miércoles, Alphabet presentó Google Gemini 3.5 Transcribe, un modelo de voz a texto diseñado para la transcripción en tiempo real con latencia de menos de un segundo y una mejora de la precisión respecto a su predecesor, Chirp 3.

El nuevo modelo reduce el tiempo hasta la transcripción final en un 70% en comparación con Chirp 3, al tiempo que mantiene una tasa de errores de palabra en transmisión del 4,0% y una tasa fuera de transmisión del 2,6%, según Artificial Analysis. En las pruebas de benchmark en el conjunto de datos FLEURS, registró una tasa de error en transmisión del 5,50% y una tasa fuera de transmisión del 5,04%.

Euro / US Dollar

EURUSD
Full profile →
1.1587▲ 0.00%
As of 30/08/2026, 09:40:33

Gemini 3.5 Transcribe está disponible a través de dos interfaces de API: la API en vivo para streaming en tiempo real con una latencia de menos de un segundo, y la API de Interacciones para audio grabado previamente, como reuniones y registros de llamadas. Esta última incluye identificación de oradores para hasta tres voces con transcripciones con tiempo de registro.

El modelo admite la detección automática del idioma en más de 85 lenguas e incorpora funciones como la eliminación de palabras de relleno, la formateado automático del texto y el reconocimiento de vocabulario personalizado para la terminología especializada. Está entrando en previsualización pública para desarrolladores a través del Google AI Studio y para empresas a través de la plataforma Gemini Enterprise Agent.

Google tiene previsto integrar la tecnología en la aplicación Gemini en macOS, la función Rambler en Android a través de Gboard y en una futura actualización de la herramienta de dictado incorporada de Chrome. La compañía no ha revelado los precios ni los plazos de disponibilidad comercial.

Este artículo fue producido con asistencia de IA y editado por un periodista de Finance Review Daily.
ADVERTISEMENT
Compartir esta noticia
SL
Escrito por
Sophie Laurent
FX & Rates Desk

Sophie covers currency markets and central bank policy across Europe, with a focus on how rate decisions ripple through FX pairs. She has been tracking the ECB's policy path since the start of the current easing cycle.

Más de Sophie Laurent →
ADVERTISEMENT
ADVERTISEMENT