Google lanza el modelo de transcripción de voz a texto Gemini 3.5

By: baijiahao.baidu.com|2026/08/27 05:06:00

Google ha lanzado el modelo de transcripción de voz a texto Gemini 3.5, diseñado para optimizar la experiencia de entrada de voz. Este modelo puede filtrar en tiempo real muletillas, corregir automáticamente errores de habla y admite 85 idiomas, así como audios de conversaciones de hasta 3 personas. Actualmente, ya está habilitado en la función 'Rambler' del teclado Gboard en el Pixel 11, y se expandirá a más servicios en el futuro. En comparación con su predecesor, Chirp 3, la velocidad de transcripción ha mejorado en aproximadamente un 70%, y la tasa de errores en tiempo real se ha reducido al 5,5%. El modelo admite un vocabulario personalizado, pero debido a su capacidad de comprensión semántica y pulido de texto, puede alterar la redacción original, lo que lo hace inapropiado para situaciones donde se requiere mantener las palabras originales.

Precio de --

--
--
--

Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.

Te puede gustar

iconiconiconiconiconiconicon
Atención al cliente:@weikecs
Cooperación empresarial:@weikecs
Trading cuantitativo y CM:bd@weex.com
Programa VIP:support@weex.com