Noticias sobre Gemini 3.5 Transcribe
4 artículos relacionados
Google AI Releases Gemini 3.5 Transcribe: A Speech-to-Text Model Reporting 2.6% Average WER Across 85+ Languages
AI InsightGoogle AI ha lanzado Gemini 3.5 Transcribe, un modelo de voz a texto que reporta un WER promedio del 2,6% en más de 85 idiomas. El modelo se divide en dos puntos finales: el punto final de flujo y el punto final de procesamiento por lotes. El punto final de flujo proporciona una transcripción de menos de un segundo, pero no admite la identificación de hablantes y los sellos de tiempo de palabras. El punto final de procesamiento por lotes admite estas dos funciones, pero cuesta la mitad que el punto final de flujo. Google informa que el WER del punto final de flujo es del 4,0%, mientras que el WER del punto final no flujo es del 2,6%, un 70% más rápido que Chirp 3.Google AI releases Gemini 3.5 Transcribe, a speech-to-text model supporting 85+ languages.The release of Gemini 3.5 Transcribe marks a significant breakthrough for Google AI in the field of speech-to-text, particularly in terms of multilingual support. The model's low WER and fast transcription speed will help improve the performance of voice agents and transcription pipelines.- DevelopersWill get access to a better speech-to-text model that supports multiple languages.
Next, we can expect Google AI to continue innovating and improving in the field of speech-to-text, particularly in terms of multilingual support and model efficiency.Importancia 85/100Google's Gemini 3.5 Transcribe turns speech to text in 85 languages while auto-correcting your verbal stumbles
AI InsightGemini 3.5 Transcribe de Google puede reconocer 85 idiomas y corregir palabras de relleno y lapsus linguae en la transcripción de voz en tiempo real. En modo de transmisión en continuo, logra una tasa de error de palabras del 4,0%, con una reducción de la latencia del 70% en comparación con el producto anterior Chirp 3. Además, a través de llamadas a funciones, se pueden asignar tareas a otros modelos Gemini.Google announces Gemini 3.5 Transcribe for AI-powered speech-to-text
AI InsightGoogle anuncia el lanzamiento de Gemini 3.5 Transcribe, que ofrece la capacidad de transcripción de voz a texto impulsada por inteligencia artificial. Esta tecnología se aplicará a más productos de Google, incluido Chrome. El lanzamiento de Gemini 3.5 Transcribe marca una mayor inmersión de Google en el campo del reconocimiento de voz.Intelligent transcription with Gemini 3.5 Transcribe
AI InsightGoogle DeepMind lanzó Gemini 3.5 Transcribe, lo que mejoró aún más la capacidad de transcripción inteligente. El lanzamiento de Gemini 3.5 Transcribe marca otro gran avance de Google en la tecnología de reconocimiento de voz. La mejora de esta tecnología traerá una mayor precisión y eficiencia a las aplicaciones de transcripción de voz a texto.