Meta lanza Muse Voice Transcribe: transcripción en tiempo real para más de 20 hablantes
Meta Superintelligence Lab presentó su primer modelo de audio en tiempo real, capaz de transcribir conversaciones con más de 20 participantes, distinguir hablantes y manejar varios idiomas y cambio de código.
Ilustracion contextual ViaMind · no es fotografia del hecho
Lo reportado
Capacidades del modelo
Según WWWhat’s New, Meta Superintelligence Lab (MSL) presentó ayer Muse Voice Transcribe, su primer modelo de audio en tiempo real. El sistema puede transcribir conversaciones con más de 20 participantes simultáneos, distinguir automáticamente entre hablantes mediante diarización, gestionar múltiples idiomas en una misma sesión y detectar cambio de código, cuando alguien mezcla palabras de idiomas diferentes.
Estado de evidencia: Las afirmaciones materiales incluidas fueron contrastadas con la evidencia enlazada.
Qué seguir
Observar si Meta publica benchmarks comparables, abre una API pública o anuncia integración en WhatsApp o Messenger en los próximos meses.