STT (Speech to Text)
Transcripción automática de audio a texto.
Explicación completa
El reconocimiento automático del habla convierte grabaciones en texto, normalmente con marcas de tiempo y separación de hablantes. Whisper de OpenAI marcó un antes y un después en precisión multilingüe.
Ejemplo
Transcribir una reunión de una hora en un minuto.
Última actualización: