STT (Speech to Text)

Transcripción automática de audio a texto.

Explicación completa

El reconocimiento automático del habla convierte grabaciones en texto, normalmente con marcas de tiempo y separación de hablantes. Whisper de OpenAI marcó un antes y un después en precisión multilingüe.

Ejemplo

Transcribir una reunión de una hora en un minuto.

Última actualización:

Términos relacionados