CourionAI
ES
Boletín
← Glosario Término

Reconocimiento de voz

Tecnología que convierte datos de audio hablados en texto escrito.

Speech-to-Text, también conocido como ASR por reconocimiento automático de voz, convierte el audio en texto. Está detrás de las notas de las reuniones, los subtítulos, las transcripciones de podcasts, la escritura por voz y los asistentes de voz. Los sistemas modernos pueden manejar varios idiomas, separar hablantes y utilizar nombres de pila o términos técnicos.

Los modelos por lotes suelen procesar grabaciones terminadas más de treinta veces más rápido que en tiempo real. Los modelos de streaming escriben mientras hablan sin poder ver el futuro. Los precios son ahora fracciones de centavo por minuto; Las diferencias en precisión suelen ser menores que las de conveniencia.