Speech recognition convierte palabras habladas en texto, mientras que speech synthesis convierte texto en audio. Juntas permiten operar como manos-libres y mejoran la accesibilidad.
Speech-enabled solutions
Esto te puede ayudar a:
- Accesibility: ayuda a usuarios con problemas visuales.
- Productivity: permitir multitasking al quitar teclados y pantallas.
- Mejorar UX al crear conversaciones naturales.
- Audiencias globales al soportar multiples idiomas.
Speech-synthesis scenarios (text-to-speech)
Algunos ejemplos de casos de uso:
- IA y chatbots conversacionales
- Accesibilidad
Combine speech recognition and synthesis
Ejemplos:
- Customer service: entender y responder al usuario
- Aprendizaje de idiomas
Factores a tener en cuenta
- calidad de audio: background noise, micro and network quality
- idiomas soportados
- privacidad: entender como se procesa y se guarda el audio
- latencia: poder hablar y reconocer audio requiere low-latency
- accesibilidad