1 repositorio
Architectural frameworks for swapping different speech recognition and synthesis providers.
Distinct from Speech Recognition Engines: Distinct from Speech Recognition Engines by focusing on the interchangeable provider architecture rather than the inference runtime.
Explore 1 awesome GitHub repository matching artificial intelligence & ml · Modular Provider Frameworks. Refine with filters or upvote what's useful.
Jasper Client es un cliente de computación por voz y framework de voz extensible diseñado para traducir el habla en lenguaje natural en acciones de hardware y solicitudes de servicio. Funciona como una interfaz de comandos de voz que gestiona el proceso de extremo a extremo de captura de audio, transcripción y ejecución de acciones. El sistema cuenta con una arquitectura modular que permite la integración de plugins personalizados, varios motores de reconocimiento de voz y proveedores de síntesis. Este enfoque basado en plugins soporta la adición de nuevos hablantes y capacidades de idiomas regionales sin alterar la lógica central. El cliente incluye un motor de detección de palabra de activación (wake-word) que monitorea flujos de audio de fondo en busca de disparadores acústicos específicos. Para mantener la capacidad de respuesta de la interfaz, utiliza un pipeline de audio multihilo que descarga el procesamiento de audio y la transcripción a hilos de ejecución separados.
Provides a modular architecture that decouples voice synthesis and recognition providers to support multiple speakers and languages.