Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos
Descripción general del módulo de interacción de voz IA
Módulo de interacción de voz IA — Palabra de activación | Reconocimiento en chino e inglés | Vocabulario/parámetros personalizados
-
Más de 110 comandos de interacción de voz predefinidos
-
Diseño integrado de reconocimiento y reproducción
-
Compatibilidad con vocabulario de voz personalizado
-
Reconocimiento de largo alcance de hasta 6 metros
-
99% de precisión de reconocimiento
-
Captación omnidireccional de 360 grados
-
Cancelación de eco y reducción de ruido de alta fidelidad
-
Reconocimiento sin conexión
-
Reducción del ruido ambiental

Características clave — Interacción de voz IA
-
Activación por reconocimiento de palabra clave KWS
-
Reproducción de locución de voz
-
Reconocimiento bilingüe chino e inglés
-
Micrófono omnidireccional de 360 grados
-
Altavoz de alta fidelidad
-
Vocabulario y parámetros personalizados
-
Cancelación de eco inteligente y reducción de ruido
-
Reconocimiento de largo alcance de 6 m
-
Alta precisión de reconocimiento
-
Tutoriales de desarrollo completos incluidos
Introducción al módulo de interacción de voz IA
El módulo de interacción de voz integra el reconocimiento y la reproducción de voz en un solo dispositivo. Cuenta con un micrófono y un altavoz integrados, junto con un potente procesador de redes neuronales que admite operaciones de redes neuronales convolucionales y reducción de ruido por aprendizaje profundo, ofreciendo una cancelación de eco robusta y una supresión del ruido ambiental. Se pueden añadir nuevas palabras de comando mediante software, con una precisión de reconocimiento de hasta el 99%. Admite entradas en chino e inglés, haciendo que la interacción de voz IA sea accesible incluso para principiantes.
El módulo de voz cuenta con múltiples interfaces integradas. Sin necesidad de comprender los principios subyacentes del reconocimiento de voz, puede generar fácilmente el firmware con el software incluido y actualizarlo a través de la interfaz Type-C. Además, el módulo proporciona interfaces serie e IIC, compatibles con proyectos de interacción de voz en plataformas como STM32, MSPM0 y Raspberry Pi. Hemos precargado más de 110 conjuntos de comandos de interacción de voz y ofrecemos tutoriales detallados, guías de modificación de firmware y herramientas de programación para acelerar el desarrollo — la opción ideal para proyectos de voz integrados.
Funciones de reconocimiento de voz
El módulo de interacción de voz cuenta con 2MB de almacenamiento integrado y viene precargado con más de 110 conjuntos de comandos de interacción de voz que cubren una amplia gama de escenarios. También admite configuraciones de comandos de interacción definidas por el usuario para satisfacer necesidades personalizadas.
-
1. Sin conocimientos previos, fácil de usar
Cuando el usuario emite un comando de voz, el módulo de voz lo reconoce y lo envía al controlador principal, que ejecuta directamente la acción correspondiente y acciona el módulo de voz para completar la locución. Todo el proceso es sencillo y fácil de usar.
-
2. Configuración eficiente, manejo cómodo
Los comandos de voz se pueden utilizar para modificar los comandos de reconocimiento del módulo, lo que permite cambiar eficazmente las palabras de activación, ajustar el volumen y modificar el contenido de la locución.
-
3. Amplia biblioteca de comandos, lista para usar
Para mayor comodidad, hemos predefinido más de 110 comandos de interacción de voz que cubren diversos escenarios, acortando considerablemente el ciclo de desarrollo y permitiendo un desarrollo eficiente del proyecto.
Configuración personalizada de comandos de reconocimiento de voz
Ofrecemos tutoriales completos de modificación de firmware y herramientas de programación, que admiten una personalización profunda para satisfacer las necesidades de desarrollo secundario.
-
&circled1; Tono de voz personalizado
-
&circled2; Vocabulario personalizado
Añada o modifique palabras de activación, palabras de comando y frases de locución. Configure de forma flexible los protocolos y los umbrales de confianza.
-
&circled3; Parámetros personalizados
La sensibilidad de reconocimiento (Alta/Media/Baja), la cancelación de eco (Activada/Desactivada), la duración de activación, el modo de salida y otros parámetros son todos ajustables.
-
&circled4; Herramienta de programación de firmware incluida
Funcionamiento sencillo con soporte para actualizaciones de firmware y guardado de parámetros. Incluso los principiantes pueden empezar rápidamente.
Características técnicas — Reconocimiento de voz
-
01 Reconocimiento bilingüe chino e inglés, vocabulario totalmente personalizable
Configure de forma flexible una o varias palabras de activación para adaptarse a los hábitos de los usuarios y las necesidades de cada escenario. El reconocimiento es rápido y preciso, captando exactamente los comandos de activación en chino e inglés, equilibrando precisión y resistencia a interferencias. Sin configuración compleja: consiga fácilmente una activación personalizada para una experiencia de interacción hombre-robot más intuitiva.
-
02 Múltiples modos de locución de voz
Admite el reconocimiento de palabras de activación con activación automática de la locución, así como la locución activa mediante un controlador host externo. Los dos modos se pueden alternar de forma flexible.
-
03 Conversación natural con cancelación de eco
Durante la locución, las palabras de activación o los comandos pueden interrumpir la reproducción en curso, lo que permite al módulo de voz responder al instante y locutar el contenido del último comando, ofreciendo una experiencia de interacción hombre-máquina más fluida y natural.
Características de hardware — Módulo de voz
-
01 Diseño integrado, desarrollo simplificado
El módulo integra un micrófono de alto rendimiento con reducción de ruido y un altavoz de alta fidelidad, logrando reconocimiento de voz + reproducción de voz en un único dispositivo. Esto simplifica enormemente el proceso de desarrollo y los costes de despliegue de hardware para sistemas de interacción de voz IA, permitiendo configurar rápidamente soluciones sin periféricos de audio adicionales.
Altavoz de alta fidelidad: ofrece una calidad de sonido clara con una reproducción precisa de los detalles de la voz. Disponible en versiones integrada y externa.
Micrófono de alto rendimiento con reducción de ruido: integrado con algoritmos avanzados de supresión de ruido, alcanza hasta un 99% de precisión de reconocimiento dentro de un rango de 6 m.
-
02 Módulo de reconocimiento de voz de alta precisión
Gracias a los algoritmos avanzados de supresión de ruido, filtra eficazmente el ruido ambiental de fondo y admite el reconocimiento de palabras de activación a distancias de hasta 6 metros, garantizando un control por comandos de voz preciso y eficiente con una precisión de hasta el 99%.
-
03 Amplia compatibilidad, sin controladores
Interfaz Type-C integrada con funcionamiento plug-and-play sin controladores. Se puede combinar con hosts integrados como Raspberry Pi mediante conexión USB, reduciendo el uso de pines. Compatible con Mac OS, Windows, Linux y otros sistemas operativos.
-
04 Compatibilidad con múltiples controladores y placas de expansión
Compatible con controladores populares como Raspberry Pi, Jetson y RDK, lo que permite una expansión de hardware flexible y combinaciones versátiles. Desbloquee más posibilidades creativas para sus robots: ¡hacer realidad las ideas es más fácil y la interacción robótica más atractiva!
Diagrama de cableado del módulo de voz
1. Módulo de interacción de voz — Diagrama de cableado de comunicación serie
-
Diagrama: módulo de interacción de voz IA conectado a Raspberry Pi
-
Diagrama: módulo de interacción de voz IA conectado a Jetson Orin
2. Módulo de interacción de voz — Diagrama de cableado de comunicación IIC
-
Diagrama: módulo de interacción de voz IA conectado a Raspberry Pi
-
Diagrama: módulo de interacción de voz IA conectado a Jetson Orin
3. Módulo de interacción de voz — Diagrama de cableado de comunicación Type-C
Interfaz Type-C integrada con funcionamiento plug-and-play sin controladores, práctica para actualizaciones de firmware. Se puede combinar con hosts integrados como Raspberry Pi mediante conexión USB, reduciendo el uso de pines.
-
Diagrama: módulo de interacción de voz IA conectado a Raspberry Pi
-
Diagrama: módulo de interacción de voz IA conectado a Jetson Orin
Soporte ROS1 y ROS2 del módulo de voz IA
El módulo de interacción de voz es compatible con ROS1 y ROS2.
Escenarios de aplicación del módulo de voz IA
Hogar inteligente, aplicaciones robóticas, perros robot programables, soluciones de interacción por sensores
Interfaz de hardware del módulo de voz

|
N.º |
Nombre del hardware / Descripción |
|
1 |
Altavoz — convierte señales analógicas en sonido |
|
2 |
Interruptor deslizante — conmuta el puerto serie para la programación de firmware |
|
3 |
Micrófono — convierte el sonido en señales analógicas |
|
4 |
Botón RST — botón de reinicio |
|
5 |
Indicador de alimentación (rojo) — permanece encendido cuando la alimentación es normal |
|
6 |
Interfaz Type-C — para la alimentación y la actualización/descarga de firmware CI1302/STC8 |
|
7 |
Chip amplificador de audio — convierte señales digitales en analógicas para accionar el altavoz |
|
8 |
Chip CI1302 — chip de reconocimiento de voz de alto rendimiento; reconoce el habla y emite señales |
|
9 |
Protección contra polaridad inversa — protección frente a una conexión invertida de 5V/GND |
|
10 |
Interfaz IIC — funciona como esclavo para la alimentación y la comunicación con el dispositivo host |
|
11 |
Interfaz serie — puerto serie externo para el control de locución basado en protocolo |
|
12 |
Chip STC8H — convierte los comandos del chip de voz en protocolo IIC y comandos serie |
Especificaciones del módulo de voz IA
|
Modelo de chip |
CI1302 (ChipIntelli) |
|
Voltaje de alimentación |
DC 5V |
|
RAM |
640KByte |
|
FLASH |
2MByte |
|
Modo de reconocimiento |
Activación por comando |
|
Método de comunicación |
Comunicación IIC (conexión de 4 pines al host), comunicación serie |
|
Alcance de reconocimiento |
Máximo 6 metros en entornos silenciosos; 1 metro en entornos ruidosos |
|
Requisitos de reconocimiento |
Reconoce frases de comando fijas; admite hasta 255 frases u oraciones cortas. Las frases de reconocimiento se pueden modificar mediante firmware. |
|
Número de comandos predefinidos |
Más de 110 frases de comando (hasta 120) |
|
Palabra de activación predeterminada |
"Hello, Little Rhino" |
Lista de piezas del módulo de voz IA
|
Módulo de interacción de voz |
1x (módulo principal) |
|
Cable de datos Type-C |
1x (para alimentación y comunicación) |
|
Cable de 4 pines PH2.0 (20 cm) |
1x (para conexión serie) |
|
Cable PH2.0 de 4 pines a Dupont (20 cm) |
1x (para conexión UART) |
Especificaciones
Preguntas frecuentes
What is the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos?
Where can I find technical documentation and open-source files for the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos?
What platforms and frameworks is the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos compatible with?
How can I get technical support for the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos?
No hay video
Read technical documentation, schematics, and research papers on feishu.cn/wiki/RhA6wg91hiFZykkcDGoc8wMCnch











