Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos

¥117.00
En stock
Módulo
-
+
Envío mundial desde Shenzhen a todo el mundo
Código abierto hardware y software transparentes
Soporte técnico ayuda de la comunidad y expertos
Pregunte por este producto

Hacer una pregunta

Cámara CSI IMX219 de 79°

Cámara CSI IMX219 de 79°

Módulo IMU de sensor de ángulo de actitud AHRS para navegación robótica

Módulo IMU de sensor de ángulo de actitud AHRS para navegación robótica

Descripción general del módulo de interacción de voz IA

Módulo de interacción de voz IA — Palabra de activación | Reconocimiento en chino e inglés | Vocabulario/parámetros personalizados

  • Más de 110 comandos de interacción de voz predefinidos

  • Diseño integrado de reconocimiento y reproducción

  • Compatibilidad con vocabulario de voz personalizado

  • Reconocimiento de largo alcance de hasta 6 metros

  • 99% de precisión de reconocimiento

  • Captación omnidireccional de 360 grados

  • Cancelación de eco y reducción de ruido de alta fidelidad

  • Reconocimiento sin conexión

  • Reducción del ruido ambiental

Características clave — Interacción de voz IA

  • Activación por reconocimiento de palabra clave KWS

  • Reproducción de locución de voz

  • Reconocimiento bilingüe chino e inglés

  • Micrófono omnidireccional de 360 grados

  • Altavoz de alta fidelidad

  • Vocabulario y parámetros personalizados

  • Cancelación de eco inteligente y reducción de ruido

  • Reconocimiento de largo alcance de 6 m

  • Alta precisión de reconocimiento

  • Tutoriales de desarrollo completos incluidos

Introducción al módulo de interacción de voz IA

El módulo de interacción de voz integra el reconocimiento y la reproducción de voz en un solo dispositivo. Cuenta con un micrófono y un altavoz integrados, junto con un potente procesador de redes neuronales que admite operaciones de redes neuronales convolucionales y reducción de ruido por aprendizaje profundo, ofreciendo una cancelación de eco robusta y una supresión del ruido ambiental. Se pueden añadir nuevas palabras de comando mediante software, con una precisión de reconocimiento de hasta el 99%. Admite entradas en chino e inglés, haciendo que la interacción de voz IA sea accesible incluso para principiantes.

El módulo de voz cuenta con múltiples interfaces integradas. Sin necesidad de comprender los principios subyacentes del reconocimiento de voz, puede generar fácilmente el firmware con el software incluido y actualizarlo a través de la interfaz Type-C. Además, el módulo proporciona interfaces serie e IIC, compatibles con proyectos de interacción de voz en plataformas como STM32, MSPM0 y Raspberry Pi. Hemos precargado más de 110 conjuntos de comandos de interacción de voz y ofrecemos tutoriales detallados, guías de modificación de firmware y herramientas de programación para acelerar el desarrollo — la opción ideal para proyectos de voz integrados.

Funciones de reconocimiento de voz

El módulo de interacción de voz cuenta con 2MB de almacenamiento integrado y viene precargado con más de 110 conjuntos de comandos de interacción de voz que cubren una amplia gama de escenarios. También admite configuraciones de comandos de interacción definidas por el usuario para satisfacer necesidades personalizadas.

  • 1. Sin conocimientos previos, fácil de usar

    Cuando el usuario emite un comando de voz, el módulo de voz lo reconoce y lo envía al controlador principal, que ejecuta directamente la acción correspondiente y acciona el módulo de voz para completar la locución. Todo el proceso es sencillo y fácil de usar.

  • 2. Configuración eficiente, manejo cómodo

    Los comandos de voz se pueden utilizar para modificar los comandos de reconocimiento del módulo, lo que permite cambiar eficazmente las palabras de activación, ajustar el volumen y modificar el contenido de la locución.

  • 3. Amplia biblioteca de comandos, lista para usar

    Para mayor comodidad, hemos predefinido más de 110 comandos de interacción de voz que cubren diversos escenarios, acortando considerablemente el ciclo de desarrollo y permitiendo un desarrollo eficiente del proyecto.

Configuración personalizada de comandos de reconocimiento de voz

Ofrecemos tutoriales completos de modificación de firmware y herramientas de programación, que admiten una personalización profunda para satisfacer las necesidades de desarrollo secundario.

  • &circled1; Tono de voz personalizado

  • &circled2; Vocabulario personalizado

    Añada o modifique palabras de activación, palabras de comando y frases de locución. Configure de forma flexible los protocolos y los umbrales de confianza.

  • &circled3; Parámetros personalizados

    La sensibilidad de reconocimiento (Alta/Media/Baja), la cancelación de eco (Activada/Desactivada), la duración de activación, el modo de salida y otros parámetros son todos ajustables.

  • &circled4; Herramienta de programación de firmware incluida

    Funcionamiento sencillo con soporte para actualizaciones de firmware y guardado de parámetros. Incluso los principiantes pueden empezar rápidamente.

Características técnicas — Reconocimiento de voz

  • 01 Reconocimiento bilingüe chino e inglés, vocabulario totalmente personalizable

    Configure de forma flexible una o varias palabras de activación para adaptarse a los hábitos de los usuarios y las necesidades de cada escenario. El reconocimiento es rápido y preciso, captando exactamente los comandos de activación en chino e inglés, equilibrando precisión y resistencia a interferencias. Sin configuración compleja: consiga fácilmente una activación personalizada para una experiencia de interacción hombre-robot más intuitiva.

  • 02 Múltiples modos de locución de voz

    Admite el reconocimiento de palabras de activación con activación automática de la locución, así como la locución activa mediante un controlador host externo. Los dos modos se pueden alternar de forma flexible.

  • 03 Conversación natural con cancelación de eco

    Durante la locución, las palabras de activación o los comandos pueden interrumpir la reproducción en curso, lo que permite al módulo de voz responder al instante y locutar el contenido del último comando, ofreciendo una experiencia de interacción hombre-máquina más fluida y natural.

Características de hardware — Módulo de voz

  • 01 Diseño integrado, desarrollo simplificado

    El módulo integra un micrófono de alto rendimiento con reducción de ruido y un altavoz de alta fidelidad, logrando reconocimiento de voz + reproducción de voz en un único dispositivo. Esto simplifica enormemente el proceso de desarrollo y los costes de despliegue de hardware para sistemas de interacción de voz IA, permitiendo configurar rápidamente soluciones sin periféricos de audio adicionales.

    Altavoz de alta fidelidad: ofrece una calidad de sonido clara con una reproducción precisa de los detalles de la voz. Disponible en versiones integrada y externa.

    Micrófono de alto rendimiento con reducción de ruido: integrado con algoritmos avanzados de supresión de ruido, alcanza hasta un 99% de precisión de reconocimiento dentro de un rango de 6 m.

  • 02 Módulo de reconocimiento de voz de alta precisión

    Gracias a los algoritmos avanzados de supresión de ruido, filtra eficazmente el ruido ambiental de fondo y admite el reconocimiento de palabras de activación a distancias de hasta 6 metros, garantizando un control por comandos de voz preciso y eficiente con una precisión de hasta el 99%.

  • 03 Amplia compatibilidad, sin controladores

    Interfaz Type-C integrada con funcionamiento plug-and-play sin controladores. Se puede combinar con hosts integrados como Raspberry Pi mediante conexión USB, reduciendo el uso de pines. Compatible con Mac OS, Windows, Linux y otros sistemas operativos.

  • 04 Compatibilidad con múltiples controladores y placas de expansión

    Compatible con controladores populares como Raspberry Pi, Jetson y RDK, lo que permite una expansión de hardware flexible y combinaciones versátiles. Desbloquee más posibilidades creativas para sus robots: ¡hacer realidad las ideas es más fácil y la interacción robótica más atractiva!

Diagrama de cableado del módulo de voz

1. Módulo de interacción de voz — Diagrama de cableado de comunicación serie

  • Diagrama: módulo de interacción de voz IA conectado a Raspberry Pi

  • Diagrama: módulo de interacción de voz IA conectado a Jetson Orin

2. Módulo de interacción de voz — Diagrama de cableado de comunicación IIC

  • Diagrama: módulo de interacción de voz IA conectado a Raspberry Pi

  • Diagrama: módulo de interacción de voz IA conectado a Jetson Orin

3. Módulo de interacción de voz — Diagrama de cableado de comunicación Type-C

Interfaz Type-C integrada con funcionamiento plug-and-play sin controladores, práctica para actualizaciones de firmware. Se puede combinar con hosts integrados como Raspberry Pi mediante conexión USB, reduciendo el uso de pines.

  • Diagrama: módulo de interacción de voz IA conectado a Raspberry Pi

  • Diagrama: módulo de interacción de voz IA conectado a Jetson Orin

Soporte ROS1 y ROS2 del módulo de voz IA

El módulo de interacción de voz es compatible con ROS1 y ROS2.

Escenarios de aplicación del módulo de voz IA

Hogar inteligente, aplicaciones robóticas, perros robot programables, soluciones de interacción por sensores

Interfaz de hardware del módulo de voz

N.º

Nombre del hardware / Descripción

1

Altavoz — convierte señales analógicas en sonido

2

Interruptor deslizante — conmuta el puerto serie para la programación de firmware

3

Micrófono — convierte el sonido en señales analógicas

4

Botón RST — botón de reinicio

5

Indicador de alimentación (rojo) — permanece encendido cuando la alimentación es normal

6

Interfaz Type-C — para la alimentación y la actualización/descarga de firmware CI1302/STC8

7

Chip amplificador de audio — convierte señales digitales en analógicas para accionar el altavoz

8

Chip CI1302 — chip de reconocimiento de voz de alto rendimiento; reconoce el habla y emite señales

9

Protección contra polaridad inversa — protección frente a una conexión invertida de 5V/GND

10

Interfaz IIC — funciona como esclavo para la alimentación y la comunicación con el dispositivo host

11

Interfaz serie — puerto serie externo para el control de locución basado en protocolo

12

Chip STC8H — convierte los comandos del chip de voz en protocolo IIC y comandos serie

Especificaciones del módulo de voz IA

Modelo de chip

CI1302 (ChipIntelli)

Voltaje de alimentación

DC 5V

RAM

640KByte

FLASH

2MByte

Modo de reconocimiento

Activación por comando

Método de comunicación

Comunicación IIC (conexión de 4 pines al host), comunicación serie

Alcance de reconocimiento

Máximo 6 metros en entornos silenciosos; 1 metro en entornos ruidosos

Requisitos de reconocimiento

Reconoce frases de comando fijas; admite hasta 255 frases u oraciones cortas. Las frases de reconocimiento se pueden modificar mediante firmware.

Número de comandos predefinidos

Más de 110 frases de comando (hasta 120)

Palabra de activación predeterminada

"Hello, Little Rhino"

Lista de piezas del módulo de voz IA

Módulo de interacción de voz

1x (módulo principal)

Cable de datos Type-C

1x (para alimentación y comunicación)

Cable de 4 pines PH2.0 (20 cm)

1x (para conexión serie)

Cable PH2.0 de 4 pines a Dupont (20 cm)

1x (para conexión UART)

Especificaciones

[{"name":"Wake-up","value":"Keyword wake-up"},{"name":"Languages","value":"Bilingual (EN/CN)"},{"name":"Commands","value":"110+ commands"},{"name":"Interfaz","value":"UART / USB / I2C"}]

Preguntas frecuentes

What is the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos?
Descripción general del módulo de interacción de voz IAMódulo de interacción de voz IA — Palabra de activación | Reconocimiento en chino e inglés | Vocabulario/parámetros personalizadosMás de 110 comandos de interacción de voz predefinidosDiseño integrado de reconocimiento y reproducciónCompatibi...
Where can I find technical documentation and open-source files for the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos?
All schematics, CAD files, firmware, and software libraries are available on the JuxiTech Wiki. Everything is fully open-source with permissive licenses.
What platforms and frameworks is the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos compatible with?
JuxiTech products are designed for ROS 2, LeRobot, HuggingFace, and NVIDIA Jetson ecosystems. See the technical documentation for details.
How can I get technical support for the Módulo de reconocimiento de voz IA — Activación por palabra clave, habla bilingüe, 110+ comandos?
Email support@juxitech.com. Free community support, documentation, and 12-month warranty included. Ships worldwide from Shenzhen, China within 1-3 business days.

No hay video

Profundiza en la tecnología → Wiki de Feishu

Read technical documentation, schematics, and research papers on feishu.cn/wiki/RhA6wg91hiFZykkcDGoc8wMCnch