AI 음성 인식 모듈 — 키워드 웨이크업, 이중 언어 음성, 110+ 명령

¥117.00
재고 있음
모듈
-
+
세계 배송 심천에서 전 세계로
오픈소스 투명한 하드웨어와 소프트웨어
기술 지원 커뮤니티와 전문가 지원
이 제품에 대해 문의하기

질문하기

SO-ARM100/SO-ARM101 로봇 팔용 상부 카메라 마운트 (RealSense 호환)

SO-ARM100/SO-ARM101 로봇 팔용 상부 카메라 마운트 (RealSense 호환)

2-DOF 서보 팬틸트 유닛

2-DOF 서보 팬틸트 유닛

AI 음성 상호작용 모듈 개요

AI 음성 상호작용 모듈 — 키워드 웨이크업 | 중국어 & 영어 인식 | 맞춤 어휘/파라미터

  • 110개 이상의 사전 설정 음성 상호작용 명령

  • 인식 및 재생 통합 설계

  • 사용자 정의 음성 어휘 지원

  • 6미터 장거리 인식

  • 99% 인식 정확도

  • 360도 전방향 음성 포착

  • 고음질 에코 캔슬링 & 노이즈 저감

  • 오프라인 인식

  • 주변 소음 저감

주요 기능 — AI 음성 상호작용

  • KWS 키워드 인식 웨이크업

  • 음성 방송 재생

  • 중국어 & 영어 이중 언어 인식

  • 360도 전방향 마이크

  • 고음질 스피커

  • 사용자 정의 어휘 & 파라미터

  • 지능형 에코 캔슬링 & 노이즈 저감

  • 6m 장거리 인식

  • 높은 인식 정확도

  • 포괄적인 개발 튜토리얼 포함

AI 음성 상호작용 모듈 소개

음성 상호작용 모듈은 음성 인식과 음성 재생을 하나의 장치에 통합했습니다. 내장 마이크와 스피커, 그리고 합성곱 신경망 연산과 딥러닝 노이즈 저감을 지원하는 강력한 뉴럴 네트워크 프로세서를 갖추어 강력한 에코 캔슬링과 주변 소음 억제를 제공합니다. 새로운 명령어는 소프트웨어로 추가할 수 있으며, 인식 정확도는 최대 99%입니다. 중국어와 영어를 모두 지원하여 초보자도 쉽게 AI 음성 상호작용을 시작할 수 있습니다.

음성 모듈은 여러 개의 온보드 인터페이스를 갖추고 있습니다. 음성 인식의 기본 원리를 이해하지 않아도 번들 소프트웨어로 쉽게 펌웨어를 생성하고 Type-C 인터페이스를 통해 업데이트할 수 있습니다. 또한 모듈은 시리얼 및 IIC 인터페이스를 제공하여 STM32, MSPM0, Raspberry Pi 등과 같은 플랫폼에서 음성 상호작용 프로젝트를 지원합니다. 110개 이상의 음성 상호작용 명령 세트를 사전 로드하고 상세한 사용자 튜토리얼, 펌웨어 수정 가이드, 프로그래밍 도구를 제공하여 프로젝트 개발을 가속화합니다. 임베디드 음성 프로젝트에 이상적인 선택입니다.

음성 인식 기능

음성 상호작용 모듈은 2MB의 내장 저장 공간을 갖추고 다양한 시나리오를 포괄하는 110개 이상의 음성 상호작용 명령 세트가 사전 로드되어 있습니다. 또한 사용자 정의 상호작용 명령 구성을 지원하여 개인화된 응용 요구 사항을 충족합니다.

  • 1. 초보자도 쉽게 사용 가능

    사용자가 음성 명령을 내리면 음성 모듈이 이를 인식하여 메인 컨트롤러로 전송하고, 컨트롤러는 해당 동작을 직접 실행한 후 음성 모듈을 구동하여 방송 콘텐츠를 재생합니다. 전체 과정이 간단하고 사용하기 쉽습니다.

  • 2. 효율적인 설정, 편리한 조작

    음성 명령을 사용하여 모듈의 인식 명령을 수정할 수 있어 웨이크업 워드 변경, 볼륨 조절, 방송 콘텐츠 수정을 효율적으로 수행할 수 있습니다.

  • 3. 풍부한 명령 라이브러리, 개봉 즉시 사용

    사용자 편의를 위해 다양한 시나리오를 포괄하는 110개 이상의 음성 상호작용 명령을 사전 설정하여 개발 주기를 크게 단축하고 효율적인 프로젝트 개발을 가능하게 합니다.

사용자 정의 음성 인식 명령 구성

완전한 펌웨어 수정 튜토리얼과 프로그래밍 도구를 제공하여 2차 개발 요구를 충족하는 심층 커스터마이징을 지원합니다.

  • &circled1; 맞춤형 음성 톤

  • &circled2; 맞춤 어휘

    웨이크업 워드, 명령어, 방송 문구를 추가하거나 수정할 수 있습니다. 프로토콜과 신뢰도 임계값도 유연하게 구성할 수 있습니다.

  • &circled3; 맞춤 파라미터

    인식 감도(높음/중간/낮음), 에코 캔슬링(켜기/끄기), 웨이크업 시간, 출력 모드 등 모든 파라미터를 조정할 수 있습니다.

  • &circled4; 펌웨어 프로그래밍 도구 포함

    펌웨어 업그레이드와 파라미터 저장을 지원하는 간단한 조작 방식으로, 초보자도 빠르게 시작할 수 있습니다.

기술 특성 — 음성 인식

  • 01 중국어 & 영어 이중 언어 인식, 완전 맞춤 어휘

    하나 또는 여러 개의 웨이크업 워드를 유연하게 구성하여 사용자 습관과 시나리오 요구에 맞출 수 있습니다. 인식은 빠르고 정확하며, 중국어와 영어 웨이크업 명령을 정밀하게 포착하면서 정확도와 내간섭성을 균형 있게 유지합니다. 복잡한 설정이 필요 없습니다 — 개인화된 웨이크업을 쉽게 구현하여 보다 직관적인 인간-로봇 상호작용 경험을 제공합니다.

  • 02 다중 음성 방송 모드

    웨이크업 워드 인식에 의한 자동 음성 방송과 외부 호스트 컨트롤러를 통한 능동 음성 방송을 모두 지원하며, 두 모드를 유연하게 전환할 수 있습니다.

  • 03 에코 캔슬링이 적용된 자연스러운 대화

    방송 중에 웨이크업 워드나 명령이 현재 재생을 중단시킬 수 있어 음성 모듈이 즉시 응답하고 최신 명령 내용을 방송하여 보다 원활하고 자연스러운 인간-기계 상호작용 경험을 제공합니다.

하드웨어 특성 — 음성 모듈

  • 01 통합 설계, 개발 간소화

    고성능 노이즈 저감 마이크와 고음질 스피커를 통합하여 음성 인식 + 음성 재생 기능을 하나로 구현했습니다. 이를 통해 AI 음성 상호작용 시스템의 개발 프로세스와 하드웨어 구축 비용을 크게 간소화하여 추가 오디오 주변기기 없이도 음성 상호작용 솔루션을 신속하게 구성할 수 있습니다.

    고음질 스피커: 음성 디테일을 정확하게 재현하는 선명한 음질 제공. 내장형 및 외장형 버전 제공.

    고성능 노이즈 저감 마이크: 고급 노이즈 억제 알고리즘이 통합되어 6m 범위 내에서 최대 99%의 인식 정확도를 달성합니다.

  • 02 고정밀 음성 인식 모듈

    고급 노이즈 억제 알고리즘을 통해 배경 환경 소음을 효과적으로 걸러내고 최대 6미터까지의 장거리 웨이크업 워드 인식을 지원하여, 최대 99%의 정확도로 정밀하고 효율적인 음성 명령 제어를 보장합니다.

  • 03 광범위한 호환성, 드라이버 불필요

    드라이버 없이 플러그 앤 플레이로 동작하는 Type-C 인터페이스 내장. USB 연결을 통해 Raspberry Pi와 같은 임베디드 호스트와 결합할 수 있어 핀 사용량을 줄입니다. Mac OS, Windows, Linux 등 다양한 운영 체제와 호환됩니다.

  • 04 다중 컨트롤러 및 확장 보드 지원

    Raspberry Pi, Jetson, RDK 등 주류 컨트롤러와 호환되어 유연한 하드웨어 확장과 다양한 조합을 지원합니다. 로봇의 창의적인 가능성을 더욱 넓혀 — 아이디어 구현을 더 쉽게, 로봇 상호작용을 더 흥미롭게 만듭니다!

음성 모듈 배선도

1. 음성 상호작용 모듈 — 시리얼 통신 배선도

  • 다이어그램: Raspberry Pi에 연결된 AI 음성 상호작용 모듈

  • 다이어그램: Jetson Orin에 연결된 AI 음성 상호작용 모듈

2. 음성 상호작용 모듈 — IIC 통신 배선도

  • 다이어그램: Raspberry Pi에 연결된 AI 음성 상호작용 모듈

  • 다이어그램: Jetson Orin에 연결된 AI 음성 상호작용 모듈

3. 음성 상호작용 모듈 — Type-C 통신 배선도

드라이버 없이 플러그 앤 플레이로 동작하는 Type-C 인터페이스가 내장되어 펌웨어 업데이트에 편리합니다. USB 연결을 통해 Raspberry Pi와 같은 임베디드 호스트와 결합할 수 있어 핀 사용량을 줄입니다.

  • 다이어그램: Raspberry Pi에 연결된 AI 음성 상호작용 모듈

  • 다이어그램: Jetson Orin에 연결된 AI 음성 상호작용 모듈

AI 음성 모듈 ROS1 & ROS2 지원

음성 상호작용 모듈은 ROS1과 ROS2를 모두 지원합니다.

AI 음성 모듈 응용 시나리오

스마트홈, 로봇 응용, 프로그래밍 가능한 로봇 강아지, 센서 상호작용 솔루션

음성 모듈 하드웨어 인터페이스

번호

하드웨어 이름 / 설명

1

스피커 — 아날로그 신호를 소리로 변환

2

슬라이드 스위치 — 펌웨어 프로그래밍을 위해 시리얼 포트 전환

3

마이크 — 소리를 아날로그 신호로 변환

4

RST 버튼 — 리셋 버튼

5

전원 표시등(빨간색) — 전원이 정상일 때 계속 켜짐

6

Type-C 인터페이스 — 전원 공급 및 CI1302/STC8 펌웨어 업데이트/다운로드용

7

오디오 증폭기 칩 — 디지털 신호를 아날로그 신호로 변환하여 스피커 구동

8

CI1302 칩 — 고성능 음성 인식 칩. 음성을 인식하여 신호 출력

9

역극성 보호 — 5V/GND 역방향 연결 보호

10

IIC 인터페이스 — 전원 공급 및 호스트 기기 통신을 위한 슬레이브로 동작

11

시리얼 인터페이스 — 프로토콜 기반 방송 제어용 외부 시리얼 포트

12

STC8H 칩 — 음성 칩 명령을 IIC 프로토콜 및 시리얼 명령으로 변환

AI 음성 모듈 사양

칩 모델

CI1302 (ChipIntelli)

전원 공급 전압

DC 5V

RAM

640KByte

FLASH

2MByte

인식 모드

명령 웨이크업

통신 방식

IIC 통신(호스트와 4핀 연결), 시리얼 통신

인식 범위

조용한 환경에서 최대 6미터, 소음이 있는 환경에서 1미터

인식 요구 사항

고정 명령 문구를 인식하며 최대 255개의 문구 또는 짧은 문장을 지원합니다. 인식 문구는 펌웨어를 통해 수정할 수 있습니다.

사전 설정 명령 수

110개 이상의 명령 문구 (최대 120개)

기본 웨이크업 워드

"Hello, Little Rhino"

AI 음성 모듈 구성품 목록

음성 상호작용 모듈

1개 (메인 모듈)

Type-C 데이터 케이블

1개 (전원 및 통신용)

PH2.0 4핀 케이블 (20cm)

1개 (시리얼 연결용)

PH2.0 4핀-Dupont 케이블 (20cm)

1개 (UART 연결용)

사양

[{"name":"Wake-up","value":"Keyword wake-up"},{"name":"Languages","value":"Bilingual (EN/CN)"},{"name":"Commands","value":"110+ commands"},{"name":"인터페이스","value":"UART / USB / I2C"}]

자주 묻는 질문

What is the AI 음성 인식 모듈 — 키워드 웨이크업, 이중 언어 음성, 110+ 명령?
AI 음성 상호작용 모듈 개요AI 음성 상호작용 모듈 — 키워드 웨이크업 | 중국어 & 영어 인식 | 맞춤 어휘/파라미터110개 이상의 사전 설정 음성 상호작용 명령인식 및 재생 통합 설계사용자 정의 음성 어휘 지원6미터 장거리 인식99% 인식 정확도360도 전방향 음성 포착고음질 에코 캔슬링 & 노이즈 저감오프라인 인식주변 소음 저감주요 기능 — AI 음성 상호작용KWS 키워드 인식 웨이크업음성 방송 재생중국어 & 영어 이중 언어 인식360도 전방향 마이크고음질 스피커사용자 정의 어...
Where can I find technical documentation and open-source files for the AI 음성 인식 모듈 — 키워드 웨이크업, 이중 언어 음성, 110+ 명령?
All schematics, CAD files, firmware, and software libraries are available on the JuxiTech Wiki. Everything is fully open-source with permissive licenses.
What platforms and frameworks is the AI 음성 인식 모듈 — 키워드 웨이크업, 이중 언어 음성, 110+ 명령 compatible with?
JuxiTech products are designed for ROS 2, LeRobot, HuggingFace, and NVIDIA Jetson ecosystems. See the technical documentation for details.
How can I get technical support for the AI 음성 인식 모듈 — 키워드 웨이크업, 이중 언어 음성, 110+ 명령?
Email support@juxitech.com. Free community support, documentation, and 12-month warranty included. Ships worldwide from Shenzhen, China within 1-3 business days.

비디오 없음

기술 심층 탐구 → Feishu Wiki

Read technical documentation, schematics, and research papers on feishu.cn/wiki/RhA6wg91hiFZykkcDGoc8wMCnch