AI音声対話モジュール概要
AI音声対話モジュール — キーワードウェイクアップ | 中国語 & 英語認識 | カスタム語彙/パラメータ
-
110以上のプリセット音声対話コマンド
-
認識と再生を一体化した設計
-
カスタム音声語彙に対応
-
6メートル遠距離認識
-
99%の認識精度
-
360度全方向集音
-
高品質エコーキャンセリング & ノイズリダクション
-
オフライン認識
-
環境ノイズ低減

主な特長 — AI音声対話
-
KWSキーワード認識ウェイクアップ
-
音声ブロードキャスト再生
-
中国語 & 英語のバイリンガル認識
-
360度全方向マイク
-
高忠実度スピーカー
-
カスタム語彙 & パラメータ
-
インテリジェントエコーキャンセリング & ノイズリダクション
-
6m遠距離認識
-
高い認識精度
-
充実した開発チュートリアル付属
AI音声対話モジュールの紹介
音声対話モジュールは、音声認識と音声再生を1台に統合したデバイスです。内蔵マイクとスピーカーに加え、畳み込みニューラルネットワーク演算とディープラーニングによるノイズリダクションをサポートする強力なニューラルネットワークプロセッサを搭載し、優れたエコーキャンセリングと環境ノイズ抑制を実現します。新しいコマンドワードはソフトウェアで追加でき、認識精度は最大99%です。中国語・英語の両方に対応しており、初心者でも簡単にAI音声対話を始められます。
音声モジュールには複数のオンボードインターフェースが搭載されています。音声認識の仕組みを理解する必要はなく、付属ソフトウェアで簡単にファームウェアを生成し、Type-Cインターフェース経由で更新できます。さらに、シリアルおよびIICインターフェースを備え、STM32、MSPM0、Raspberry Pi などのプラットフォームで音声対話プロジェクトをサポートします。110以上の音声対話コマンドセットをプリロードし、詳細なユーザーチュートリアル、ファームウェア変更ガイド、プログラミングツールを提供して開発を加速します。組み込み音声プロジェクトに最適な選択肢です。
音声認識機能
音声対話モジュールは2MBの内蔵ストレージを備え、幅広いシーンをカバーする110以上の音声対話コマンドセットをプリロードしています。また、ユーザー定義の対話コマンド設定にも対応し、個々のアプリケーションのニーズに応えます。
-
1. 初心者でも簡単に使える
ユーザーが音声コマンドを発すると、音声モジュールがそれを認識し、メインコントローラーに送信します。コントローラーは対応する動作を直接実行し、音声モジュールを駆動してブロードキャスト内容を再生します。プロセス全体がシンプルで使いやすい設計です。
-
2. 効率的な設定、便利な操作
音声コマンドでモジュールの認識コマンドを変更でき、ウェイクアップワードの変更、音量調整、ブロードキャスト内容の変更を効率的に行えます。
-
3. 豊富なコマンドライブラリ、すぐに使える
ユーザーの利便性のため、さまざまなシーンをカバーする110以上の音声対話コマンドをプリセットしており、開発サイクルを大幅に短縮し、効率的なプロジェクト開発を実現します。
カスタム音声認識コマンド設定
ファームウェア変更チュートリアルとプログラミングツールを一式提供し、二次開発ニーズに応える深いカスタマイズをサポートします。
-
&circled1; カスタム音声トーン
-
&circled2; カスタム語彙
ウェイクアップワード、コマンドワード、ブロードキャストフレーズを追加・変更できます。プロトコルや信頼度しきい値も柔軟に設定可能です。
-
&circled3; カスタムパラメータ
認識感度(高/中/低)、エコーキャンセリング(オン/オフ)、ウェイクアップ時間、出力モードなどのパラメータをすべて調整できます。
-
&circled4; ファームウェアプログラミングツール付属
操作は簡単で、ファームウェアのアップグレードやパラメータ保存に対応。初心者でもすぐに使い始められます。
技術特長 — 音声認識
-
01 中国語 & 英語のバイリンガル認識、完全カスタム語彙
1つまたは複数のウェイクアップワードを柔軟に設定でき、ユーザーの習慣やシーンのニーズに合わせられます。認識は高速かつ正確で、中国語・英語のウェイクアップコマンドを正確に捉え、精度と耐干渉性のバランスを保ちます。複雑な設定は不要 — パーソナライズされたウェイクアップを簡単に実現し、より直感的な人とロボットの対話体験を提供します。
-
02 複数の音声ブロードキャストモード
ウェイクアップワード認識による自動音声ブロードキャストと、外部ホストコントローラーによる能動的な音声ブロードキャストをサポート。2つのモードを柔軟に切り替えられます。
-
03 エコーキャンセリングによる自然な対話
ブロードキャスト中にウェイクアップワードやコマンドで再生を中断でき、音声モジュールが即座に応答して最新のコマンド内容をブロードキャストします。よりスムーズで自然な人と機械の対話体験を提供します。
ハードウェア特長 — 音声モジュール
-
01 統合設計、開発をシンプルに
高感度ノイズリダクションマイクと高忠実度スピーカーを一体化し、音声認識 + 音声再生を1台で実現。AI音声対話システムの開発プロセスとハードウェア導入コストを大幅に簡素化し、追加のオーディオ周辺機器なしで音声対話ソリューションをすぐに構築できます。
高忠実度スピーカー: 音声ディテールを正確に再現するクリアな音質を提供。内蔵版と外付け版があります。
高性能ノイズリダクションマイク: 高度なノイズ抑圧アルゴリズムを統合し、6m以内で最大99%の認識精度を実現します。
-
02 高精度音声認識モジュール
高度なノイズ抑圧アルゴリズムにより周囲の環境ノイズを効果的に除去し、最大6メートルの遠距離ウェイクアップワード認識をサポート。最大99%の精度で正確かつ効率的な音声コマンド制御を実現します。
-
03 幅広い互換性、ドライバー不要
ドライバー不要のプラグアンドプレイ対応Type-Cインターフェースを内蔵。USB接続でRaspberry Piなどの組み込みホストと組み合わせられ、ピン使用量を削減します。Mac OS、Windows、LinuxなどのOSに対応。
-
04 マルチコントローラー・拡張ボード対応
Raspberry Pi、Jetson、RDKなどの主要コントローラーに対応し、柔軟なハードウェア拡張と多彩な組み合わせを実現します。ロボットのクリエイティブな可能性をさらに広げ — アイデアの実装をより簡単に、ロボットとの対話をより魅力的に!
音声モジュール配線図
1. 音声対話モジュール — シリアル通信配線図
-
図: Raspberry Pi に接続した AI 音声対話モジュール
-
図: Jetson Orin に接続した AI 音声対話モジュール
2. 音声対話モジュール — IIC通信配線図
-
図: Raspberry Pi に接続した AI 音声対話モジュール
-
図: Jetson Orin に接続した AI 音声対話モジュール
3. 音声対話モジュール — Type-C通信配線図
ドライバー不要のプラグアンドプレイ対応Type-Cインターフェース内蔵で、ファームウェア更新も簡単。USB接続でRaspberry Piなどの組み込みホストと組み合わせられ、ピン使用量を削減します。
-
図: Raspberry Pi に接続した AI 音声対話モジュール
-
図: Jetson Orin に接続した AI 音声対話モジュール
AI音声モジュール ROS1 & ROS2 対応
音声対話モジュールはROS1とROS2の両方に対応しています。
AI音声モジュールの応用シーン
スマートホーム、ロボット応用、プログラマブルロボットドッグ、センサー対話ソリューション
音声モジュールのハードウェアインターフェース

|
番号 |
ハードウェア名 / 説明 |
|
1 |
スピーカー — アナログ信号を音声に変換 |
|
2 |
スライドスイッチ — ファームウェアプログラミング用にシリアルポートを切り替え |
|
3 |
マイク — 音声をアナログ信号に変換 |
|
4 |
RSTボタン — リセットボタン |
|
5 |
電源インジケーター(赤)— 電源が正常なときに点灯 |
|
6 |
Type-Cインターフェース — 電源供給とCI1302/STC8ファームウェアの更新/ダウンロード用 |
|
7 |
オーディオアンプチップ — デジタル信号をアナログ信号に変換してスピーカーを駆動 |
|
8 |
CI1302チップ — 高性能音声認識チップ。音声を認識して信号を出力 |
|
9 |
逆接続保護 — 5V/GNDの逆接続からの保護 |
|
10 |
IICインターフェース — 電源供給とホストデバイスとの通信のスレーブとして動作 |
|
11 |
シリアルインターフェース — プロトコルベースのブロードキャスト制御用外部シリアルポート |
|
12 |
STC8Hチップ — 音声チップのコマンドをIICプロトコルとシリアルコマンドに変換 |
AI音声モジュール仕様
|
チップモデル |
CI1302 (ChipIntelli) |
|
電源電圧 |
DC 5V |
|
RAM |
640KByte |
|
FLASH |
2MByte |
|
認識モード |
コマンドウェイクアップ |
|
通信方式 |
IIC通信(ホストと4ピン接続)、シリアル通信 |
|
認識距離 |
静かな環境で最大6メートル、騒がしい環境では1メートル |
|
認識要件 |
固定のコマンドフレーズを認識。最大255フレーズまたは短文に対応。認識フレーズはファームウェアで変更可能。 |
|
プリセットコマンド数 |
110以上のコマンドフレーズ(最大120) |
|
デフォルトのウェイクアップワード |
"Hello, Little Rhino" |
AI音声モジュール同梱品リスト
|
音声対話モジュール |
1個(本体モジュール) |
|
Type-C データケーブル |
1個(電源と通信用) |
|
PH2.0 4ピンケーブル(20cm) |
1個(シリアル接続用) |
|
PH2.0 4ピン-Dupontケーブル(20cm) |
1個(UART接続用) |
仕様
よくある質問
What is the AI 音声認識モジュール — キーワード起動、バイリンガル音声、110+ コマンド?
Where can I find technical documentation and open-source files for the AI 音声認識モジュール — キーワード起動、バイリンガル音声、110+ コマンド?
What platforms and frameworks is the AI 音声認識モジュール — キーワード起動、バイリンガル音声、110+ コマンド compatible with?
How can I get technical support for the AI 音声認識モジュール — キーワード起動、バイリンガル音声、110+ コマンド?
ビデオなし
Read technical documentation, schematics, and research papers on feishu.cn/wiki/RhA6wg91hiFZykkcDGoc8wMCnch











