クリアな収音
騒音下でも聞き取り、話している最中でも割り込める
ローカル処理
完全ローカルで実測 0.9 秒応答、オフラインでも対話
調整済み、すぐ使える
各ボードで実測調整済み、コードは公開

シナリオ詳細

卓上対話ロボット、産業用音声制御、スマートホームアシスタントの3つの現場における対話方式と導入の選択肢。

端末上で聞き取り、その場で応答

デバイス上で多言語を認識し音声で応答します。卓上機器、会議端末、案内キオスクに組み込み、双方向の音声対話に使えます。


主なメリット

  • 多言語認識
  • 割り込み対応
  • 段階的音声品質
Scene Feature
多言語認識
30の対話言語から導入時に1つを選択。デバイスが選択言語に対応しない場合、導入はエラーで停止します。
Scene Feature
割り込み対応
応答再生中もマイクは収音を続け、ユーザーが話すと再生を止めて次のターンに移ります。
Scene Feature
音声ペルソナ
マシン音・シミュレート音・リアル音の3段階。J4012のリアル音モデルは参照音声から声をクローンできます。

音声で機器制御と現場入力を完結 — 操作のハードルを低減

倉庫、工場、サーバールームなどの現場で、エッジ音声が複雑なUIやバーコードスキャナを代替。現場作業員は自然言語で入出庫登録、設備点検、巡回報告、危険通知を実施。ローカルASRが構造化テキストを出力し、WMS、MES、IoTプラットフォームに直接連携可能。


主なメリット

  • 操作ハードルの低減
  • 弱いネットワークでも動作
  • 構造化出力
Scene Feature
倉庫入出庫
SKU・数量の音声呼び出し確認 — 構造化テキストで直接WMSに書き込み。
Scene Feature
設備点検
作業員が音声で機器状態を報告、AIが自動で点検フォームに記入し異常アラートを発報。
Scene Feature
現場巡回報告
巡回フォームを音声入力;危険イベントをリアルタイムで指令センターに音声伝達。

ウェイク後はローカル処理、オフラインでも操作可能

XIAO ESP32S3を低消費電力のウェイクフロントエンドとし、起動後は本体が認識・対話・音声応答を行い、Matter、HomeAssistant、Mi Homeなどのローカルプロトコルで機器を制御します。ローカルLLMを選ぶとコマンドはローカルで処理され、オフラインでも使えます。


主なメリット

  • 待機時省電力
  • カスタムウェイクワード
  • ローカル制御
Scene Feature
低消費電力ウェイク
ESP32S3がエッジでウェイクワードを検出してからメインシステムを起動、全体の省電力化を実現。
Scene Feature
カスタムウェイクワード
ウェイクワードを短い中国語または英語のブランドワードに変更可能。感度は厳格・標準・高感度の3段階。
Scene Feature
ローカルIoTオーケストレーション
Matter、HomeAssistant、Mi Homeと連携 — クラウドが切れてもスマートホーム制御は継続。

導入と選定

構成ツールは用途、音声グレード、同時処理数、ローカルLLM、集音方式、遅延要件を順に選んで具体的な型番を出します。

選び方に迷ったら 選定ガイドを詳しく見る →

用途

3つのアーキテクチャ形態:フロントエンド専用 / ハイブリッド / LLM一体型

音声処理の計算リソースをどこに置くかが、性能上限と単体BOMを決定します。一般的な3つの展開モデル:


主なメリット

  • フロントエンド専用
  • ハイブリッド
  • LLM一体型
製品画像デバイス同時対話数(音声のみ)音声機能ローカルLLM
reRouter CM4 シリーズreRouter CM4 シリーズ1チャネルマシン音声非対応(クラウド可)
reComputer RK3576 シリーズreComputer RK3576 シリーズ1チャネルシミュレート音声4B–7B(RK1828必要)
reComputer RK3588 シリーズreComputer RK3588 シリーズ1チャネルシミュレート音声4B–7B(RK1828必要)
reComputer J30 シリーズreComputer J30 シリーズ1チャネルリアル音声~2B
reComputer J40 シリーズreComputer J40 シリーズ2〜3チャネルリアル音声4B–7B
reComputer J50 シリーズreComputer J50 シリーズ3チャネル以上リアル音声7B–14B
NVIDIA Jetson AGX Thor Developer KitNVIDIA Jetson AGX Thor Developer Kit6チャネル以上(音声のみ)リアル音声14B–32B

シーン能力に応じてAIコンピュートボックスを選択

AIコンピュートボックスは対応音声能力によってランク分けされています。下表は本シナリオで利用できるデバイス一覧(ファミリー単位):各ファミリーの音声のみの同時対話数、音声機能、実行可能なローカルLLM規模を記載(マイクとスピーカーの選定は次のタブを参照)。具体的な型番・構成・アクセサリは下の構成ツールで選択してください。注:ローカルLLMを音声パイプラインと同一デバイスで実行すると性能が低下し、応答遅延が増加します。高並列 + 大規模モデルの場合は、より高い演算能力のグレードを推奨します。


主なメリット

  • ウェイク/コマンドワードのみ
  • スタンドアロン版
  • プロフェッショナル級リアル音声
  • 高並列 + 高度なLLM
製品タイプチップ集音
距離
収音
角度
内蔵
アンプ
コアアルゴリズム
reSpeaker Liteリニア
2マイク
XMOS XU3163m180°5WAEC · DoA
reSpeaker XVF3800円形
4マイク
XMOS XVF38005m360°5WAEC · DoA · Multi-beamforming
reSpeaker Clipウェアラブル
2マイク
nRF5340+nRF70023m360°—ノイズ抑制(SpeexDSP)
reSpeaker Flex Circular-4円形
4マイク
XMOS XVF38005m360°10WAEC · DoA · Multi-beamforming
reSpeaker Flex Linear-4リニア
4マイク
XMOS XVF38005m180°10WAEC · DoA · Multi-beamforming

reSpeakerシリーズの3つのコア優位性


主なメリット

  • ハードウェア集音
  • オンボード音響処理
  • オープンSDK

よくあるご質問

お探しの答えが見つかりませんか?
お問い合わせ
ハードウェアパートナーとしてうれしいです!
次へ