J4012 上に OpenVoiceStream をデプロイし、音声認識・音声合成・声紋の機能を提供します。次のステップの音声 AI サービスは同じ J4012 上に配置され、ここに接続します。
この Tier は音声処理のみをローカルで実行し、LLM はクラウド API を呼び出すため、ローカル大規模モデルはデプロイしません — その分の GPU リソースは、ステップ 3 の顔認証サービスと並行して動く音声セッションの同時処理に充てられます。
ターゲット
本機上に直接デプロイします。本機が J4012 そのものである場合にのみ利用できます。モデルは自動的にダウンロードされるため、オフラインパッケージの準備は不要です。
ターゲット
配線
- J4012 を電源とイーサネットに接続します
- J4012 の IP アドレスと SSH 認証情報を入力します(ステップ 3 と同じデバイスです)
- Deploy をクリックし、モデルのダウンロードとサービスの起動が終わるまで待ちます
サービスは 8621 をリッスンし、Watcher 1 台につき 1 セッション、最大 3 セッションの同時接続に対応します。4 台目は 4429 too_many_sessions で拒否されます。このマシンの LAN IP を控えておいてください。次のステップで「音声サービスアドレス」として入力します。
音声サービスと次のステップが同じマシン上にある場合でも、127.0.0.1 は指定しないでください。このアドレスはコンテナ内から読み取られるため、コンテナ内の 127.0.0.1 はコンテナ自身を指し、ホスト側のサービスには到達しません。
トラブルシューティング
| 症状 | 対処方法 |
|---|
| 初回デプロイが止まったように見える | 正常です。初回起動時に hf-mirror 経由で約 5GB のモデルをダウンロードするため、10分以上かかることがあります |
| ディスク容量が足りない | このステップには最低 15GB の空き容量が必要です |
| NVIDIA runtime が利用できない | nvidia-container-toolkit をインストールし、Docker を再起動してください |
| コンテナ名の競合でデプロイが中断する | デバイス上に手動インストール済みの音声サービス、または別 Tier の音声ステップが存在します。両者は同じコンテナ名とポート 8621 を取り合うため共存できません。案内に従って既存コンテナを docker rm -f してから再試行してください。ボリュームは影響を受けません |
| デプロイは完了したが 8621 に接続できない | モデルの読み込み中です。docker logs seeed-voice-v010 で進捗を確認し、curl localhost:8621/readyz が 200 を返せば準備完了です |
Watcher が 4429 too_many_sessions を受け取る | 3 系統すべてが使用中です。会話が終了するとセッションは解放されます。開いたままになっている Watcher がないか確認してください |