Raspberry Pi 音声アシスタント

話しかけると音声で答える、クラウドを使わない小型AI端末。

Raspberry Pi 音声アシスタントのイメージ

スマートスピーカーは便利な反面、話した内容がクラウドに送られます。同じことを手元だけで完結させられるかを確かめるために作った、Raspberry Pi 4の音声アシスタントです。USBマイクで録音し、whisper.cppで文字起こしし、内容に応じた返答を組み立てて、Open JTalkで読み上げます。この一連の処理をすべてラズパイ内で動かしているため、APIキーも通信費も不要で、ネットワークを切っても動きます。実用的な応答速度を出すためモデルは最小構成を選び、録音デバイスやモデルのパスは環境変数で差し替えられるようにしました。デバイス設定や音声入出力の調整といったハードウェア側の環境構築も含めて自分で行っています。

使用技術
  • Raspberry Pi 4
  • Python
  • whisper.cpp(音声認識)
  • Open JTalk(音声合成)
  • ALSA
  • USBマイク
担当
  • 構成設計
  • 録音・再生の実装
  • 文字起こしと応答処理の実装
  • デバイス設定・調整
成果
  • 録音から読み上げまでをラズパイ内だけで完結
  • クラウドAPIを使わず、APIキーも通信も不要
  • 録音デバイスとモデルのパスを環境変数で切り替え可能に
制作期間
試作
ステータス
試作完了

← 制作実績の一覧へ戻る