ヘルメスエージェントのセットアップ
Fish Audio OpenAI 互換の TTS エンドポイントを通じて音声ファイルを生成するように、Hermes エージェントを構成します。
Fish Audio TTS をエルメス エージェントに接続します
Hermes エージェントは、組み込みの OpenAI TTS プロバイダーのカスタム ベース URL を使用できます。これにより、Hermes を機能させる言語モデルを変更せずに、text_to_speech ツールが Fish Audio に接続されます。
このエンドポイントをHermesモデルプロバイダーの下に追加しないでください。 Fish Audio は、チャット モデルに必要な
/v1/chat/completionsエンドポイントではなく、/v1/audio/speechでの音声生成を公開します。
始める前に
必要なものは次のとおりです。
- Fish Audio API キー (API クレジット付き)
- Fish Audio 音声 ID
- 最近のHermes Agentのインストール
個別に監視または取り消しできるように、Hermes 専用の API キーを作成します。
API キーを追加します
キーを ~/.hermes/.env に追加します。
VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEYキーを config.yaml、シェル履歴、スクリーンショット、またはリポジトリに置かないでください。
Fish Audio TTS を構成します
~/.hermes/config.yaml の tts セクションを追加または更新します。
tts:
provider: openai
speed: 1.0
openai:
base_url: 'https://fishaudio.org/v1'
model: fishaudio-s21pro-flash
voice: 00a1b221-6137-4b73-ad62-b0cbce134167
speed: 1.0音声 ID の例は、接続テスト用の公開システム音声です。最初のリクエストが成功した後、これを希望の Fish Audio Voice ID に置き換えます。
ツールを有効にしてテストする
hermes tools を実行し、音声と TTS が有効になっていることを確認します。ヘルメスを起動して次のように尋ねます。
Use the text_to_speech tool to create an MP3 file that says:
"Hello, this is a Fish Audio test."Hermes は MP3 ファイルをオーディオ出力ディレクトリに保存し、メディア パスを返す必要があります。
メッセージング チャネルの制限
この設定は MP3 ファイルの生成について検証されています。 Hermes は、Telegram または Discord の音声バブルを配信するときに、ネイティブの Opus 出力を要求する場合があります。 Fish Audio OpenAI 互換エンドポイントは現在、mp3、wav、および pcm をサポートしているため、ネイティブ Opus 音声バブル配信はこの構成ではサポートされていません。これらのチャネルには MP3 添付ファイルまたは変換レイヤーを使用します。
トラブルシューティング
- Hermes は、OpenAI オーディオ キーが設定されていないと言っています:
VOICE_TOOLS_OPENAI_KEYが、Hermes を起動するプロセスで利用できることを確認してから、再起動します。 - リクエストは依然として OpenAI に到達します:
tts.providerがopenaiであり、tts.openai.base_urlが正確にhttps://fishaudio.org/v1であることを確認します。 - 無効な音声またはモデル:
alloyなどの OpenAI 音声名やtts-1などのモデル名ではなく、Fish Audio ID を使用してください。 - 401: 欠落している、無効である、または取り消された API キーを置き換えます。
- 402: 再試行する前に、API クレジットを追加してください。
- Opus リクエストが失敗します: ネイティブ メッセージング音声バブルの代わりに MP3 ファイルをリクエストします。