Fish Audio Docs
統合ガイドサードパーティの統合
Back to site

ヘルメスエージェントのセットアップ

Fish Audio OpenAI 互換の TTS エンドポイントを通じて音声ファイルを生成するように、Hermes エージェントを構成します。

Fish Audio TTS をエルメス エージェントに接続します

Hermes エージェントは、組み込みの OpenAI TTS プロバイダーのカスタム ベース URL を使用できます。これにより、Hermes を機能させる言語モデルを変更せずに、text_to_speech ツールが Fish Audio に接続されます。

このエンドポイントをHermesモデルプロバイダーの下に追加しないでください。 Fish Audio は、チャット モデルに必要な /v1/chat/completions エンドポイントではなく、/v1/audio/speech での音声生成を公開します。

始める前に

必要なものは次のとおりです。

  • Fish Audio API キー (API クレジット付き)
  • Fish Audio 音声 ID
  • 最近のHermes Agentのインストール

個別に監視または取り消しできるように、Hermes 専用の API キーを作成します。

API キーを追加します

キーを ~/.hermes/.env に追加します。

VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEY

キーを config.yaml、シェル履歴、スクリーンショット、またはリポジトリに置かないでください。

Fish Audio TTS を構成します

~/.hermes/config.yamltts セクションを追加または更新します。

tts:
  provider: openai
  speed: 1.0
  openai:
    base_url: 'https://fishaudio.org/v1'
    model: fishaudio-s21pro-flash
    voice: 00a1b221-6137-4b73-ad62-b0cbce134167
    speed: 1.0

音声 ID の例は、接続テスト用の公開システム音声です。最初のリクエストが成功した後、これを希望の Fish Audio Voice ID に置き換えます。

ツールを有効にしてテストする

hermes tools を実行し、音声と TTS が有効になっていることを確認します。ヘルメスを起動して次のように尋ねます。

Use the text_to_speech tool to create an MP3 file that says:
"Hello, this is a Fish Audio test."

Hermes は MP3 ファイルをオーディオ出力ディレクトリに保存し、メディア パスを返す必要があります。

メッセージング チャネルの制限

この設定は MP3 ファイルの生成について検証されています。 Hermes は、Telegram または Discord の音声バブルを配信するときに、ネイティブの Opus 出力を要求する場合があります。 Fish Audio OpenAI 互換エンドポイントは現在、mp3wav、および pcm をサポートしているため、ネイティブ Opus 音声バブル配信はこの構成ではサポートされていません。これらのチャネルには MP3 添付ファイルまたは変換レイヤーを使用します。

トラブルシューティング

  • Hermes は、OpenAI オーディオ キーが設定されていないと言っています: VOICE_TOOLS_OPENAI_KEY が、Hermes を起動するプロセスで利用できることを確認してから、再起動します。
  • リクエストは依然として OpenAI に到達します: tts.provideropenai であり、tts.openai.base_url が正確に https://fishaudio.org/v1 であることを確認します。
  • 無効な音声またはモデル: alloy などの OpenAI 音声名や tts-1 などのモデル名ではなく、Fish Audio ID を使用してください。
  • 401: 欠落している、無効である、または取り消された API キーを置き換えます。
  • 402: 再試行する前に、API クレジットを追加してください。
  • Opus リクエストが失敗します: ネイティブ メッセージング音声バブルの代わりに MP3 ファイルをリクエストします。

関連ドキュメント