Fish Audio Docs
整合指南第三方集成
返回主站

Hermes 代理設置

設定 Hermes Agent 透過 Fish Audio OpenAI 相容的 TTS 端點產生語音檔案。

將 Fish Audio TTS 連接到 Hermes 代理

Hermes Agent 可以為其內建 OpenAI TTS 提供者使用自訂基本 URL。這會將 text_to_speech 工具連接到 Fish Audio,而無需更改為 Hermes 提供支援的語言模型。

不要在 Hermes 模型提供者下方加入此端點。 Fish Audio 在 /v1/audio/speech 公開語音生成,而不是聊天模型所需的 /v1/chat/completions 端點。

開始之前

您需要:

  • 帶有 API 積分的 Fish Audio API 鑰匙
  • Fish Audio 語音 ID
  • 最近安裝了 Hermes Agent

為 Hermes 建立專用的 API 金鑰,以便您可以獨立監控或撤銷它。

新增 API 金鑰

將密鑰加入~/.hermes/.env

VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEY

請勿將金鑰放入 config.yaml、shell 歷史記錄、螢幕截圖或儲存庫中。

設定 Fish Audio TTS

新增或更新 ~/.hermes/config.yaml 中的 tts 部分:

tts:
  provider: openai
  speed: 1.0
  openai:
    base_url: 'https://fishaudio.org/v1'
    model: fishaudio-s21pro-flash
    voice: 00a1b221-6137-4b73-ad62-b0cbce134167
    speed: 1.0

範例語音 ID 是用於連線測試的公共系統語音。第一次成功請求後,將其替換為您首選的 Fish Audio 語音 ID

啟用並測試該工具

運行 hermes tools 並確保語音和 TTS 已啟用。啟動 Hermes 並詢問:

Use the text_to_speech tool to create an MP3 file that says:
"Hello, this is a Fish Audio test."

Hermes 應將 MP3 檔案保存在其音訊輸出目錄中並返回媒體路徑。

訊息傳遞通道限制

此設定已針對 MP3 檔案產生進行驗證。 Hermes 在傳送 Telegram 或 Discord 語音氣泡時可能會要求原生 Opus 輸出。 Fish Audio OpenAI 相容終端目前支援 mp3wavpcm,因此此設定不支援本機 Opus 語音氣泡傳送。對這些通道使用 MP3 附件或轉換圖層。

故障排除

  • Hermes 說沒有配置 OpenAI 音訊金鑰:確認 VOICE_TOOLS_OPENAI_KEY 可用於啟動 Hermes 的進程,然後重新啟動它。
  • 請求仍然到達OpenAI:確認tts.provideropenai並且tts.openai.base_url正是https://fishaudio.org/v1
  • 無效的語音或模型:使用 Fish Audio ID,而不是 OpenAI 語音名稱(例如 alloy)或模型名稱(例如 tts-1)。
  • 401:取代遺失、無效或撤銷的 API 金鑰。
  • 402:在重試之前加入 API 積分。
  • Opus 請求失敗:請求 MP3 檔案而不是本機訊息語音氣泡。

相關文檔