Fish Audio 文档
集成指南第三方软件接入

Hermes Agent 接入教程

配置 Hermes Agent,通过 Fish Audio 的 OpenAI 兼容 TTS 接口生成语音文件。

Hermes Agent 接入 Fish Audio TTS

Hermes Agent 内置的 OpenAI TTS Provider 支持自定义 Base URL,因此可以把 text_to_speech 工具连接到 Fish Audio,而不改变 Hermes 使用的语言模型。

不要把这个地址添加到 Hermes 的模型 Provider。Fish Audio 提供的是 /v1/audio/speech 语音生成接口,不是聊天模型需要的 /v1/chat/completions

准备工作

你需要:

  • 一个有 API 额度的 Fish Audio API Key
  • 一个 Fish Audio 音色 ID
  • 较新版本的 Hermes Agent

建议为 Hermes 单独创建 API Key,以便独立查看用量或撤销权限。

添加 API Key

把 Key 写入 ~/.hermes/.env

VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEY

不要把 Key 写进 config.yaml、Shell 历史、截图或代码仓库。

配置 Fish Audio TTS

~/.hermes/config.yaml 中添加或更新 tts

tts:
  provider: openai
  speed: 1.0
  openai:
    base_url: 'https://fishaudio.org/v1'
    model: fishaudio-s21pro-flash
    voice: 00a1b221-6137-4b73-ad62-b0cbce134167
    speed: 1.0

示例音色是用于联通测试的公开系统音色。首次请求成功后,可以替换成自己的 Fish Audio 音色 ID

启用并测试

运行 hermes tools,确认已经启用 Voice & TTS。启动 Hermes 后输入:

请使用 text_to_speech 工具生成一个 MP3 文件,内容是:
“你好,这是一条 Fish Audio 测试语音。”

Hermes 应在音频输出目录中保存 MP3 文件,并返回媒体文件路径。

消息渠道限制

上述配置已覆盖 MP3 文件生成。Hermes 向 Telegram 或 Discord 发送原生语音气泡时可能请求 Opus;Fish Audio 当前的 OpenAI 兼容接口支持 mp3wavpcm,因此这套配置暂不支持原生 Opus 语音气泡。此类渠道请先使用 MP3 附件,或增加格式转换层。

常见问题

  • Hermes 提示没有 OpenAI Audio Key:确认启动 Hermes 的进程能够读取 VOICE_TOOLS_OPENAI_KEY,然后重启。
  • 请求仍然发送给 OpenAI:确认 tts.provideropenai,并且 tts.openai.base_urlhttps://fishaudio.org/v1
  • 音色或模型无效:请使用 Fish Audio ID,不要使用 alloytts-1 等 OpenAI 默认值。
  • 401:API Key 缺失、无效或已撤销,请更换。
  • 402:API 额度不足,请补充额度后重试。
  • Opus 请求失败:改为生成 MP3 文件,不要请求消息渠道的原生语音气泡。

相关文档