集成指南第三方软件接入
Hermes Agent 接入教程
配置 Hermes Agent,通过 Fish Audio 的 OpenAI 兼容 TTS 接口生成语音文件。
Hermes Agent 接入 Fish Audio TTS
Hermes Agent 内置的 OpenAI TTS Provider 支持自定义 Base URL,因此可以把 text_to_speech 工具连接到 Fish Audio,而不改变 Hermes 使用的语言模型。
不要把这个地址添加到 Hermes 的模型 Provider。Fish Audio 提供的是
/v1/audio/speech语音生成接口,不是聊天模型需要的/v1/chat/completions。
准备工作
你需要:
- 一个有 API 额度的 Fish Audio API Key
- 一个 Fish Audio 音色 ID
- 较新版本的 Hermes Agent
建议为 Hermes 单独创建 API Key,以便独立查看用量或撤销权限。
添加 API Key
把 Key 写入 ~/.hermes/.env:
VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEY不要把 Key 写进 config.yaml、Shell 历史、截图或代码仓库。
配置 Fish Audio TTS
在 ~/.hermes/config.yaml 中添加或更新 tts:
tts:
provider: openai
speed: 1.0
openai:
base_url: 'https://fishaudio.org/v1'
model: fishaudio-s21pro-flash
voice: 00a1b221-6137-4b73-ad62-b0cbce134167
speed: 1.0示例音色是用于联通测试的公开系统音色。首次请求成功后,可以替换成自己的 Fish Audio 音色 ID。
启用并测试
运行 hermes tools,确认已经启用 Voice & TTS。启动 Hermes 后输入:
请使用 text_to_speech 工具生成一个 MP3 文件,内容是:
“你好,这是一条 Fish Audio 测试语音。”Hermes 应在音频输出目录中保存 MP3 文件,并返回媒体文件路径。
消息渠道限制
上述配置已覆盖 MP3 文件生成。Hermes 向 Telegram 或 Discord 发送原生语音气泡时可能请求 Opus;Fish Audio 当前的 OpenAI 兼容接口支持 mp3、wav 和 pcm,因此这套配置暂不支持原生 Opus 语音气泡。此类渠道请先使用 MP3 附件,或增加格式转换层。
常见问题
- Hermes 提示没有 OpenAI Audio Key:确认启动 Hermes 的进程能够读取
VOICE_TOOLS_OPENAI_KEY,然后重启。 - 请求仍然发送给 OpenAI:确认
tts.provider是openai,并且tts.openai.base_url是https://fishaudio.org/v1。 - 音色或模型无效:请使用 Fish Audio ID,不要使用
alloy、tts-1等 OpenAI 默认值。 - 401:API Key 缺失、无效或已撤销,请更换。
- 402:API 额度不足,请补充额度后重试。
- Opus 请求失败:改为生成 MP3 文件,不要请求消息渠道的原生语音气泡。