헤르메스 에이전트 설정
Fish Audio OpenAI 호환 TTS 엔드포인트를 통해 음성 파일을 생성하도록 Hermes 에이전트를 구성합니다.
Fish Audio TTS를 Hermes 에이전트에 연결합니다.
Hermes 에이전트는 내장된 OpenAI TTS 공급자에 대해 사용자 정의 기본 URL을 사용할 수 있습니다. 이는 Hermes를 지원하는 언어 모델을 변경하지 않고 text_to_speech 도구를 Fish Audio에 연결합니다.
Hermes 모델 공급자 아래에 이 엔드포인트를 추가하지 마세요. Fish Audio는 채팅 모델에 필요한
/v1/chat/completions엔드포인트가 아닌/v1/audio/speech에서 음성 생성을 노출합니다.
시작하기 전에
당신은 다음이 필요합니다
- API 크레딧이 포함된 Fish Audio API 키
- Fish Audio 음성 ID
- 최근 Hermes Agent 설치
Hermes 전용 API 키를 생성하여 독립적으로 모니터링하거나 취소할 수 있습니다.
API 키 추가
~/.hermes/.env에 키를 추가합니다.
VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEYconfig.yaml, 쉘 기록, 스크린샷 또는 저장소에 키를 넣지 마십시오.
Fish Audio TTS 구성
~/.hermes/config.yaml에서 tts 섹션을 추가하거나 업데이트합니다.
tts:
provider: openai
speed: 1.0
openai:
base_url: 'https://fishaudio.org/v1'
model: fishaudio-s21pro-flash
voice: 00a1b221-6137-4b73-ad62-b0cbce134167
speed: 1.0예시 Voice ID는 연결 테스트를 위한 공개 시스템 음성입니다. 첫 번째 요청 성공 후 원하는 Fish Audio 음성 ID로 바꾸세요.
도구 활성화 및 테스트
hermes tools를 실행하고 음성 및 TTS가 활성화되어 있는지 확인하세요. Hermes를 시작하고 다음과 같이 질문하십시오.
Use the text_to_speech tool to create an MP3 file that says:
"Hello, this is a Fish Audio test."Hermes는 오디오 출력 디렉터리에 MP3 파일을 저장하고 미디어 경로를 반환해야 합니다.
메시징 채널 제한
이 설정은 MP3 파일 생성을 위해 검증되었습니다. Hermes는 Telegram 또는 Discord 음성 풍선을 전달할 때 기본 Opus 출력을 요청할 수 있습니다. Fish Audio OpenAI 호환 엔드포인트는 현재 mp3, wav 및 pcm를 지원하므로 이 구성에서는 기본 Opus 음성 버블 전달이 지원되지 않습니다. 해당 채널에는 MP3 첨부 파일이나 변환 레이어를 사용하세요.
문제 해결
- Hermes에서는 구성된 OpenAI 오디오 키가 없다고 말합니다: Hermes를 시작하는 프로세스에서
VOICE_TOOLS_OPENAI_KEY를 사용할 수 있는지 확인한 다음 다시 시작하세요. - 요청이 여전히 OpenAI에 도달합니다:
tts.provider가openai이고tts.openai.base_url가 정확히https://fishaudio.org/v1인지 확인하세요. - 잘못된 음성 또는 모델:
alloy와 같은 OpenAI 음성 이름이나tts-1와 같은 모델 이름이 아닌 Fish Audio ID를 사용합니다. - 401: 누락되거나 유효하지 않거나 취소된 API 키를 교체합니다.
- 402: 재시도하기 전에 API 크레딧을 추가하세요.
- Opus 요청 실패: 기본 메시지 음성 풍선 대신 MP3 파일을 요청합니다.