Fish Audio Docs
Guias de integraçãoIntegrações de terceiros
Back to site

Configuração do Agente Hermes

Configure o Hermes Agent para gerar arquivos de fala por meio do endpoint TTS compatível com Fish Audio OpenAI.

Conecte Fish Audio TTS ao Agente Hermes

O Hermes Agent pode usar um URL base personalizado para seu provedor OpenAI TTS integrado. Isso conecta a ferramenta text_to_speech a Fish Audio sem alterar o modelo de linguagem que alimenta o Hermes.

Não adicione este endpoint nos provedores de modelo Hermes. Fish Audio expõe a geração de fala em /v1/audio/speech, não no terminal /v1/chat/completions exigido por um modelo de chat.

Antes de começar

Você precisa de:

  • Uma chave Fish Audio API com créditos API
  • Um ID de voz Fish Audio
  • Uma instalação recente do Agente Hermes

Crie uma chave API dedicada para Hermes para que você possa monitorá-la ou revogá-la de forma independente.

Adicione a chave API

Adicione a chave a ~/.hermes/.env:

VOICE_TOOLS_OPENAI_KEY=YOUR_FISH_AUDIO_API_KEY

Não coloque a chave em config.yaml, histórico de shell, capturas de tela ou repositório.

Configurar Fish Audio TTS

Adicione ou atualize a seção tts em ~/.hermes/config.yaml:

tts:
  provider: openai
  speed: 1.0
  openai:
    base_url: 'https://fishaudio.org/v1'
    model: fishaudio-s21pro-flash
    voice: 00a1b221-6137-4b73-ad62-b0cbce134167
    speed: 1.0

O exemplo Voice ID é uma voz de sistema público para teste de conexão. Substitua-o pelo seu ID de voz Fish Audio preferido após a primeira solicitação bem-sucedida.

Habilite e teste a ferramenta

Execute hermes tools e certifique-se de que Voice & TTS esteja ativado. Inicie Hermes e pergunte:

Use the text_to_speech tool to create an MP3 file that says:
"Hello, this is a Fish Audio test."

Hermes deve salvar um arquivo MP3 em seu diretório de saída de áudio e retornar um caminho de mídia.

Limitação do canal de mensagens

Esta configuração é verificada para geração de arquivos MP3. Hermes pode solicitar saída nativa do Opus ao entregar balões de voz do Telegram ou Discord. O endpoint compatível com Fish Audio OpenAI atualmente suporta mp3, wav e pcm, portanto, a entrega de bolha de voz nativa do Opus não é suportada por esta configuração. Use um anexo de MP3 ou uma camada de conversão para esses canais.

Solução de problemas

  • Hermes diz que nenhuma chave de áudio OpenAI está configurada: confirme se VOICE_TOOLS_OPENAI_KEY está disponível para o processo que inicia o Hermes e reinicie-o.
  • As solicitações ainda chegam a OpenAI: confirme que tts.provider é openai e tts.openai.base_url é exatamente https://fishaudio.org/v1.
  • Voz ou modelo inválido: use IDs Fish Audio, e não nomes de voz OpenAI, como alloy ou nomes de modelos, como tts-1.
  • 401: substitua a chave API ausente, inválida ou revogada.
  • 402: adicione créditos API antes de tentar novamente.
  • Falha na solicitação Opus: solicite um arquivo MP3 em vez de um balão de voz de mensagem nativa.

Documentação relacionada