Fish Audio Docs
API 參考文字轉語音即時文字轉語音
返回主站

即時文字轉語音 v1

維護仍使用已凍結 Realtime TTS WebSocket v1 協定的客戶端。

Realtime TTS v1 是現有客戶端的凍結相容協定。新接入應使用上級 v3 協定;v1、v2、v3 的事件與欄位並不相同。

端點、驗證與編碼

項目
WebSocketwss://realtime.fishaudio.org/v1/tts/live
子協定realtime.tts.msgpack.v1
編碼MessagePack 二進位幀
Authorization: Bearer FISHAUDIO_API_KEY
Sec-WebSocket-Protocol: realtime.tts.msgpack.v1

不要把憑證放入 URL 或瀏覽器程式碼。

事件流程

authenticated → start → ready → text → flush → audio → usage → stop → finish

客戶端事件為 starttextflushstopping。服務端事件為 authenticatedreadyaudiousagepongwarningfinisherror。音訊位於 audio.data;可在 stop 前重複 textflush 以產生多個分段。

start.request

欄位規則
model_id必填,公開音色/模型 UUID;亦接受 modelId
engine_model_id選填;亦接受 engineModelId
formatmp3wavpcmopus,預設 mp3
speed / volume0.5–2 / 0–10
language1–32 個字元。
chunk_length100–300 的整數。
latencynormalbalanced

所有訊息都是 MessagePack Map,未知欄位會被拒絕。系統按成功接受的 flush 分段結算;v1 不提供持久重放或分段冪等。錯誤包含 codemessageretryable。新功能請遷移到即時文字轉語音 v3