Fish Audio Docs
API リファレンステキスト読み上げリアルタイムテキスト読み上げ
Back to site

リアルタイムテキスト読み上げ v1

凍結された Realtime TTS WebSocket v1 を使用する既存クライアントを保守します。

Realtime TTS v1 は凍結された互換契約です。新規統合では上位の v3 契約を使用してください。v1、v2、v3 のイベントとフィールドに互換性はありません。

エンドポイント、認証、エンコード

項目
WebSocketwss://realtime.fishaudio.org/v1/tts/live
サブプロトコルrealtime.tts.msgpack.v1
エンコードMessagePack バイナリフレーム
Authorization: Bearer FISHAUDIO_API_KEY
Sec-WebSocket-Protocol: realtime.tts.msgpack.v1

認証情報を URL やブラウザーコードに含めないでください。

イベントフロー

authenticated → start → ready → text → flush → audio → usage → stop → finish

クライアントイベントは starttextflushstopping。サーバーイベントは authenticatedreadyaudiousagepongwarningfinisherror です。音声は audio.data に入り、stop 前に複数の textflush セグメントを送信できます。

start.request

フィールド規則
model_id必須の公開音声/モデル UUID。modelId も使用可能。
engine_model_id任意。別名は engineModelId
formatmp3wavpcmopus。既定値 mp3
speed / volume0.5–2 / 0–10
language1–32 文字。
chunk_length100–300 の整数。
latencynormal または balanced

すべてのメッセージは MessagePack Map で、不明なフィールドは拒否されます。課金は受理された flush セグメント単位です。v1 には永続的な再実行やセグメント冪等性がありません。エラーは codemessageretryable を含みます。新機能には Realtime TTS v3 を使用してください。