Skip to main content
POST
音声を生成

音声のマッピング

voiceは内部エイリアスマップを使ってプロバイダーごとに正規化されます。
  • openai: 一般的な音声(例: alloy, ash, ballad, coral, echo, fable, onyx, nova, sage, shimmer, verse, cedar, marin).
  • google (AI Studio / Gemini TTS): 標準のプリビルド音声: Zephyr, Puck, Charon, Kore, Fenrir, Leda, Orus, Aoede, Callirrhoe, Autonoe, Enceladus, Iapetus, Umbriel, Algieba, Despina, Erinome, Algenib, Rasalgethi, Laomedeia, Achernar, Alnilam, Schedar, Gacrux, Pulcherrima, Achird, Zubenelgenubi, Vindemiatrix, Sadachbia, Sadaltager, Sulafat.
  • elevenlabs: 一般公開されている初期音声をマッピングします(例: rachel, domi, bella, antoni, elli, josh, arnold, adam, sam).
eleven-labs/eleven-v4 と eleven-labs/eleven-v4-turbo には、カスタムクローンを含む任意の 20 文字の ElevenLabs 音声ライブラリ ID を指定できます。必要に応じて config.elevenlabs.voice_settings.stability と similarity_boost を設定してください。Eleven v4 は speed と voice_settings.style に対応していません。 指定したvoiceがルート先のプロバイダーとモデルで無効な場合、リクエストはparam: "voice"を含む400 invalid_request_errorを返します。

プロバイダー固有の設定

プロバイダー固有の音声設定も渡せます。
  • ElevenLabs: config.elevenlabs.voice_id / config.elevenlabs.voice / config.elevenlabs.voiceName
  • Google: config.google.voice_name / config.google.voiceName
移植性を高めるため、トップレベルのvoiceを既定値として使ってください。

音声サンプル

承認

Authorization
string
header
必須

Bearer トークンによる認証

ボディ

application/json
model
string
必須
input
string
必須
voice
string
speed
number
必須範囲: 0.25 <= x <= 4
format
enum<string>
利用可能なオプション:
mp3,
wav,
ogg,
aac
provider
object

ゲートウェイでの選択に使用するプロバイダーのルーティング設定。

config
object

レスポンス

200 - audio/mpeg

音声ファイル

The response is of type file.

最終更新日 2026年10月2日