Skip to main content
Voice format: inworld.<Model>.<VoiceId> Models:
  • inworld-tts-1.5-mini (alias Mini) — faster, lower latency.
  • inworld-tts-1.5-max (alias Max) — higher quality.
  • inworld-tts-2 (alias TTS2) — latest generation; supports the delivery_mode parameter.
Defaults to inworld-tts-1.5-mini if model omitted.

Voice Samples


WebSocket

Query Parameters

Voice Settings

REST API

Fields

Response

Default (binary_output): chunked audio bytes. With output_type: "base64_output": JSON with base64-encoded audio. With output_type: "audio_id": JSON with an audio_url for deferred retrieval.