SLNG · AsyncAPI Specification
SLNG Gateway API - SLNG (WebSocket)
Version 0.2.0
SLNG Gateway API
View Spec
View on GitHub
CompanySpeechVoiceSpeech to TextText to SpeechVoice AIVoice AgentsTranscriptionSpeech RecognitionArtificial IntelligenceAPI GatewayAsyncAPIWebhooksEvents
Channels
/v1/stt/slng/openai/whisper:large-v3
Real-time speech-to-text transcription using OpenAI's Whisper Large v3 model via WebSocket. Supports streaming audio input with intelligent Voice Activity Detection (VAD), partial transcripts for immediate feedback, and automatic language detection. Perfect for live transcription, voice commands, and real-time captioning.
/v1/stt/slng/openai/whisper:large-v3-compressed
Real-time speech-to-text transcription using OpenAI's Whisper Large v3 model via WebSocket with compressed audio support. Supports streaming audio input with intelligent Voice Activity Detection (VAD), partial transcripts for immediate feedback, and automatic language detection.
/v1/stt/slng/speechmatics:en
Speech-to-Text. Real-time speech-to-text transcription using Speechmatics model hosted by SLNG via WebSocket. Supports streaming audio input with intelligent Voice Activity Detection (VAD), partial transcripts for immediate feedback. Perfect for live transcription, voice commands, and real-time captioning. Supports English and Spanish with high accuracy.
/v1/stt/slng/speechmatics:es
Speech-to-Text. Real-time speech-to-text transcription using Speechmatics model hosted by SLNG via WebSocket. Supports streaming audio input with intelligent Voice Activity Detection (VAD), partial transcripts for immediate feedback. Perfect for live transcription, voice commands, and real-time captioning. Supports English and Spanish with high accuracy.
/v1/stt/slng/deepgram/nova:3-en
Speech-to-Text API for converting audio files to text using SLNG deepgram/nova. Real-time speech-to-text transcription with ultra-low latency using Deepgram's Nova model. Optimized for streaming audio with intelligent Voice Activity Detection (VAD) and speaker diarization.
/v1/stt/slng/deepgram/nova:3-es
Speech-to-Text API for converting audio files to text using SLNG deepgram/nova. Real-time speech-to-text transcription with ultra-low latency using Deepgram's Nova model. Optimized for streaming audio with intelligent Voice Activity Detection (VAD) and speaker diarization.
/v1/stt/slng/deepgram/nova:3-hi
Speech-to-Text API for converting audio files to text using SLNG deepgram/nova. Real-time speech-to-text transcription with ultra-low latency using Deepgram's Nova model. Optimized for streaming audio with intelligent Voice Activity Detection (VAD) and speaker diarization.
/v1/stt/slng/deepgram/nova:3-multi
Speech-to-Text API for converting audio files to text using SLNG deepgram/nova. Real-time speech-to-text transcription with ultra-low latency using Deepgram's Nova model. Optimized for streaming audio with intelligent Voice Activity Detection (VAD) and speaker diarization.
/v1/tts/slng/canopylabs/orpheus:en
Text-to-Speech API for generating speech from text using SLNG canopylabs/orpheus. High-quality streaming TTS with emotion control, hosted on SLNG infrastructure. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/myshell/melo:v1
Text-to-Speech API for generating speech from text using SLNG myshell/melo. Melo - High-quality TTS model deployed on SLNG infrastructure. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/geneing/kokoro:v1
Text-to-Speech API for generating speech from text using SLNG geneing/kokoro. Kokoro TTS model deployed on SLNG infrastructure. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:3-en
Text-to-Speech API for generating English speech using Rime Arcana v3 TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:3-fr
Text-to-Speech API for generating French speech using Rime Arcana v3 TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:3-hi
Text-to-Speech API for generating Hindi speech using Rime Arcana v3 TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana/{lang}
Text-to-Speech API for generating speech from text using SLNG rime/arcana. Rime Arcana TTS model supporting multiple languages. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:ar
Text-to-Speech API for generating Arabic speech from text using Rime Arcana TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:de
Text-to-Speech API for generating German speech from text using Rime Arcana TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:en
Text-to-Speech API for generating English speech from text using Rime Arcana TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:es
Text-to-Speech API for generating Spanish speech from text using Rime Arcana TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/rime/arcana:fr
Text-to-Speech API for generating French speech from text using Rime Arcana TTS model. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/deepgram/aura:2
Text-to-Speech API for generating speech from text using SLNG deepgram/aura. Real-time conversational TTS designed for voice agents with ultra-low latency. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/deepgram/aura:2-en
Text-to-Speech API for generating speech from text using SLNG deepgram/aura. Real-time conversational TTS designed for voice agents with ultra-low latency. English voices only. Establishes a WebSocket connection for real-time text-to-speech.
/v1/tts/slng/deepgram/aura:2-es
Text-to-Speech API for generating speech from text using SLNG deepgram/aura. Real-time conversational TTS designed for voice agents with ultra-low latency. Spanish voices only. Establishes a WebSocket connection for real-time text-to-speech.
Messages
SlngDeepgramAuraTtsWebsocketRequest
SLNG Deepgram Aura TTS WebSocket Request
WebSocket request for SLNG-hosted Deepgram Aura TTS (encoding restricted to linear16/mulaw/alaw)
SlngRimeArcana2TtsWebsocketRequestFr
Rime Arcana French TTS WebSocket Request
SlngRimeArcana2TtsWebsocketRequestEs
Rime Arcana Spanish TTS WebSocket Request
SlngRimeArcana2TtsWebsocketRequestEn
Rime Arcana English TTS WebSocket Request
SlngRimeArcana2TtsWebsocketRequestDe
Rime Arcana German TTS WebSocket Request
SlngRimeArcana2TtsWebsocketRequestAr
Rime Arcana Arabic TTS WebSocket Request
SlngRimeArcana3TtsWebsocketRequest
Rime Arcana v3 TTS WebSocket Request
TtsWebsocketResponse
TTS WebSocket Response
TtsWebsocketRequest
TTS WebSocket Request
SttWebsocketResponse
STT WebSocket Response
SttWebsocketRequest
STT WebSocket Request
Servers
wss
production
Production
wss
staging
Staging