| id | speech-to-text |
|---|---|
| title | Speech to Text |
Cube AI supports OpenAI-compatible speech-to-text transcription for audio inputs, depending on the enabled backend and available models.
⚠️ Not all Cube AI deployments enable speech-to-text by default.
POST /proxy/{domain_id}/v1/audio/transcriptionscurl -k https://localhost/proxy/<domain_id>/v1/audio/transcriptions \
-H "Authorization: Bearer <pat>" \
-H "Content-Type: multipart/form-data" \
-F "file=@audio.wav" \
-F "model=whisper"file— Audio file to transcribe (e.g. WAV, MP3)model— Speech-to-text model (for examplewhisper)
Returns a transcription result compatible with the OpenAI API format.
- Audio is processed inside a Trusted Execution Environment (TEE)
- Availability depends on backend configuration
- Large audio files may increase latency