Skip to main content
Customize transcription behavior with STTOptions.

STTOptions

Configuration Examples

Basic English Transcription

Multi-Language Detection

Transcription with Timestamps

Speaker Diarization

Custom Vocabulary

Improve recognition for domain-specific terms:

Supported Languages

Language support depends on the STT model. Whisper models support 99+ languages.

AudioFormat

TranscriptionMetadata

Access processing metrics:
A real-time factor < 1.0 means the transcription is faster than real-time. For example, 0.2x means 10 seconds of audio processed in 2 seconds.