Scribe v1
Deprecated on the models page ('First generation speech recognition (outclassed by v2)'). Use scribe_v2. Current price not listed separately.
- Input
- audio, video
- Output
- text
- License
- proprietary
- Verified
- 2026-09-29
How to call it
| Provider | Model id | Endpoint / URL | Docs |
|---|---|---|---|
| ElevenLabs API | scribe_v1 | https://api.elevenlabs.io/v1/speech-to-text | docs |
Notable capabilities (1)
- ElevenLabs' first speech-to-text model: 99 languages, word timestamps, diarization and audio-event tagging; claimed highest benchmark accuracy vs Gemini 2.0 and Whisper v3 at launch ($0.40/hour). source
Other ElevenLabs models
Eleven v4 / Eleven v4 Turbo · Eleven Music v2.5 · Eleven v3 Conversational · Scribe v2 / Scribe v2 Medical · Scribe v2 Realtime · Eleven Sound Effects v2 · Eleven v3 · Eleven Flash v2.5 / Flash v2 · Eleven Multilingual v2 · Eleven Multilingual STS v2 (Voice Changer) · Eleven Voice Design v3 (Text to Voice) · Eleven Dubbing v2 · Eleven Turbo v2.5 / Turbo v2