Welches Modell versteht Deutsch am genauesten?
Wir spielen jedem Modell dieselben deutschen Aufnahmen vor und vergleichen das Ergebnis Wort für Wort mit der geprüften Verschriftung. Ein gemeinsamer Durchschnitt verfälscht dabei, also steht die Wortfehlerrate pro Datensatz, mit Kosten und Tempo daneben.
Genauigkeit kostet. Finde deinen Punkt.
Eine Tabelle zeigt Rangplätze. Diese Karte zeigt, was sie dich kostet. Wähle die Achse, die für dich zählt.
★ GPT-Audio ausgelassen (Ausreißer)
Die Messkonsole.
Ein gemeinsamer WER verfälscht. Wähl Audiotyp und Hosting, die Rangfolge richtet sich danach.
| Modell▲ | Gesamt | Kosten▲ | Tempo▲ | Sprachen▲ | Hosting▲ | |
|---|---|---|---|---|---|---|
| WER▲ | CER▲ | |||||
Qwen3-ASR-Flash · Sync DashScope | 3,7 %★ | 1,8 % | 1,93 € | 5,4× | MULTI | API |
Qwen3-ASR-Flash · Datei DashScope | 3,8 % | 1,8 % | 1,77 € | 1,5× | MULTI | API |
| 4,2 % | 1,7 % | eigene GPU | 50× | MULTI | SELF | |
Scribe v2 ElevenLabs | 4,6 % | 2,0 % | 3,37 € | 8,8× | MULTI | API |
| 4,6 % | 2,0 % | eigene GPU | 9,6× | DE | SELF | |
| 4,8 % | 2,3 % | eigene GPU | 3,3× | MULTI | SELF | |
Universal-3.5 Pro AssemblyAI | 4,9 % | 2,3 % | 3,22 € | 2× | MULTI | API |
Qwen3-Omni-Flash DashScope | 4,9 % | 2,5 % | 4,69 € | 4,5× | MULTI | API |
| 4,9 % | 2,4 % | eigene GPU | 16,1× | DE | SELF | |
Prerecorded Reson8 | 5,0 % | 2,4 % | 3,33 € | 24,9× | MULTI | API |
| 5,1 % | 2,6 % | 2,76 € | 12,2× | MULTI | EU | |
MAI-Transcribe 1.5 Azure | 5,1 % | 2,5 % | 5,52 € | 9,2× | MULTI | API |
| 5,1 % | 1,9 % | eigene GPU | 33,9× | DE | SELF | |
| 5,2 % | 2,6 % | 1,84 € | 8,3× | MULTI | EU | |
Universal-2 AssemblyAI | 5,2 % | 2,7 % | 4,14 € | 2,2× | MULTI | API |
Solaria-1 Gladia · EU | 5,3 % | 2,8 % | 9,35 € | 2,7× | MULTI | EU |
| 5,4 % | 2,3 % | eigene GPU | 35,9× | DE | SELF | |
Chirp 3 Google · OpenRouter | 5,5 % | 2,9 % | 14,72 € | 5,5× | MULTI | API |
Amazon Transcribe AWS | 5,6 % | 2,7 % | 22,08 € | 1× | MULTI | API |
Whisper-1 OpenAI | 5,6 % | 2,6 % | 5,52 € | 10,1× | MULTI | API |
Gemini 3.5 Transcribe Google | 5,6 % | 2,7 % | 4,60 € | 3,7× | MULTI | API |
GPT-4o-mini-transcribe OpenAI | 5,6 % | 2,9 % | 1,60 € | 11,7× | MULTI | API |
| 5,7 % | 2,5 % | eigene GPU | 46,1× | DE | SELF | |
Melia 1 Speechmatics | 5,8 % | 2,9 % | 15,95 € | 7,5× | MULTI | API |
| 5,9 % | 2,2 % | eigene GPU | 65,8× | DE | SELF | |
| 6,0 % | 2,1 % | eigene GPU | 23,9× | MULTI | SELF | |
| 6,0 % | 2,7 % | eigene GPU | 7,1× | MULTI | SELF | |
Gemini 2.5 Flash Google | 6,1 % | 2,9 % | 0,67 € | 7,2× | MULTI | API |
Enhanced Speechmatics | 6,1 % | 3,0 % | 15,95 € | 5,9× | MULTI | API |
Chirp 3 Google · EU | 6,1 % | 3,0 % | 14,72 € | 8,7× | MULTI | API |
| 6,2 % | 3,6 % | eigene GPU | 9,4× | MULTI | SELF | |
| 6,3 % | 2,9 % | eigene GPU | 8,2× | MULTI | SELF | |
| 6,6 % | 2,4 % | eigene GPU | 65,4× | MULTI | SELF | |
Whisper-LV3-Turbo Groq | 6,9 % | 4,0 % | 0,61 € | 29× | MULTI | API |
| 7,0 % | 3,2 % | eigene GPU | 29,9× | MULTI | SELF | |
| 7,0 % | 3,8 % | eigene GPU | 31,9× | MULTI | SELF | |
| 7,1 % | 3,2 % | eigene GPU | 28,5× | MULTI | SELF | |
| 7,4 % | 3,1 % | eigene GPU | 19× | MULTI | SELF | |
Qwen3-Omni-Turbo DashScope | 7,4 % | 3,5 % | 7,85 € | 4,4× | MULTI | API |
| 7,5 % | 2,9 % | eigene GPU | 26× | DE | SELF | |
Nova-3 (EU) Deepgram · EU | 8,0 % | 3,8 % | 3,96 € | 26,6× | MULTI | EU |
| 8,0 % | 3,9 % | eigene GPU | 13,3× | MULTI | SELF | |
Nova-3 (US) Deepgram | 8,0 % | 3,8 % | 3,96 € | 8,2× | MULTI | API |
GPT-4o-transcribe-diarize OpenAI | 8,4 % | 4,0 % | – | 2,4× | MULTI | API |
| 9,8 % | 3,8 % | eigene GPU | 29,4× | MULTI | SELF | |
| 15,1 % | 7,2 % | eigene GPU | 17,7× | MULTI | SELF | |
| 16,3 % | 11,1 % | 0,08 € | 16,8× | MULTI | EU | |
GPT-Audio OpenAI | 29,8 %* | 21,7 % | 49,09 € | 8,1× | MULTI | API |
48 Modelle sind in dieser Runde durchgelaufen, alle auf identischem Audio und mit identischer Metrik. Was in den Korpora steckt, auf denen hier gemessen wird, steht in der Korpus-Übersicht; wie gerechnet wird, in der Methodik. Die Mundart-Wertung und die Sprechertrennung stellen dieselben Modelle vor zwei andere Aufgaben.
STT-Benchmark · 08.06.2026 · jede Zahl unabhängig nachprüfbar












