Zum Inhalt springen
Eigene Messung · Deutsches Audio · Stand 18.09.2026

Raven versteht Deutsch. Gemessen, nicht behauptet.

5,9%

Wortfehlerrate auf deutschem Audio

Raven transkribiert deutsche Sprache mit 5,9 % Wortfehlerrate, gemessen auf vier deutschen Vorlese-Datensätzen am 02.09.2026.

Die Spracherkennung läuft auf eigener Infrastruktur, ohne US-Dienste im Datenpfad. Gemessen wird mit einem offenen Werkzeug, jede Zahl lässt sich nachrechnen.

Die Wertungen

Zwei eigene Zahlen. Jede mit ihrer Rangliste.

51 Modelle, dasselbe Audio, dieselbe Metrik. Jeder Strich ist ein Modell. Zur Rangliste

23 Häuser, 51 Modelle, dasselbe Audio und dieselbe Metrik.

  • AssemblyAI
  • AWS
  • Microsoft Azure
  • Cohere
  • IBM
  • Microsoft
  • Moonshine
  • NVIDIA
  • OpenAI
  • OpenMOSS
  • primeline
  • Qwen
  • Mistral
  • DashScope
  • Deepgram
  • ElevenLabs
  • Google
  • Gladia
  • Groq
  • nyra health
  • Reson8
  • Speechmatics
  • xAI

Wo ein Kürzel statt eines Zeichens steht, gibt der Hersteller seine Marke für Vergleichsseiten nicht frei.

Warum wir selbst messen

Hersteller messen sich selbst. Wir messen nach.

Herstellerzahlen fallen erwartbar gut aus. Deshalb spielen wir jedem Modell dieselben deutschen Aufnahmen vor, rechnen mit demselben offenen Werkzeug und veröffentlichen jede Zahl pro Datensatz. So wissen wir, was in Raven läuft, und du kannst es nachprüfen.

Die Datensätze

Jede Zahl pro Datensatz.

Ein Durchschnitt über alles verwischt, wofür ein Modell taugt. Was in einem Korpus steckt, steht auf der Wertung, die darauf misst.

Wie wir messen

Vier Prinzipien. Alle nachprüfbar.

Jedes Modell hört dieselben Aufnahmen, das Ergebnis wird Wort für Wort mit der geprüften Verschriftung verglichen. Der Durchschnitt über einen Datensatz ist nach Länge gewichtet.

  1. 01

    Eigene Messungen

    Keine Herstellerzahlen. Jedes Modell selbst getestet, auf identischem Audio.

  2. 02

    Echtes deutsches Audio

    Parlamentsreden, Hörbücher, vorgelesene Sätze und echte Meetings.

  3. 03

    Ein Verfahren für alle

    Selbst betrieben und per Schnittstelle, gleiche Daten, gleiche Metrik. Leere Zellen bleiben leer.

  4. 04

    Offene Methodik

    Werkzeug, Datensätze und Scorer sind öffentlich. Jede Zahl führt auf ihren Lauf zurück.

WER
Anteil falsch verstandener, ausgelassener und erfundener Wörter. Niedriger ist besser.
DER
Anteil der Sprechzeit, die dem falschen Sprecher zugeordnet ist. Niedriger ist besser.
RTFx
Minuten Audio pro Minute Rechenzeit. Höher ist schneller.

Und jetzt dein Audio

Hör selbst, wie Raven deine Meetings versteht.

Raven nimmt jeden Sprecher auf einer eigenen Spur auf, die Hauptverarbeitung läuft in Deutschland. Dieselbe Messdisziplin, angewendet auf dein Audio.

Raven kostenlos testen

Jede Zahl auf diesen Seiten stammt aus einem eigenen Lauf. Das Werkzeug dafür ist öffentlich: Wer eine Zahl anzweifelt, kann sie selbst nachmessen.

Einordnung und Nachrechnenraven.eval · Messwerkzeug

STT-Benchmark · 18.09.2026 · jede Zahl unabhängig nachprüfbar