Transkriptionen direkt vergleichen
Eine Aufnahme. Verschiedene Transkriptionen.
Demo · Live-Ergebnisse der Anbieter sind noch nicht verbunden.
Referenztranskription
Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?
Ha, taklifnomani yangilasangiz bo‘ladi.
Beispiel-Benchmark
1 von 8 Modellen gemessen · 5 Clips · 0:33 Audio
Niedriger ist besser. WER und CER normalisieren Großschreibung, Satzzeichen und Apostrophe. E2E umfasst eine vollständige Anfrage; RTF ist E2E geteilt durch die Audiodauer. Synthetisches Audio, Datensatz stt-demo-v1.
| Rang | Anbieter und Modell | WER ↓ | CER ↓ | Abdeckung |
|---|---|---|---|---|
| — | 24.6% | 17.6% | 5/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 |
Transkription
VoiceLab · Modell nicht veröffentlicht
Public preview API · 2026-09-02WER
0.0%
CER
0.0%
E2E
4.09s
RTF
0.54×
Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.
Referenztranskription → Transkription
edits=0Ergebnisse nach Szenario
| Testszenario | WER | CER |
|---|---|---|
| Klare Sprache | 0.0% | 0.0% |
| Gespräch | 0.0% | 0.0% |
| Namen und Orte · Zahlen und Daten | 33.3% | 22.7% |
| Sprachmix | 10.0% | 2.9% |
| Support-Anfrage | 80.0% | 70.5% |