Porównaj transkrypcje
Jedno nagranie. Różne transkrypcje.
Demo · Wyniki dostawców na żywo nie są jeszcze podłączone.
Transkrypcja referencyjna
0:08
Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?
Ha, taklifnomani yangilasangiz bo‘ladi.
Lokalne
Globalne
Benchmark poglądowy
Zmierzono 1 z 8 modeli · 5 próbek · 0:33 audio
Niższa wartość jest lepsza. WER i CER normalizują wielkość liter, interpunkcję i apostrofy. E2E obejmuje jedno pełne żądanie; RTF to E2E podzielone przez długość audio. Audio syntetyczne, zbiór stt-demo-v1.
dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
| Miejsce | Dostawca i model | WER ↓ | CER ↓ | Pokrycie |
|---|---|---|---|---|
| — | 24.6% | 17.6% | 5/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 |
Transkrypcja
VoiceLab · Model nieujawniony
Public preview API · 2026-09-02WER
0.0%
CER
0.0%
E2E
4.09s
RTF
0.54×
mode=batchlang=uztrials=1region=—
Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.
Transkrypcja referencyjna → Transkrypcja
edits=0Wyniki według scenariusza
| Scenariusz testowy | WER | CER |
|---|---|---|
| Wyraźna mowa | 0.0% | 0.0% |
| Rozmowa | 0.0% | 0.0% |
| Nazwy i miejsca · Liczby i daty | 33.3% | 22.7% |
| Mieszane języki | 10.0% | 2.9% |
| Zamówienie w obsłudze | 80.0% | 70.5% |