Porównaj transkrypcje

Jedno nagranie. Różne transkrypcje.

Demo · Wyniki dostawców na żywo nie są jeszcze podłączone.

Transkrypcja referencyjna

0:08

Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?

Ha, taklifnomani yangilasangiz bo‘ladi.

Lokalne
Globalne

Benchmark poglądowy

Zmierzono 1 z 8 modeli · 5 próbek · 0:33 audio

Niższa wartość jest lepsza. WER i CER normalizują wielkość liter, interpunkcję i apostrofy. E2E obejmuje jedno pełne żądanie; RTF to E2E podzielone przez długość audio. Audio syntetyczne, zbiór stt-demo-v1.

dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
MiejsceDostawca i modelWER ↓CER ↓Pokrycie
24.6%17.6%5/5
0/5
0/5
0/5
0/5
0/5
0/5
0/5

Transkrypcja

VoiceLab · Model nieujawniony

Public preview API · 2026-09-02

WER

0.0%

CER

0.0%

E2E

4.09s

RTF

0.54×

mode=batchlang=uztrials=1region=

Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.

Transkrypcja referencyjnaTranskrypcja

edits=0

Wyniki według scenariusza

Scenariusz testowyWERCER
Wyraźna mowa0.0%0.0%
Rozmowa0.0%0.0%
Nazwy i miejsca · Liczby i daty33.3%22.7%
Mieszane języki10.0%2.9%
Zamówienie w obsłudze80.0%70.5%