Jämför transkriptioner

En inspelning. Olika transkriptioner.

Demo · Leverantörernas liveresultat är inte anslutna ännu.

Referenstranskription

0:08

Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?

Ha, taklifnomani yangilasangiz bo‘ladi.

Lokala
Globala

Illustrativ benchmark

1 av 8 modeller uppmätta · 5 klipp · 0:33 ljud

Lägre är bättre. WER och CER normaliserar skiftläge, skiljetecken och apostrofer. E2E omfattar en hel begäran; RTF är E2E delat med ljudets längd. Syntetiskt ljud, dataset stt-demo-v1.

dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
PlaceringFöretag och modellWER ↓CER ↓Täckning
24.6%17.6%5/5
0/5
0/5
0/5
0/5
0/5
0/5
0/5

Transkription

VoiceLab · Modell ej publicerad

Public preview API · 2026-09-02

WER

0.0%

CER

0.0%

E2E

4.09s

RTF

0.54×

mode=batchlang=uztrials=1region=

Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.

ReferenstranskriptionTranskription

edits=0

Resultat per scenario

TestscenarioWERCER
Tydligt tal0.0%0.0%
Samtal0.0%0.0%
Namn och platser · Siffror och datum33.3%22.7%
Blandade språk10.0%2.9%
Supportärende80.0%70.5%