Comparez les transcriptions

Un enregistrement. Plusieurs transcriptions.

Démo · Les résultats en direct des fournisseurs ne sont pas encore connectés.

Transcription de référence

0:08

Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?

Ha, taklifnomani yangilasangiz bo‘ladi.

Local
International

Benchmark indicatif

1 modèles mesurés sur 8 · 5 extraits · 0:33 d’audio

Plus bas est meilleur. WER et CER normalisent la casse, la ponctuation et les apostrophes. E2E couvre une requête complète ; RTF correspond à E2E divisé par la durée audio. Audio synthétique, jeu stt-demo-v1.

dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
RangFournisseur et modèleWER ↓CER ↓Couverture
24.6%17.6%5/5
0/5
0/5
0/5
0/5
0/5
0/5
0/5

Transcription

VoiceLab · Modèle non publié

Public preview API · 2026-09-02

WER

0.0%

CER

0.0%

E2E

4.09s

RTF

0.54×

mode=batchlang=uztrials=1region=

Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.

Transcription de référenceTranscription

edits=0

Résultats par scénario

Scénario de testWERCER
Parole claire0.0%0.0%
Conversation0.0%0.0%
Noms et lieux · Nombres et dates33.3%22.7%
Mélange de langues10.0%2.9%
Commande et assistance80.0%70.5%