ट्रांसक्रिप्शन की साथ-साथ तुलना करें
एक रिकॉर्डिंग। अलग-अलग ट्रांसक्रिप्शन।
डेमो · प्रदाताओं के लाइव नतीजे अभी जुड़े नहीं हैं।
संदर्भ ट्रांसक्रिप्शन
0:08
Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?
Ha, taklifnomani yangilasangiz bo‘ladi.
स्थानीय
वैश्विक
उदाहरण बेंचमार्क
8 में से 1 मॉडल मापे गए · 5 क्लिप · 0:33 ऑडियो
कम मान बेहतर है। WER और CER में केस, विराम चिह्न और अपॉस्ट्रॉफी सामान्य किए जाते हैं। E2E एक पूरी रिक्वेस्ट है; RTF, E2E को ऑडियो अवधि से भाग देने पर मिलता है। सिंथेटिक ऑडियो, डेटासेट stt-demo-v1।
dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
| रैंक | प्रदाता और मॉडल | WER ↓ | CER ↓ | कवरेज |
|---|---|---|---|---|
| — | 24.6% | 17.6% | 5/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 | |
| — | — | — | 0/5 |
ट्रांसक्रिप्शन
VoiceLab · मॉडल प्रकाशित नहीं है
Public preview API · 2026-09-02WER
0.0%
CER
0.0%
E2E
4.09s
RTF
0.54×
mode=batchlang=uztrials=1region=—
Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.
संदर्भ ट्रांसक्रिप्शन → ट्रांसक्रिप्शन
edits=0परिदृश्य के अनुसार नतीजे
| परीक्षण परिदृश्य | WER | CER |
|---|---|---|
| स्पष्ट भाषण | 0.0% | 0.0% |
| बातचीत | 0.0% | 0.0% |
| नाम और स्थान · संख्याएँ और तारीखें | 33.3% | 22.7% |
| मिली-जुली भाषाएँ | 10.0% | 2.9% |
| सहायता ऑर्डर | 80.0% | 70.5% |