ट्रांसक्रिप्शन की साथ-साथ तुलना करें

एक रिकॉर्डिंग। अलग-अलग ट्रांसक्रिप्शन।

डेमो · प्रदाताओं के लाइव नतीजे अभी जुड़े नहीं हैं।

संदर्भ ट्रांसक्रिप्शन

0:08

Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?

Ha, taklifnomani yangilasangiz bo‘ladi.

स्थानीय
वैश्विक

उदाहरण बेंचमार्क

8 में से 1 मॉडल मापे गए · 5 क्लिप · 0:33 ऑडियो

कम मान बेहतर है। WER और CER में केस, विराम चिह्न और अपॉस्ट्रॉफी सामान्य किए जाते हैं। E2E एक पूरी रिक्वेस्ट है; RTF, E2E को ऑडियो अवधि से भाग देने पर मिलता है। सिंथेटिक ऑडियो, डेटासेट stt-demo-v1।

dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
रैंकप्रदाता और मॉडलWER ↓CER ↓कवरेज
24.6%17.6%5/5
0/5
0/5
0/5
0/5
0/5
0/5
0/5

ट्रांसक्रिप्शन

VoiceLab · मॉडल प्रकाशित नहीं है

Public preview API · 2026-09-02

WER

0.0%

CER

0.0%

E2E

4.09s

RTF

0.54×

mode=batchlang=uztrials=1region=

Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.

संदर्भ ट्रांसक्रिप्शनट्रांसक्रिप्शन

edits=0

परिदृश्य के अनुसार नतीजे

परीक्षण परिदृश्यWERCER
स्पष्ट भाषण0.0%0.0%
बातचीत0.0%0.0%
नाम और स्थान · संख्याएँ और तारीखें33.3%22.7%
मिली-जुली भाषाएँ10.0%2.9%
सहायता ऑर्डर80.0%70.5%