并排比较转写结果

同一段录音,不同的转写结果。

演示 · 尚未接入各服务商的实时结果。

参考转写

0:08

Salom, bugungi uchrashuvni soat uchga ko‘chirsak sizga qulay bo‘ladimi?

Ha, taklifnomani yangilasangiz bo‘ladi.

本地
全球

示例基准测试

已测量 1/8 个模型 · 5 个片段 · 0:33 音频

数值越低越好。WER/CER 会统一大小写、标点和撇号。E2E 为一次完整请求,RTF 为 E2E 除以音频时长。合成音频,数据集 stt-demo-v1。

dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run
排名公司与模型WER ↓CER ↓覆盖率
24.6%17.6%5/5
0/5
0/5
0/5
0/5
0/5
0/5
0/5

转写结果

VoiceLab · 模型未公开

Public preview API · 2026-09-02

WER

0.0%

CER

0.0%

E2E

4.09s

RTF

0.54×

mode=batchlang=uztrials=1region=

Salom bugungi uchrashuvni soat uchga ko'chirsak sizga qulay bo'ladimi Ha taklifnomani yangilasangiz bo'ladi.

参考转写转写结果

edits=0

分场景结果

测试场景WERCER
清晰语音0.0%0.0%
对话0.0%0.0%
人名和地名 · 数字和日期33.3%22.7%
多语言混合10.0%2.9%
客服订单80.0%70.5%