Transkriptionen direkt vergleichen

Eine Aufnahme. Verschiedene Transkriptionen.

Demo · Live-Ergebnisse der Anbieter sind noch nicht verbunden.

Referenztranskription

0:08

Здравствуйте, вам будет удобно перенести сегодняшнюю встречу на три часа?

Да, пожалуйста, обновите приглашение.

Lokal
Global

Beispiel-Benchmark

0 von 8 Modellen gemessen · 5 Clips · 0:29 Audio

Niedriger ist besser. WER und CER normalisieren Großschreibung, Satzzeichen und Apostrophe. E2E umfasst eine vollständige Anfrage; RTF ist E2E geteilt durch die Audiodauer. Synthetisches Audio, Datensatz stt-demo-v1.

dataset=stt-demo-v1audio=synthetic_voice · PCM 24kHz · 16bit · mononormalizer=basic-text-v1reference=written_formtiming=client_e2e_single_request · mean_single_run

Nicht gemessen

RangAnbieter und ModellWER ↓CER ↓Abdeckung
0/5
0/5
0/5
0/5
0/5
0/5
0/5
0/5

Transkription

Wählen Sie einen Anbieter aus, um dessen Demo-Ergebnis zu sehen.