MDRSS · MARKDOWN SNAPSHOT
0.0/10

Whisper

It is trained on a large dataset of diverse audio and is also a multitasking model that can perform multilingual speech recognition, speech translation, and language identification. A Transformer sequence-to-sequence model is trained on various speech processing tasks, including multilingual speech recognition, speech translation, spoken language identification, and voice activity detection.

#multimodal / card #2474★ 0◌ 0snapshot 2026-08-04