README: Whisper is a general-purpose speech recognition model. It is trained on a large dataset of diverse audio and is also a multitasking model that can perform multilingual speech reco…
README: A Transformer sequence-to-sequence model is trained on various speech processing tasks, including multilingual speech recognition, speech translation, spoken language identificati…
GitHub 项目简介: Robust Speech Recognition via Large-Scale Weak Supervision
README: pip install -U openai-whisper
README: There are six model sizes, four with English-only versions, offering speed and accuracy tradeoffs.