开源语音识别工具 Whisper

开源语音识别工具 Whisper

💡 原文中文,约1900字,阅读约需5分钟。
📝

内容提要

Whisper是通用的语音识别模型,支持多语言语音识别、语音翻译和语言识别。安装Whisper需要满足Python和PyTorch的环境要求,同时需要安装FFmpeg和Git。安装过程中可能会遇到错误,需要重复执行命令直到安装完成。使用Whisper时,需要将音频传入主机并执行相应命令。模型下载较慢时可以搭建本地下载点。

🏷️

标签

➡️

继续阅读