基于 openai-whipser 开源模型和 flask ,搭建的本地离线运行的语音识别服务,主要自用用于取代百度语音识别的。 GitHub: https://github.com/jianchang512/stt 这是一个离线运行的本地语音识别转文字工具,基于 openai-whipser 开源模型,可将视频/音频中的人类声音识别并转为文字,可输出 json 格式、srt 字幕带时间戳格式、纯文字格式。可用于自行部署后替代 openai 的语音识别接口或百度语音识别等,准确率基本等同 openai 官方 api 接口。