请教下现在 app 端语音转文字 sdk 哪个好用些

查看 190|回复 20
maotong   
https://github.com/k2-fsa/sherpa-onnx
肯定是这个了。 里面有些训练好的模型可以直接用。全平台支持。
nocmt   
可以看看我的软件,https://subflowai.nocmt.com/
目前是支持端侧模型,跑 STT 和 LLM 翻译的
taken   
流式的话,国内大厂:
首推腾讯,服务好响应快
其次就都差不多了
讯飞>字节>阿里
dingwen07   
系统内置的
feifei1210250   
常规中文的话用 Fun-ASR-Nano-2512 ,识别效果和速度都比 whisper 要强很多,
但带背景音乐的中文影视作品用前者会有幻觉,经常会会有“哈哈哈”之类的完全无关的识别结果,仍是 whisper large-v3-turbo 比较合适
Nasdaq   
Fun-ASR
junyiwork   
中文的话,火山引擎或者阿里云的 ASR 都还不错。
declandragon   
是实时语音转文字还是音频提取字幕?音频提取字幕用了阿里的
DICK23   
我用的腾讯的 asr
KisekiRemi   
推荐腾讯或者讯飞的
您需要登录后才可以回帖 登录 | 立即注册

返回顶部