zhongruan 在 求语音转文本模型推荐 中发帖
最近迷上了openwebui的语音模式,文本转语音用的minimax的逆向,还不错,就是这个语音转文本用的硅基流动免费的FunAudioLLM/SenseVoiceSmall,但是遇到一些专业的词语就识别错误了,有没有什么好用的语音转文本模型推荐…本来想用豆包和阿里的,但是字节跳动和阿里云均要满18。。。然后OPENAI的那个,经常把中文识别成英文