PC 端哪个 speech-to-text 模型比较好

2025 年 12 月 8 日
 supermama

各位佬,最近想内部开发个小工具,在 Windows 或者 Mac 上实现 语音转文本,目前有哪个模型可以比较好支持中、英文识别,模型要开源的,识别率尽量高,而且对于资源的占用不是很高。是否有哪位佬整个,推荐一个比较合适的模型。先谢过各位大佬了!

1606 次点击
所在节点    问与答
3 条回复
565656
2025 年 12 月 8 日
apple windows 都自带把
xtreme1
2025 年 12 月 8 日
我在 pc + nvidia 上用这个看视频生成字幕, 中英文都没啥问题, 你可以不同规模都试试
https://huggingface.co/ggerganov/whisper.cpp/tree/main
Meteora626
2025 年 12 月 8 日
开源绕不开阿里,funasr 找个最新的模型就行了

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1177488

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX