用 AI 搓了一个语音输入法 sayany,支持豆包在线/离线模型, Vibe Coding 效率翻倍

4 月 15 日
 cdredfox

最近在 Vibe Coding 的时候,发现一边写代码一边口述需求给 AI 效率非常高,但市面上的输入法要么隐私有顾虑,要么离线识别率感人。

索性自己动手搓了一个 sayany ,这段时间我自己一直在用,体验还不错,特地来 V2EX 和大家分享一下

🤔 为什么要造这个轮子?

主要是为了解决两个痛点:

🛠️ 核心特性

这个项目最大的特点就是灵活,兼顾了隐私和准确率: 双模型支持:

💡 使用建议

如果你是在公司内网或者对隐私极其敏感的场景(比如写核心代码、回消息),建议开启离线模式;

如果是日常聊天、写文档,强烈建议开启豆包在线模型,那个准确率和响应速度会让你打开新世界的大门。

在线体验/下载: https://sayany.miyun.tech

以上官网,应用都是通过 AI Vibe Coding 出来的。

1814 次点击
所在节点    分享创造
3 条回复
yukminnie
4 月 15 日
每天都有新的输入法、剪贴板和截图软件可以用(

反馈一下,软件体验下来很流畅,本地和在线都正常。但有两个问题。第一是使用的是 SenseVoice Small 的小模型,但是后台内存占用达到了 1G 多,不知道为什么。

第二个问题就是,点击这个快捷键以后,好像大概 1 秒,这个识别的弹窗才开始出现。但实际上已经及时识别,没有吞字,不知道是不是个例。
cdredfox
4 月 17 日
@yukminnie 谢谢反馈,目前本地模型用的是非量化模型,使用后会常驻内存,所以内存占用会略高,但量识别率会精确一些,量化模型虽然内存低,但是识别率会有下降,这块我研究一下,看有没有办法保证准确率的情况下,降低占用。

快捷键这个问题我来优化一下。
yukminnie
4 月 17 日
@cdredfox 感觉 230 兆那个小模型日常体验已经足够。如果配合这个在线大模型修正的话,整体很平衡,可以两个模型都下载,然后自行切换。♥️

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1206174

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX