
Tyvox 是一款本地优先的语音输入法,按住一个热键就能在任何应用的光标位置说出文字,识别结果实时落到当前输入框。它常被当作 Typeless 的开源平替,适合不想依赖云端、又希望打字这件事更快的人。
语音识别默认在本地完成,引擎基于 whisper 或 sensevoice,声音不必离开设备;在此之上可以叠加一层可选的 LLM 润色,把口语化的碎句整理成通顺段落,或顺手翻译成另一种语言。整个程序是一个桌面软件,用 Electron 承载界面、Hono 跑后端,安装后随系统托盘常驻,不需要自己部署任何服务。项目以 MIT 协议开源,代码托管在 GitHub。
场景痛点
写长文、回消息、填表单时,手敲是最慢的一步。思路已经到了嘴边,手指还在追赶,尤其是中文输入里反复选词、改错别字的环节,很容易打断表达。
另一类是跨应用场景:在浏览器、编辑器、聊天窗口之间来回切换,每次都要重新把注意力切回键盘。也有人试过云端语音输入,但担心录音和文稿被上传;而 Typeless 这类闭源方案又附带订阅成本。用户需要的其实是一个本地运行、随按随说、又不把声音传出去的效率工具。

核心功能
一个热键,光标原位出文字
Tyvox提供按住说话(push-to-talk)和开关切换两种触发方式。录音悬浮窗独立存在,不会抢走当前输入框的焦点,用户说完松开,整理后的文本就落在原本要打字的位置。全局热键在任何应用里都能唤起,不需要先切到某个窗口。
本地语音识别
识别引擎 whisper / sensevoice 默认在用户机器上运行,音频和转写文本不会外发,除非主动开启云端服务。对隐私敏感的用户,这意味着口述内容始终留在本地。需要更高识别率或离线环境时,本地模型是不依赖网络的底线保障。这也是它被归类为 AI工具 的核心原因——智能推理发生在设备内。
LLM 润色与翻译
开启 LLM 润色后,原始口述会被整理成更干净的句子,并随着识别进度流式回显;同一层能力也能做语言转换,把中文口播直接转成英文文稿。云端 ASR 和 LLM 都是可选模块,在设置里手动启用,启用后只把必要数据发给所配置的供应商。
个人词库
Tyvox会学习人名、专业术语和用户自己的写作习惯,后续的语音输入 会更贴合个人语料。对经常口播固定名词、行业黑话的人,这一项能明显减少二次修改。
原生体验
程序提供全局热键、安静的托盘图标、自动更新,以及一个随应用启停的内嵌后端,没有需要长期照看的服务进程。首次启动会引导用户授予两项权限:麦克风(用于收音)和辅助功能(用于全局热键与模拟粘贴)。安装包使用稳定的自签名身份,因此两项授权在更新后依然有效。
安装与使用
前置条件
- 系统需要 macOS、Windows 或 Linux(截至 README 说明,仅 macOS 版本在真机验证过,Windows 与 Linux 部分功能可能不稳定)
- 首次运行需授予麦克风与辅助功能权限
- macOS 用户注意:安装包使用自签名证书(非 Apple 公证),首次启动可能被拦截
安装
一行命令即可安装。macOS 与 Linux 使用:
Windows 在 PowerShell 中运行:
也可以从 GitHub 下载对应安装包手动安装:macOS 为 Tyvox-*.dmg,Windows 为 Tyvox Setup *.exe,Linux 提供 Tyvox-*.AppImage 与 tyvox-desktop_*.deb。macOS 若被拦,右键应用选择「打开」,或执行 xattr -rd com.apple.quarantine /Applications/Tyvox.app;不要自行重签,否则会破坏跨更新保留的权限。
日常使用
按住热键开始说话,松开后文字落到光标处;想更顺滑可开启 LLM 润色,或在设置里接入云端 ASR / 翻译。下面按场景给参数建议:
| 场景 | 推荐配置 | 说明 |
| 纯本地口播 | 默认本地 whisper | 数据不出设备,适合敏感内容 |
| 长文整理 | 本地识别 + LLM 润色 | 口语转通顺段落,减少二次编辑 |
| 跨语言输出 | 本地识别 + LLM 翻译 | 中文口播直接出英文稿 |
| 高频术语 | 开启个人词库 | 人名、行话识别更准 |
我的使用感受
把「打字」换成「说话」之后,最明显的收益是思路不再被手指拖慢。本地识别让口述内容留在设备里,对注重隐私的人是定心丸;LLM 润色把零散口语顺成段落,省下大量返工。唯一要留意的边界是平台成熟度——目前只有 macOS 在真机充分验证,Windows 与 Linux 用户可能遇到功能不完整的情况,适合愿意顺手反馈问题的早期使用者。
官方网站
https://github.com/luckrnx09/tyvox
下载地址
https://pan.quark.cn/s/267ae4161cef






