随言

关于

用声音输入,按你自己的方式。

随言是 macOS 上的开源语音输入工具。它希望安静、私密,并且坦白说明自己能做什么、不能做什么。

为什么叫“随言”?

随口说,随处写。

“随言”对应产品的一句话:想到什么说什么,在哪里都能写下来,不被打断。

英文名 Cadenza 是音乐里的“华彩乐段”,独奏者自由发挥的那一段。对电脑说话也该是这种感觉:你按自己的方式说,应用跟着你。

打字才是慢的那一步

你说话,文字出现在光标处。所有工作都在本地完成,凡是要离开本机的东西,都需要你明确同意。

聊天、写笔记、发邮件、搜索、写代码注释:一天里有很多这样的小时刻,打字会拖慢你。

你说话时发生了什么

四步,都在本地完成。云端是你可以选择的选项,不是必须。

  1. 按住快捷键默认左 Option。
  2. 采集音频只在内存里,不保存。
  3. 识别本地模型,或你选的服务商。
  4. 写入写到光标处,或保留下来供你复制。

三条原则

  1. 本地优先,云端需同意除非你打开,否则任何内容都不会离开本机。云端服务只有在你对该服务商同意后才会收到音频,隐私文字也会说明取消能撤回什么、不能撤回什么。
  2. 坦白说明局限我们区分哪些是在真实 Mac 上测过的,哪些只用假的环境测过,并公开准确度的测量方法。不声称兼容每一个应用。
  3. 一起来做MIT 许可证,有贡献指南、行为准则和私下报告安全问题的渠道。每个改动都有人评审,并遵守隐私约定。

平台

随言建立在只有 macOS 才有的接口上,其他系统需要另起项目。

macOS早期预览  macOS 14 及以上,Apple 芯片与 Intel
Windows暂无计划  欢迎另起项目移植
Linux暂无计划  欢迎另起项目移植

为什么只做 macOS,以及移植可以复用什么

许可与致谢

随言免费,基于 MIT 许可证开源。 在 GitHub 查看源码

站在别人的工作之上

sherpa-onnx在本地运行语音模型。
SenseVoice、FireRedASR2、Parakeet TDT你可以下载的语音模型。
Apple SpeechMac 自带的语音识别。

第三方声明与许可证