功能
小巧、安静,只属于你。
语音输入
按住一个键说话,松开,文字写到光标处。自动去掉“呃、嗯”和重复的字,词库帮你纠正专有名词。
语音翻译新
按住另一个快捷键,直接输入译文。可以用你添加的任何 AI 服务,包括本机的 Ollama。
云端识别,可选新
用你自己的 OpenAI、Groq、Google、Azure、AssemblyAI、ElevenLabs 或国内服务账号。同意之后才会发送音频。
轻声识别新
环境有噪声时,本机模型会先降噪,小声说话也不会被当成静音丢掉。
截图与文字识别
截图、标注、贴在屏幕上,一键取出图里的文字和二维码。默认在本地识别。
接入开发者和 AI 硬件
可选的本地接口,把你的程序、挂件或眼镜里的声音变成文字。
隐私
本地优先,云端只在你要时才用。
本地
- SenseVoice
- FireRedASR2
- Parakeet
不上传任何内容。
你自己的云端账号
- OpenAI
- Groq
- Google Cloud
- Azure
- AssemblyAI
- ElevenLabs
- 讯飞
- 火山引擎
- 腾讯云
- 阿里云
- 百度
- Deepgram
只有你对该服务商同意之后,才会发送音频。
没有账号,没有统计,没有崩溃上报。“永不联网”开关会隐藏一切可能联网的选项。 阅读隐私承诺
开源
读代码,自己构建,一起改进。
随言基于 MIT 许可证,在公开中开发。什么会离开本机,代码里写得清清楚楚,谁都可以查。
从源码构建
$git clone https://github.com/DragonKingIO/Cadenza-voice.git$cd Cadenza-voice$./cadenza/tools/fetch-sherpa-onnx.sh$./cadenza/build.sh --stage-only