工作原理
OpenASR 在用户控制的硬件上处理语音。桌面应用、CLI 和本地 HTTP 服务器均使用签名验证目录中的 .oasr 模型包进行本地推理。
常规转写不会将音频发送到任何云服务。明确的联网功能包括:用户主动下载模型、桌面更新清单检查、可选的在线文字精修或翻译,以及可选的远程计算。在线文字处理只会把识别后的文本(不含音频)发送给用户选择的服务商;远程计算只会把音频发送到用户通过 TLS 和首次信任证书锁定明确配对的 OpenASR 服务器。
开源内核与桌面应用
开源内核——包括 Rust CLI、服务器和配套库——以 Apache-2.0 许可证发布,可在 macOS、Windows 和 Linux 上通过预编译发行版或源码编译运行。
macOS 和 Windows 桌面应用是基于开源内核构建的独立闭源产品。目前未发布原生 Linux 桌面应用。
模型目录
OpenASR 提供经过签名的模型目录,涵盖 Whisper、Qwen3-ASR、Parakeet-TDT、FireRed-AED、SenseVoice、Moonshine、Cohere Transcribe、X-ASR 和 Dolphin 等模型系列,以及说话人分离和中文标点等能力包。
常规转写不会静默下载缺失的模型,用户会看到提示并自行确认每次下载。CLI 的 --offline 选项禁止网络访问,若模型缺失则直接报错。