中文本地识别

中文(及多语)本地语音识别

OpenASR 是本地优先的语音转文字项目,适合希望在本机完成中文识别、又不想把录音送进中央云转写服务的用户。macOS 与 Windows 提供桌面应用;Apache-2.0 开源内核提供 Rust CLI 与本地 HTTP API。模型来自签名目录,可按中文、方言或多语言需求选择;无需账号,无遥测。

运行位置
默认本机
桌面平台
macOS 与 Windows
模型分发
签名目录
开源内核
Apache-2.0

中文场景怎么选模型

先确认主要语言:普通话、中英混合,还是需要更广的多语/方言覆盖。再看设备内存能承受的模型体积与量化。

签名目录中有面向中文或包含中文能力的多个系列,也有更偏多语的选择。没有放之四海皆准的“最佳模型”;以语言、硬件、功能与许可证共同决定。请到模型页查看当前可用列表,不要依赖过时截图或第三方转载。

桌面使用路径

安装 OpenASR Desktop 后,在模型页下载所需中文或双语包,即可进行文件转写、听写等。下载需你确认,不会在转写时静默塞包。

处理多人会议或访谈时,所有本地文件 ASR 模型都可启用声纹 ID;应用自动选择原生或外置说话人来源,并可把匹配到的人标成姓名。

  • 本机推理,默认音频不外传
  • 中文标点等能力以目录中的能力包/模型说明为准
  • 无原生 Linux 桌面,Linux 走 CLI/服务器

开发与自动化

需要批量转写中文录音、或把识别嵌进内部工具时,使用开源 CLI 与本地 HTTP API。

CLI 支持 --offline:无网且模型已就绪时可稳定跑完;模型缺失则失败,避免静默联网。匿名说话人分离使用 --diarize,身份管理使用服务端仅管理员 /v1/voice-id/* API。

隐私与合规取向

中文会议、客服质检样本、采访录音等材料往往不宜默认上传。OpenASR 的设计是:转写在用户控制的硬件上完成,不运营中央云转写后端,不做遥测。

联网例外有限且应可预期:确认后的模型下载、桌面更新检查,以及默认关闭的可选远程计算(仅指向你自行配对的服务器)。

常见问题

OpenASR 能做中文本地识别吗?

能。转写在本机运行,模型从签名目录安装。具体中文与多语覆盖取决于你选择的模型,请以模型页实时目录为准。

只有中文,还是也支持其他语言?

目录同时包含中文导向与多语言模型。有的侧重中英或中文方言,有的覆盖更多语言。按任务选择,而不是假定单一模型通吃。

中文会议能区分说话人吗?

可以。桌面所有本地文件 ASR 模型都可区分说话人,并用声纹 ID 标姓名。CLI 提供匿名 --diarize,服务器提供仅管理员身份接口。声纹 ID 是标注功能,不是身份认证。

需要把音频传到境外或厂商云吗?

默认不需要。不存在 OpenASR 运营的中央云转写后端。只有你确认的下载,或你主动启用并配对的远程计算,才会产生相应网络行为。

Mac / Windows / Linux 怎么选?

桌面应用支持 macOS 与 Windows。Linux 没有原生桌面应用,可使用开源 CLI 与服务器。三者转写都走本地模型,不依赖账号体系。

如何避免运行时自动下载?

先在有网环境确认并装好模型。日常使用时,常规转写不会静默下载;CLI 加 --offline 可在缺模型时直接失败并停止。