V2EX
本地多模型语音识别工具OpenASR发布
开发者近日开源了完全本地化的语音转文字工具 OpenASR。该项目旨在解决当前本地 ASR(语音识别)工具使用门槛高、生态割裂的问题。目前市面上虽有 Qwen3-ASR、SenseVoice、FireRed 等优秀的本地 ASR 模型,但它们的推理框架(如 ggml、ONNX、PyTorch)和接口各不相同,普通用户部署成本极高。OpenASR 不仅是一个 Whisper GUI,它通过统一的底层设计,实现了多模型的一键切换与本地断网运行。该工具支持音视频转文字、实时字幕、全局语音输入,并提供 CLI 和本地 API。这一项目极大降低了本地 ASR 技术的应用门槛,为需要高隐私、多场景(如方言、低配设备、实时流式)语音转文字的开发者与创业者提供了高效的本地化解决方案。
获取每日 AI 情报与羊毛福利
加入 Telegram 频道 @ainews_Go,第一时间接收精选资讯推送。