ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

sherpa-onnx 离线语音识别完全指南:断网也能搭建本地 ASR

sherpa-onnx 离线语音识别完全指南:断网也能搭建本地 ASR sherpa-onnx 离线语音识别完全指南断网也能搭建本地 ASR【免费下载链接】sherpa-onnxSpeech-to-text, text-to-speech, speaker diarization, speech enhancement, source separation, and VAD using next-gen Kaldi with onnxruntime without Internet connection. Support embedded systems, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, x86_64 servers, websocket server/client, support 12 programming languages项目地址: https://gitcode.com/GitHub_Trending/sh/sherpa-onnx语音交互正在成为连接人与机器的第二块屏幕。可当你身处没有信号的电梯AI 还能听懂你说话吗sherpa-onnx 就是为这种时刻准备的离线语音宝藏它把语音识别ASR即自动语音识别和语音合成TTS即把文字变成人声整个搬进你的设备本地跑音频数据不出机器断网照常工作。一句话定位sherpa-onnx 是一套基于 ONNX Runtime一个轻量级神经网络推理引擎不依赖显卡和互联网的本地语音工具箱专门解决不想把声音传给云端的人的语音功能需求。sherpa-onnx 五大核心能力条条有真实效果流式语音识别说话的同时文字实时蹦出来说完即停没有转圈等待的进度条离线语音合成输入一句话设备用自然人声读给你听还能保存成音频文件语音端点检测VAD自动判断哪里在说话一段长录音自动切出所有说话片段说话人分离一段会议录音自动分辨出这是谁、那是谁语音增强与源分离去掉环境噪声、把歌声和伴奏拆开嘈杂车库里的录音也能变干净。无论是手机、树莓派这类嵌入式设备还是 x86_64 服务器和各类 NPU 硬件它都能跑起来且覆盖 12 种编程语言想翻现成代码仓库里的 python-api-examples/ 和 c-api-examples/ 都是可直接参考的样例。三步上手体验从克隆到开口git clone https://gitcode.com/GitHub_Trending/sh/sherpa-onnx pip install sherpa-onnx装好后随手跑一个示例脚本第一次就能听到自己的声音被自己的设备读出来全程不花一分流量。谁该闭眼入它三类典型场景App 开发者给应用加语音输入、实时字幕不用养服务器、不用付调用费嵌入式与边缘设备玩家模型在设备上本地运行响应快隐私数据不出门内容创作者会议、课程录音一键转成逐字稿字幕批量生成。这是一个值得反复把玩的良心之作——克隆下来用自己的声音试一把你会立刻明白离线和在线的区别有多大。【免费下载链接】sherpa-onnxSpeech-to-text, text-to-speech, speaker diarization, speech enhancement, source separation, and VAD using next-gen Kaldi with onnxruntime without Internet connection. Support embedded systems, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, x86_64 servers, websocket server/client, support 12 programming languages项目地址: https://gitcode.com/GitHub_Trending/sh/sherpa-onnx创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表