
Buzz 离线语音转文字本地跑 Whisper 的完整上手指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz凌晨一点桌上躺着一段 40 分钟的采访录音文字稿明天就要交。上传给在线服务心里不踏实一个字一个字敲又敲不下去——这时候你需要的是一个能把录音直接喂进去、在本地离线跑Whisper的桌面应用Buzz。Buzz 是什么Buzz是一个免费开源的离线语音转文字桌面应用引擎是 OpenAI 的Whisper支持百种以上语言。安装好之后全程可以断网用音频文件从头到尾不离开你的电脑。三步跑通第一次转录安装。macOS / Windows 直接去官网下载页拿安装包Linux 用商店渠道flatpak install flathub io.github.chidiwilliams.Buzz打开 Buzz导入音频或视频文件MP3、WAV、MP4 都收也可以直接粘贴在线链接。点行里的齿轮展开选项语言选中文zh模型保持Base不动——第一次跑用默认值就够。点运行等进度条走完双击结果列打开转录查看器。主界面就是任务表每个文件一行状态、模型、结果都摊在面前支持多个任务排队并发喂进去三种输入方式本地音视频文件。MP3、WAV、FLAC 音频MP4、MKV、MOV 视频都认。手头的录音、下载的网课直接拖进来。在线链接。Buzz 支持导入 URL不用自己先下载再导入拿到链接就能转。实时麦克风录音。点录制按钮边说边出字幕结果存成一条任务。开会、录课、听讲座时开着它散会稿子就有了这就是实时录音转文字的用法。跑起来模型、提示词、GPU模型选大小。tiny / base / small / medium / large 五档越大越准也越慢。偏好设置里可以直接指定默认模型。初始提示Initial prompt。转录前塞一段话进去告诉模型这里面会出现哪些词。医学讲座塞专业术语、播客塞嘉宾名字专有名词的错字会明显减少。GPU 加速。有 N 卡的话打开 GPU 加速速度能翻 3 倍左右Mac 走 Apple Silicon普通集显则交给 whisper.cpp 的 Vulkan 后端不用折腾。拿结果编辑、导出、字幕切分转录查看器。时间轴 音频播放器 文本三合一点开任务就能听能改。逐句修时间轴和文字。哪句识别错了就改哪句起止时间可以拖适合交稿前的最后校对。导出 TXT / SRT / VTT三种格式。给剪辑软件就选 SRT 或 VTT纯文字整理选 TXT。字幕切分Resize。自动把超长字幕按字数上限拆开、把间隔过短的字幕段合并。做视频字幕时转写完点一下就能拿到能直接上片的文件。模型别一上来就选 Large几个最常用的调优判断记住这几条就够模型日常口播Base足够听不清再往Small / Medium升Large 留给必须一字不差的材料。语言能指定就别用自动检测中英混说选占比高的那个。硬件N 卡开 GPU 加速速度翻几倍Mac 用 Apple Silicon集显用 whisper.cpp Vulkan。文件嘈杂环境先开语音分离提取人声再转比换大模型有效。最常见的三个坑现象根因一句话解法说中文却转出英文没指定语言自动检测判错语言框里手动填 zh中英混说中文段被翻成英文自动检测漂移指定主语言长录音转得极慢模型选大了 / 没开加速换 Base 打开 GPU 加速另外文件多到不想一个个点运行时可以走命令行批量提交详细参数见仓库内的 docs/docs/cli.mdbuzz add --task transcribe --language zh --model-size small meeting.mp3挑段 5 分钟的录音试一次装好之后别拿两个小时的会议文件开刀挑段 5 分钟录音选Base模型跑一遍导出 SRT 丢进剪辑软件看一眼时间轴对不齐对不齐顺手在查看器里修两句。半小时下来这个工具你就算真正上手了。更多用法细节可以看仓库里的 docs/。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考