
Buzz 本地离线音频转录指南语音转文字从选型到调优【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的本地离线音频转录工具。音频、视频文件、麦克风实时录音、YouTube 链接都能在自家电脑上完成转录与翻译覆盖 99 种主流语言结果可导出为 TXT、SRT、VTT。适合做会议记录的人、做字幕的创作者以及需要批量把语音转文字的场景。选型先行选对模型再动手Buzz 内置多种 Whisper 后端标准 Whisper、Faster Whisper、C 实现的 Whisper.cpp、Hugging Face 模型以及 OpenAI API。选型的关键不是越大越好而是匹配你的硬件你的情况推荐模型与后端预期体验笔记本、无独显、追求速度Whisper.cpp BaseCPU 即可跑可支撑实时转录NVIDIA 独显6GB 以上显存Faster Whisper Medium比标准 Whisper 快一个量级占用内存更少Mac 用户Whisper.cpp Small/MediumMac 上的最佳选择Apple Silicon 自动加速精度优先采访、讲座、关键材料Whisper Large-V3准确率最高、速度最慢偶有幻听编词低延迟会议实时记录Whisper.cpp Tiny资源占用最低响应快两条经验一是尽量显式指定语言而不是自动检测官方文档也建议这么做稳定性更好二是不确定的话拿同一段音频跑两个不同档位的模型对比一下五分钟就能定下来。安装 Buzz 并产出第一份转录四种安装方式按你的平台任选其一Windows下载官方安装包。程序未做签名安装时出现警告点更多信息 → 仍要运行即可。macOS下载.dmg安装器。注意当前版本要求 Apple Silicon最后一个支持 Intel 芯片的版本是 1.4.5。Linux支持 Flatpak、Snap 和 AppImage。flatpak install flathub io.github.chidiwilliams.Buzz或走 Snap先装音频依赖sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzzPython跨平台先装好 ffmpeg并用 Python 3.12 环境pip install buzz-captions python -m buzz装完到拿到第一份结果三步导入文件按CtrlO或点左上角选择音频或视频文件把语言指定为文件实际使用的语言。执行转录模型选 Base拿不准就按上面表格来点 Run。任务在主界面列表里排队你可以继续做别的事。打开并导出状态变为 Completed 后双击该行打开转录查看器直接导出 TXT、SRT 或 VTT。各方式的更多细节见安装文档。三个真实场景的落地打法会议记录边开边记会后修正输入会上的麦克风不需要预先录文件。操作选好任务与语言后按CtrlR或点 Record 开始实时转录文字逐句出现在界面上要投屏给全场可打开演示窗口。会后在转录编辑器里把明显错词改掉。产出TXT 格式的会议纪要需要 Word 文档时用内置的 Export to DOCX 插件一步导出。视频字幕词级时间戳 字幕重排输入一个视频文件Buzz 直接对其音轨转录。操作导入时在选项里勾选 Word-Level Timings词级时间戳用 Medium 档模型转录完成后在编辑器点 Resize设定单条字幕最大长度、按标点断句。产出SRT 或 VTT 字幕文件可直接导入剪辑软件。批量处理文件夹自动进转录自动出输入一个装满音频的文件夹。操作在 Preferences 里开启 Folder Watch指定输入与输出目录新文件放进去即自动转录也可以一次性添加多个文件排队。重复导入同一批文件时开启 Skip Already Transcribed 插件已出结果的文件会被跳过。想写成脚本的话CLI 同样支持buzz add --txt recordings/*.mp3详见CLI 文档。产出每个文件对应一份转录统一落到你指定的输出目录。调优速度与准确率挑 4 个最实用的GPU 加速。NVIDIA 显卡收益最大Linux 上 NVIDIA 开箱即用有问题就装 CUDA 12、cuBLAS、cuDNNWindows 安装包已内置 GPU 支持PyPI 安装的版本需要自行安装 CUDA 版 torch。Mac 会自动走 Apple Silicon。Whisper.cpp 另支持 Vulkan集显也能加速。初始提示词。把容易听错的人名、术语填进 Initial Prompt导入表单的 Advanced... 里。模型会按提示纠正拼写专名错误明显减少。语音分离。勾选 Extract speech 后Buzz 会先把人声从音频中分离出来再转录对会议通话这类有背景噪音的录音效果突出。批处理线程数。用 Whisper.cpp 跑批量任务时可通过环境变量BUZZ_WHISPERCPP_N_THREADS调线程数官方在 16 线程笔记本上测得设为 8 时提速约 15%设得更大反而更慢。配合文件夹监控和跳过已转录可以挂一夜自动出结果。更多高级项如降低显存占用、自定义重排规则见Preferences 文档。常见问题问完全断网的电脑能不能用能。先在有网络的机器上把需要的模型下好再把模型目录复制到离线机器的相同位置Linux 是~/.cache/BuzzmacOS 是~/Library/Caches/BuzzWindows 是%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache。路径也可以在 Help → Preferences → Models 里点Show file location查看或用仓库自带的模型下载脚本预先备好。问实时录音卡顿、句子跟不上怎么办默认的 Whisper 后端比较吃资源。换成 Whisper.cpp、选 Tiny 或 Base 档并观察界面上的 Queue 数值持续增大就加大 Transcription step 或换更小的模型。问Buzz 更新后崩溃先查哪里多数情况是模型文件不完整或损坏到 Preferences 的 Models 页删掉对应模型重新下载即可。仍不行就从 Help → About Buzz → Show logs 查日志。另外 CPU 需要支持 AVX2过老的机器不受支持。问转录结果存哪文件名能自定义吗默认保存在源文件旁边。在 Preferences → Default export file name 可以设命名模板支持input_file_name、model_size、date_time等变量例如{{ input_file_name }} ({{ task }}d on {{ date_time }})方便按日期归档。Buzz 的价值一句话转录链路完全跑在你自己的机器上文件不出本机速度和准确率还能按硬件自由取舍。想继续深入读官方文档。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考