
Buzz 离线转录指南音频变文字和 SRT 字幕全程本地免费【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款完全离线的音频转录工具基于 OpenAI Whisper 运行适合任何需要把会议录音、播客、课程视频变成文字和字幕的人。你的音频文件不会上传到任何服务器没有订阅费断网也能用数据全程留在自己的电脑里。它能帮你做的三件事文件转录与字幕导出拖入一个 mp3、mp4 或 YouTube 链接Buzz 会按时间戳逐段生成文字。在转录查看器里点导出菜单就能得到 TXT、SRT、VTT 三种文件SRT 字幕可直接拖进剪辑软件。实时录音转录选好麦克风后点录音按钮文字就在主界面实时出现还有一个全屏演示窗口适合把现场转录投到大屏上。翻译与说话人识别转录完成后可再翻译成目标语言开启说话人识别后每段话会标上 Speaker 1、Speaker 2不用你手动猜谁在说。维度支持情况导出格式TXT、SRT、VTT翻译结果同样可导出Whisper 后端whisper.cppVulkan 加速、faster-whisper、TransformersCUDA、Apple Silicon模型大小从 tiny 到 large还支持 Hugging Face 上的社区模型安装 Buzz 并跑通第一次转录安装按系统四选一Windows从官方发布页下载安装程序软件未签名SmartScreen 会弹警告点更多信息 → 仍要运行即可。macOS下载 dmg 安装Intel 与 Apple Silicon 均支持。Linuxflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz。开发者Python 3.12 环境下pip install buzz-captions再运行python -m buzz记得先装好 ffmpeg。第一次转录的操作流程按 Ctrl/Cmd O 导入音频或视频文件选择任务类型转录或翻译、语言、模型大小——手动指定语言比自动检测更稳点 Run状态变为 Completed 后双击该行打开转录查看器在查看器里点击任意段落即可回听对应片段从导出菜单选择 SRT 输出字幕文件。具体选项差异可查 安装文档。三个值得上手的场景会议纪要导入会议录音勾选Extract speech降噪并开启说话人识别一份带发言人的纪要十分钟就能初稿。以前一小时的会议要人工整理两三个小时现在只剩校对时间。视频字幕给自制视频做 SRT 字幕Buzz 是最短路径——转录、导出、拖进剪辑软件对齐即可不用逐条手写时间轴。安静环境下准确率在 95% 以上人工校对工作量很小。外语学习转录外语播客配合翻译功能对照原文导出 TXT 后当精读材料用 medium 及以上模型识别效果更好。避坑清单慢、不准、选错模型怎么办转录慢换 tiny 或 base 小模型Nvidia 显卡选 CUDA 后端其他 GPU 或核显走 whisper.cpp Vulkan同时关掉占资源的程序。识别不准手动指定语言专业术语多的内容在Advanced...里把它们填进 Initial prompt能明显减少拼写错误嘈杂录音先开Extract speech提取人声。模型怎么选小模型速度快英语材料够用中文或小语种建议 medium 起步再按显存往上调。Snap 用户注意首次运行执行sudo snap connect buzz:password-manager-service否则无法保存 OpenAI API 密钥等凭据。长文件别开 Word-Level Timings它会按词拆字幕行除非你打算用段落调整工具再合并。开始使用已装好 Python 3.12 和 ffmpeg 的话一行pip install buzz-captions即可跑起来完整操作细节见 官方文档。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考