
录音转文字不用上传服务器Buzz 离线语音转文字从上手到调优【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz硬盘角落躺着 20 条会议录音逐字稿还得靠人肉听写Buzz 基于 OpenAI Whisper 做 Buzz 离线语音转文字转录和翻译全程跑在你自己的电脑上音频一个字节都不出机器免费开源不用注册任何账号。Buzz 能帮你解决哪些活把散落的录音、视频批量变成可编辑的逐字稿——适合会议记录者、播客制作者。实时录音边说边出文字还能区分不同说话人——适合访谈、直播、课堂记录。给视频生成 SRT / VTT 字幕文件直接挂到播放器或剪辑软件——适合做内容的创作者。语音转文字不用联网断网环境照常工作隐私敏感的材料也敢随便转——适合合规要求高的团队。从导入音频到出字幕的完整流程结论装好环境后6 步出第一条结果。安装不挑系统Windows 下载官方安装包运行应用未签名弹窗点更多信息再点仍要运行macOS 把 .dmg 拖进应用程序Linux 用 Flatpak 或 Snap 任选其一Python 用户则先备好 ffmpeg音频解码工具再装依赖推荐 Python 3.12也可以直接克隆源码跑最新功能pip install buzz-captions python -m buzz git clone https://gitcode.com/GitHub_Trending/buz/buzz通过文件菜单或工具栏图标导入音频。任务选转录。手动指定语言比自动检测稳见后文。挑一个模型大小如 small。点运行等状态变为已完成。双击任务行打开查看器边播放边核对导出 TXT、SRT 或 VTT。把视频变成可挂载的字幕文件你要做的事让一段 MP4 的讲解视频直接配上时间轴准确的中文字幕。关键操作导入视频后 Buzz 会自动提取音轨不用你手动转码在高级设置里打开词级时间戳让每个词都带上独立时间标记转录完成后用调整大小功能按静音间隔和标点把词合并成符合字幕阅读习惯的长度。产出物一份 SRT 或 VTT 文件拖进播放器或剪辑软件即可挂载。直播中边说边出文字你要做的事直播、面试或访谈进行中声音实时变成文字供大屏展示或 OBS 直播软件读取。关键操作任务选录音并指定麦克风点击录音后录音与识别同步进行显示模式三选一追加并校正会持续修正上一句最接近人工记录的观感结果可实时写入 TXT 文件也可打开演示窗口直接投到大屏多人访谈时还能区分并标注不同说话人。产出物一份随说话持续更新的文字流可投屏也可喂给直播推流软件。丢进文件夹就自动归档你要做的事每天往固定目录丢一堆录音不想逐条点导入。关键操作在偏好设置里指定一个监视文件夹新音频放入即自动创建转录任务装个跳过已转录文件插件重复导入同一批文件时直接复用已有结果不再重跑模型想更省事一条命令也能批量跑完buzz add --task transcribe --model-type whispercpp \ --model-size small --srt --vtt /path/to/audio.mp3产出物自动排队执行完毕的转录任务输出文件按你勾选的格式落盘。 本地转录设置更快更准的几个关键项如果你的显卡是 NVIDIA就把模型后端切到 Whisper.cpp它会自动走 CUDAAMD、Intel 显卡则走 Vulkan跨平台的显卡计算接口。显存不够时选量化版模型——量化是把模型精度从 32 位压到 8 位省显存但对准确度影响不大——或直接开启降低 GPU 内存占用。自动检测老报错直接手动指定语言。自动检测只参考音频开头几秒已知语言却检测结果跑偏时手动指定能明显减少整段误识别。模型档位怎么挑base、small 出草稿、控耗时medium、large 保准确率实时录音建议用 small 这种小模型才跟得上语速。人名、产品名总被写错在高级设置的初始提示里填入这些词模型会优先按提示拼写专有名词错字会少很多。录音底噪大就先开启语音提取把人声从背景噪声里单独抠出来再转录嘈杂环境的效果会好一截。卡点排查转录慢换更小的模型或用环境变量BUZZ_WHISPERCPP_N_THREADS调整 Whisper.cpp 占用的 CPU 线程数模型下载慢设置HF_ENDPOINT指向 hf-mirror.com 镜像站旧显卡跑得慢或出错设置BUZZ_FORCE_CPUtrue强制走 CPU。谁适合用谁别硬上Buzz 把隐私和实时性两头都占住了音频全程本地处理录音识别也能同步出字。云端转录服务虽然省事但每段音频都得先上传服务器敏感内容过不了这道坎按量收费也意味着用得越多花得越多纯命令行工具虽然也本地免费却没有图形界面也不支持实时录音日常录入和边听边核对都费劲。✅ 适合音频敏感、不想上传又想要实时能力的个人和团队✅ 适合有批量录音归档需求、需要字幕产出的内容创作者❌ 不适合只想零成本零安装、偶尔转一两条更倾向网页端服务的人资源与源码Buzz 是免费开源的离线语音转文字工具源码结构清晰跟着文档就能定位到每个功能对应的实现。官方文档docs/docs转录核心模块buzz/transcriber/插件系统源码buzz/plugins/【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考