ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Buzz 语音转文字完整实战指南:从零安装到字幕导出

Buzz 语音转文字完整实战指南:从零安装到字幕导出 Buzz 语音转文字完整实战指南从零安装到字幕导出【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款免费的开源语音转文字工具能在你的电脑上离线完成音频转录与翻译核心由 OpenAI 的 Whisper 模型驱动支持导入音频文件、麦克风实时录音并导出 TXT、SRT、VTT 字幕全程不需要把文件传到云端。本文按装好 → 转出第一段文字 → 提速 → 导出 → 排错的顺序带你走完全流程。一、三种安装方式先让 Buzz 跑起来这一节解决怎么把它装到我电脑上的问题Windows、macOS、Linux 都能覆盖。Windows 和 macOS先去官方发布页下载对应系统的安装包macOS 是.dmgWindows 是安装程序。Windows 的应用没有做签名安装时会弹出警告点More info再选Run anyway即可。LinuxSnap 方式需要先补上音频依赖库再安装主程序并授权密码存储sudo apt-get install libportaudio2 libcanberra-gtk-module sudo snap install buzz sudo snap connect buzz:password-manager-service如果你用 Flatpak一条命令就够了flatpak install flathub io.github.chidiwilliams.Buzz通过 PyPI 安装已经有 Python 3.12 和 ffmpeg 的话可以直接从 PyPI 装装完用模块方式启动pip install buzz-captions python -m buzzLinux 上可能还要补装 libportaudio2 等系统库完整清单见 官方安装文档。二、第一次转录把音频变成文字四步之内你会看到自己的第一段转录结果。先点工具栏的 按钮快捷键CtrlO添加音频或视频文件也支持粘贴 YouTube 链接再在任务列表里选择任务类型——Transcribe是保留原文转文字Translate to English是翻译成英文建议手动指定语言而不是自动检测准确率更稳最后点Run状态变成 Completed 后双击这一行就打开结果。Whisper 模型是听过多少种声音的耳朵档位从 tiny 到 large越大越准也越慢第一次用 tiny 就够。转录完成后双击打开转录查看器可以边播音频边校对用CtrlF搜索文字逐行核对时间戳三、实时录音麦克风转实时文字会议和讲座不想等录音结束这一节让你边说边出文字 在实时录音面板先选任务、语言和麦克风再点Record文字会随说话逐句出现。文字有三种追加模式新句子加在下方、加在上方、或者追加并纠错会回头修正上一句的错误更吃算力在偏好设置里切换。两个注意点默认 Whisper 模型比较重实时场景建议换 Whisper.cpp 配小模型更跟得上录音进行中可以打开Presentation window把大字号字幕投到屏幕上适合现场活动。如果录音源是电脑本身播放的声音而不是麦克风需要先把它路由到虚拟音频设备BlackHole、VB CABLE 或 PulseAudio 虚拟声卡再在 Buzz 里选这个设备作为输入步骤见实时录音文档。四、选模型与 GPU 加速提速的关键转录太慢或太不准多半出在模型档位和硬件这两处 ⚙️按硬件挑模型档位老款笔记本tiny / base快精度一般日常使用small速度和质量的平衡点要更高准确率medium工作站级别large已下载的模型可以在偏好设置Ctrl,→ 模型设置里查看和删除打开 GPU 加速Buzz 支持多种后端Nvidia 显卡走 CUDAMac 的 Apple Silicon 有原生加速Whisper.cpp 则支持 Vulkan覆盖大部分独立显卡和核显。做实时转录时Whisper.cpp 加小模型通常是最快组合。用环境变量精调一些高级项要靠启动前设环境变量比如写一个 run_buzz.sh#!/bin/bash export BUZZ_MODEL_ROOT/data/models/buzz export BUZZ_WHISPERCPP_N_THREADS8 export BUZZ_FAVORITE_LANGUAGESzh,en buzz第一条改模型存放目录第二条限制 CPU 线程数官方文档的测试里设为核数一半反而更快第三条把常用语言顶到语言列表最前。完整变量说明在偏好设置文档。五、导出结果字幕和纯文本转录完只是走完一半这一节帮你把成果变成能用的格式。在转录查看器里点导出按钮可选TXT、SRT、VTT等格式。做字幕的话用Resize工具把逐词计时的行合并成完整字幕行可以设每行最大长度、是否按标点断句还能给每条字幕追加在屏时长如果原始音频文件还在本机它还会分析静音点让字幕打点更准详见编辑与调整文档。不想开图形界面可以用命令行批量处理例如把本地视频转成字幕buzz add --task transcribe \ --model-type whispercpp --model-size small \ --srt --vtt meeting.mp4完整参数见 CLI 文档支持指定模型类型、语言、初始提示词等。六、常见卡点与维护中途卡住了先对照下面这份清单自查。Windows 安装弹安全警告应用未签名属正常现象选 More info → Run anyway 即可Linux 没有录音设备确认装过 libportaudio2snap 版要执行密码服务授权那条命令模型下载慢按偏好文档设置 HF_ENDPOINT 指向镜像源人名专名总被转错在导入任务的 Advanced 选项里填 Initial prompt把常用名字写进去实时转录卡换更小的模型观察队列长度必要时调大Transcription step用一段时间后可以回偏好设置删掉不用的模型腾空间换机器时把模型目录整体搬走再把 BUZZ_MODEL_ROOT 指过去就行。到这里安装、首转、提速、导出、排错五个环节就都跑通了。下一步建议先拿一段真实的会议录音完整走一遍导入 → 转录 → 导出 SRT模型拿不准时回到第四节的档位对照表按自己的硬件选。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表