ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Buzz + Faster-Whisper 离线语音转写配置:数小时会议录音当天出文字稿

Buzz + Faster-Whisper 离线语音转写配置:数小时会议录音当天出文字稿 Buzz Faster-Whisper 离线语音转写配置数小时会议录音当天出文字稿【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz下午六点半会议室里躺着一段四小时的讨论录音文字稿今天必须交出去而这台机器接不了外网。Buzz 解决的正是这类问题它是跑在自己电脑上的离线语音转写工具配合 Faster-Whisper 引擎从音频到带时间戳的文字稿全程不需要联网。Faster-Whisper 是对 OpenAI Whisper 的优化移植精度与原版基本持平转录速度却快出 2~4 倍内存占用也更低。纯离线场景下它基本是首选引擎Buzz 的 buzz/transcriber/ 目录里还集成了 Whisper.cpp 等引擎后文只围绕 Faster-Whisper 展开。在本地跑起来 Buzz 之前要准备什么硬件上CPU 需要支持 AVX2太老的机器带不动有 NVIDIA 显卡的话转录会快不少但没有也能用 CPU 跑。第一次下载模型需要联网之后可以完全离线。克隆仓库、建虚拟环境、装依赖全部命令集中在下面git clone https://gitcode.com/GitHub_Trending/buz/buzz cd buzz python -m venv .venv source .venv/bin/activate # Windows 用 .venv\Scripts\activate pip install -e . pip install faster-whisper python main.py需要在一台能联网的电脑上提前把模型备好、再整包搬到离线机器的话仓库里的 scripts/download-models.py 就是干这个的它把模型缓存拉全整个缓存文件夹拷到目标机器相同位置即可。三步完成首次离线转录打开偏好设置菜单栏 Help - Preferences切到 Models 页。下载模型Group 下拉选 Faster Whisper尺寸先挑 Medium点 Download。进度条走完后再点 Show file location确认文件落盘。模型统一存在用户缓存目录下Linux 上就是~/.cache/Buzz/modelsMedium 大约要 1.5GB 磁盘。导入音频并转写点主界面左上角的 选中录音文件在弹窗里核对 Model刚才下的 Faster-Whisper 模型、Language音频语种、TaskTranscribe 转录或 Translate 翻译点 OK。任务进入队列进度直接显示在主列表里跑完点开任务就能看到逐句带时间戳的文字。Faster-Whisper 模型尺寸怎么选四个常用档位对比如下体积按下载量估算模型下载体积转录速度精度适合场景Tiny约 75MB最快一般草稿速览、低配老机器Base约 140MB快尚可日常零散录音Medium约 1.5GB中等高默认推荐会议记录、播客Large (v3)约 2.9GB最慢最高正式存档、专业交付默认推荐从 Medium 起步速度可接受精度对多数会议和访谈够用。追求极致速度时可以看 large-v3-turbo约 1.6GB它在速度和精度之间取平衡。名字带.en后缀的变体只支持英语处理中文等语种时别选错。同一份录音不同档位效果差异明显拿几分钟音频各测一遍是最稳妥的办法。CPU 与 GPU 两条提速路径CPU 路径Buzz 默认只占用一半 CPU 核心做转录线程无需改动。如果机器同时挂着别的重任务或 GPU 驱动反复出问题就在 Preferences 里勾选 Force CPU 强制走 CPU显存或内存紧张时再勾上 Reduce GPU memoryBuzz 会切到 int8 量化内存占用明显下降CPU 模式下同样有效。启动器层面等价的环境变量写法BUZZ_FORCE_CPUtrue python main.py # 强制 CPU 转录 BUZZ_REDUCE_GPU_MEMORYtrue python main.py # int8 量化降低内存占用GPU 路径NVIDIA 显卡 CUDA 12 即可Linux 上开箱即用Windows 官方安装包已内置 GPU 支持。显存建议 6GB 起步显存不够时开 Reduce GPU memory 量化GPU 下为 int8_float16即可放下 Medium 甚至 Large。排障速查现象可能原因处理模型下载卡住或失败网络不稳Windows 并行下载锁竞争重新下载或联网机上备好文件后手动拷入 models 缓存目录转完模型后 Buzz 崩溃下载不完整或文件损坏在 Preferences - Models 里删除该模型重新下载转录明显偏慢模型偏大、后台程序抢占资源、GPU 未生效换小一档模型关闭占用大的程序确认 CUDA 12 装好或改用 Force CPU有显卡却按 CPU 速度跑CUDA 版本低于 12或驱动缺失升级 CUDA 12仍不行就勾 Force CPU 保底文字对不上录音模型档位太低、环境嘈杂换更大模型录音环境降噪录完可再开降噪后处理提示无法运行 BuzzCPU 不支持 AVX2更换较新的硬件老平台不在支持范围更多细节可以翻 docs/ 下的中英文档想动手看引擎怎么调度转录从 buzz/transcriber/ 和 buzz/widgets/ 两个目录读起代码量不大一天能过完。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表