ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Buzz 离线转写三步教程:本地跑 Whisper,录音直接变文字稿

Buzz 离线转写三步教程:本地跑 Whisper,录音直接变文字稿 Buzz 离线转写三步教程本地跑 Whisper录音直接变文字稿【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz两小时的会议录音你不想逐句手打字幕。Buzz 是一台离线语音转写工具Whisper 模型直接跑在你电脑里音频不离开本机生成的文字稿带时间戳还能顺手导出 SRT 字幕。主界面左侧任务队列显示每个文件的转写进度右侧可直接播放音频对照文稿安装 Buzz 并下载第一个模型用 PyPI 渠道最省事需要 Python 3.12 和 ffmpegpip install buzz-captions python -m buzzLinux 也可以走sudo snap install buzz。想要源码可以git clone https://gitcode.com/GitHub_Trending/buz/buzz但日常使用不必碰仓库。首次转写前只有一个前置动作下模型。打开 Preferences 窗口切到 Models 标签页Group 下拉框选 Faster Whisper它是官方 Whisper 的 CTranslate2 重写版同样的效果跑得更快在 Available for Download 分组里点中Medium。点 Download进度条走完模型就出现在 Downloaded 分组下载中断也没关系重进再点会续上已缓存的部分。模型缓存在本机的.cache/buzz/models之后离线语音转写全程不需要网络。Models 标签页Group 选模型组中间是已下载/可下载列表下方是 Download、Delete、Show file location把本地录音变成带时间戳的文字稿File 菜单里点 Import File选一个 mp3、wav、flac、m4a 都行。弹出的导入窗口里Model 保持 Faster Whisper模型大小选 medium首次用速度和质量都够用Language 留 Detect Language 让模型自己判断Task 选 Transcribe。Export 一行勾上 SRT再勾 TXT点 OK。队列里出现一个新任务进度条慢慢走。完成后点这条任务Transcription Viewer 打开左边是带时间戳的文字稿上方可以播放音频逐句对照TXT 和 SRT 文件直接落在音频所在目录。转录结果段落按时间戳对齐播放头走到哪一句高亮哪一句把外语播客翻译成中文外语内容的关键在 Task 一行。Language 选源语言或留 DetectTask 改选 Translate to English——Whisper 的翻译方向是输出英文稿这一步先拿到干净的英文。想要中文稿点窗口底部的 Advanced Settings勾选 Enable AI translation在 AI model 一行填一个支持文本生成的 LLM 模型 ID填本地模型即可不必外发。Buzz 会把英文稿逐句喂给模型翻译字幕的时间戳保持不变。这一步依赖 LLM其余环节依旧离线。一整个文件夹批量转写File 菜单里的 Import Folder 选中一整个文件夹里面所有音频会逐条进队列按顺序转。更进一步Preferences 的 Folder Watch 标签页可以指定一个监听目录往里面丢新文件Buzz 自动开始转写适合录音笔每天同步一堆 mp3的场景。失败的任务会在状态列标出 Failed点开能看到原因修好重导就行。模型档位怎么选硬件怎么匹配你的硬件是纯 CPU 或核显 → 选 tiny 到 smalltiny 约 73MBsmall 约 460MBmedium 也能跑但明显更慢有 NVIDIA 显卡且装好 CUDA 版 PyTorch → medium 起步冲质量就上 large-v3约 2.9GB或 large-v3-turbo约 1.6GB更快Apple Silicon 的 Mac → Group 换 Whisper.cpp官方为 M 系列优化Faster Whisper 在旧款 Intel Mac 上不可选内存紧张 → tiny 或 base。踩坑速查现象一句话解法下载卡住或失败取消后重新点 Download已缓存部分不重下转写慢换 small 或 base 档关掉吃 CPU 的后台程序中文识别差升到 medium 或更大档位确认音频里人声够清晰模型文件太占空间Models 页面选中后点 Delete 清理界面没有 Faster Whisper 选项你是旧款 Intel MacGroup 改选 Whisper.cpp把第一段录音拖进 Buzz选完模型点 OK剩下的交给它。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表