ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Buzz:免费离线音频转录完整指南,本地运行 Whisper 零成本转写

Buzz:免费离线音频转录完整指南,本地运行 Whisper 零成本转写 Buzz免费离线音频转录完整指南本地运行 Whisper 零成本转写【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款跑在 OpenAI Whisper 之上的离线音频转录桌面工具转写和翻译全部在本地电脑上完成不上传音频、不注册账号、不按字数收费。它适合做会议记录、给视频做字幕、整理涉密或隐私语音素材的用户。 10 秒扫完Buzz 关键信息表项目内容软件形态跨平台桌面应用支持 Windows / macOS / Linux核心技术Python 3.12 PyQt6转录引擎为 Whisper支持 Whisper.cpp、Faster Whisper 等多后端许可协议MIT 开源联网要求模型下载完成后可完全离线使用数据存储转录历史与设置存于本地 SQLite 数据库主界面是一个任务队列导入文件后在这里选择参数、跟踪进度、打开结果。Buzz 能力清单按使用频率从高到低排文件转录导入音频、视频或 YouTube 链接自动抽音轨转写手头已有录音、视频素材多语言识别支持近百种语言也可留空让模型自动检测语言混杂或不确定语言的内容实时麦克风录音边录边转可另开演示窗口投屏给现场观众会议、讲座、访谈现场语音翻译把转写结果译成目标语言也可接 OpenAI API 做远程转写增强跨语言内容整理说话人识别区分同一段录音里的不同发言人并在文本中标注多人会议纪要、采访整理字幕导出与时间轴微调导出 TXT / SRT / VTT还能逐段拖动调整起止时间字幕校对、剪辑交付自动化监视文件夹自动为新文件建任务CLI 可批量脚本化流水线处理大量素材 三条上手路径图形界面 / 包管理器 / 开发者版路径一官方安装包普通用户首选下载对应系统的安装包Windows 包未签名安装时出现安全警告选更多信息→仍要运行即可启动后按 Ctrl/CmdO 导入媒体文件在任务列表里选好任务类型、语言和模型点击运行路径二Linux 包管理器flatpak install flathub io.github.chidiwilliams.Buzz没有 Flatpak 的话也可以用 Snap 安装需先装几个运行库依赖。路径三PyPI 开发者版前提系统装好 ffmpeg使用 Python 3.12 环境。pip install buzz-captions python -m buzz默认装的是 CPU 版 torchWindows 上要 GPU 加速需另外安装 CUDA 版详见下文排错。 两个高频场景实战场景一给视频生成字幕导入视频文件Buzz 自动抽取音轨无需手动转格式任务选转写语言指定为中文模型按机器性能选 small 或 medium运行打开转录查看器核对时间戳导出 SRT 或 VTT查看器支持按时间戳定位播放、搜索和调速是字幕校对的主要工作台。产出物一个可直接导入剪辑软件的字幕文件安静环境下准确率足以省去大部分人工校对。场景二会议实时记录主界面切到实时录音模式选好麦克风开始录音底部面板实时出字默认 20 秒延迟让文字与语音对齐结束后保存再跑一次说话人识别把发言人标注清楚如果对个别片段不满意用段落调整工具拖动起止时间即可修正。产出物带时间戳、分好发言人的会议文字稿必要时再翻译成目标语言归档。排错速查4 个高频问题的现象、原因与解法现象转录速度慢 → 原因模型对当前机器过大或后端没吃到 GPU → 解法换 tiny / base 小模型或改用 Whisper.cpp 后端并启用加速Nvidia 走 CUDA其他显卡走 Vulkan现象专有名词、术语转写错 → 原因模型缺少领域上下文 → 解法高级设置里填初始提示initial prompt已知音频语言时手动指定别用自动检测现象Windows 安装报安全警告 → 原因安装包未做代码签名 → 解法属正常现象选更多信息→仍要运行即可现象PyPI 版 GPU 不生效 → 原因默认装的是 CPU 版 torch → 解法按 README 说明改装 CUDA 版 torch 及对应 cu12 运行库 源码结构与深入入口Buzz 是 Python 3.12 PyQt6 桌面应用转录历史、设置、转录段落都落在本地 SQLite 数据库里。所有转录后端被抽象在 buzz/transcriber/ 目录Whisper、Whisper.cpp、Faster Whisper、Hugging Face 各占一个文件想接新后端从这里入手最清晰插件机制位于 buzz/plugins/已内置 AI 摘要、DOCX 导出、自动调整字幕时长等插件。命令行参数全貌可查 docs/docs/cli.md。文档入口与反馈建议想跑批量任务或细看功能从 docs/docs/ 目录下的使用教程文件导入、实时录音、翻译、段落调整、说话人识别逐篇读起即可。发现 bug 或有功能想法建议直接给项目仓库提 Issue附上日志文件帮助 → 关于 Buzz → 显示日志能让维护者更快定位。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表