Buzz:离线语音转录,敏感会议录音不出电脑也能跑通
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
周五下班前打开文件夹,2 小时的会议录音还等着整理。Buzz 是一个跑在你自己电脑上的离线语音转录工具,底层用 OpenAI 的Whisper,音频从头到尾不用传到任何云端。读完本文,你能把它装好、跑通第一个文件,并把结果导出成 TXT 或字幕。
🎯 它凭什么能解决你的问题
全程本地运行——你的文件一步不出电脑
- 音频、视频都直接在本地机器上处理,不存在"上传到服务器"这一步
- 转录记录、模型文件都存在你自己电脑的缓存目录里
- 适合商业录音、医疗访谈、内部会议这类不方便外发的内容
- 就算断网也能跑,只要提前把模型下好
多套 Whisper 后端——有显卡用显卡,没显卡照样跑
- Whisper.cpp走 C++ 实现,普通核显甚至纯 CPU 都能跑
- Faster Whisper在 6GB 显存以上的 NVIDIA 显卡上速度最快
- HuggingFace 后端能加载针对特定语言优化过的定制模型
- 你在设置里切换后端,不用改任何代码
边听边出字——实时录音转写
- 打开麦克风就能边说边转,适合现场记录和演讲
- 支持"追加校正"模式,会自动修正上一句的错字
- 可以单独开个演示窗口,投影给别人看实时字幕
🚀 从零到跑通,只需三步
第一步:按系统把 Buzz 装上
Windows / macOS:从官方发布页下载对应的安装包(Windows 是 .exe,macOS 是 .dmg),按提示安装即可。Windows 首次启动若弹安全提示,选"更多信息"→"仍要运行"。
Linux:
flatpak install flathub io.github.chidiwilliams.Buzz开发者(PyPI):
pip install buzz-captions python -m buzz第二步:导入并跑通第一个文件
启动后点工具栏的"+"(或按 Ctrl/Cmd + O),选一个音频或视频文件,比如一段 MP3 或 MP4。在右侧表单里确认任务(转录/翻译)、语言、模型,然后点 Run。第一次运行会先下载你选的模型,等状态变成 Completed 就成功了。
Buzz 主界面:导入文件、选择模型后点 Run 即可开始离线转录。
第三步:打开结果并导出
状态完成后,双击那一行打开转录查看器。你能逐句核对文本、拖动时间戳、边播放边改字。确认无误后,在导出菜单里选 TXT、SRT 或 VTT,结果就保存到本地。
转录查看器:逐句查看文本、调整时间戳,并导出为多种格式。
🧩 这些场景,插上就能用
播客主:把一集口播稿十分钟拉出来
- 导入整集的音频,语言选对应语种,模型用 small 或 medium。
- 点 Run,等转录完成后打开查看器。
- 导出 TXT,直接进剪辑软件当文字稿用。
小技巧:在高级设置里把节目里常被转错的嘉宾名、产品名填进 Initial prompt,能明显减少错别字。
内容创作者:给视频配好可直接导入的字幕
- 导入视频,Buzz 会自动抽出音频轨来转写。
- 勾选"词级时间戳",方便后续重新切分字幕。
- 导出 SRT 或 VTT,直接拖进剪辑软件。
字幕调整界面:按最大长度、标点或静音重新切分字幕行。
小技巧:用"Resize"功能把超长字幕按标点拆开,并给每条字幕统一加长停留时间,观感更稳。
会议记录员:让新录音自动变成纪要
- 在偏好里开启文件夹监视,指定一个输入目录。
- 把当天录音丢进去,Buzz 自动开始转录。
- 配好导出命名模板,纪要文件名自动带日期。
小技巧:导出文件名支持变量(如文件名、任务、时间),设一次后每场会议都省得手动改名。
⚙️ 用久了才会碰到的几件事
转得太慢——模型和后端怎么选
问题:长音频转一下要等很久。原因是模型越大越吃算力,小机器硬跑大模型必然慢。解法:低配机器换 tiny/base 模型或切到 Whisper.cpp 后端;有 NVIDIA 显卡(≥6GB 显存)就换 Faster Whisper;老显卡跑不稳可以强制走 CPU。
想批量和自动化——文件夹监视加命令行
问题:文件多,一个个点太累。原因是纯手动导入没有批量入口。解法:用文件夹监视自动处理新文件;脚本化场景直接用命令行,一条buzz add就能指定模型、语言、导出格式并跑多个文件。
导出格式怎么选——TXT、SRT、VTT
问题:导出来不知道选哪个。原因是三种格式用途不同。解法:纯文字整理选 TXT;本地剪辑软件用 SRT;在线视频平台用 VTT;需要程序处理再选 JSON。
🛟 卡住了?先查这里
模型存到哪里了?
- Linux 在
~/.cache/Buzz,macOS 在~/Library/Caches/Buzz,Windows 在%USERPROFILE%\AppData\Local\Buzz - 或在 帮助 → 偏好 → 模型 里点"显示文件位置"
转出来一堆错字怎么办?
- 手动指定语言,别用自动检测
- 在 Initial prompt 里补上专有名词
- 重要内容换更大的模型再跑一遍
老电脑启动就崩?
- 先删掉损坏的模型文件重新下载
- 确认 CPU 支持 AVX2,太老的机器不支持
完全断网的机器怎么用?
- 在有网的机器下好模型,整个模型文件夹拷过去放到对应缓存目录
- 参考
scripts/download-models.py提前准备离线模型包
延伸阅读:
- 常见问题与模型说明:
docs/docs/faq.md - AI 摘要等插件源码:
plugins/ai_summary/ - 命令行参数速查:
docs/docs/cli.md
回到周五那个文件夹,现在把录音丢给 Buzz,等它转完你就能直接导出字幕收尾了。装好后先跑一段自己的录音试试,感受下离线转录的顺手。这就是 Buzz 想帮你做到的事。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考