Buzz:离线语音转录,敏感会议录音不出电脑也能跑通
2026/9/7 7:21:53 网站建设 项目流程

Buzz:离线语音转录,敏感会议录音不出电脑也能跑通

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

周五下班前打开文件夹,2 小时的会议录音还等着整理。Buzz 是一个跑在你自己电脑上的离线语音转录工具,底层用 OpenAI 的Whisper,音频从头到尾不用传到任何云端。读完本文,你能把它装好、跑通第一个文件,并把结果导出成 TXT 或字幕。

🎯 它凭什么能解决你的问题

全程本地运行——你的文件一步不出电脑

  • 音频、视频都直接在本地机器上处理,不存在"上传到服务器"这一步
  • 转录记录、模型文件都存在你自己电脑的缓存目录里
  • 适合商业录音、医疗访谈、内部会议这类不方便外发的内容
  • 就算断网也能跑,只要提前把模型下好

多套 Whisper 后端——有显卡用显卡,没显卡照样跑

  • Whisper.cpp走 C++ 实现,普通核显甚至纯 CPU 都能跑
  • Faster Whisper在 6GB 显存以上的 NVIDIA 显卡上速度最快
  • HuggingFace 后端能加载针对特定语言优化过的定制模型
  • 你在设置里切换后端,不用改任何代码

边听边出字——实时录音转写

  • 打开麦克风就能边说边转,适合现场记录和演讲
  • 支持"追加校正"模式,会自动修正上一句的错字
  • 可以单独开个演示窗口,投影给别人看实时字幕

🚀 从零到跑通,只需三步

第一步:按系统把 Buzz 装上

Windows / macOS:从官方发布页下载对应的安装包(Windows 是 .exe,macOS 是 .dmg),按提示安装即可。Windows 首次启动若弹安全提示,选"更多信息"→"仍要运行"。

Linux

flatpak install flathub io.github.chidiwilliams.Buzz

开发者(PyPI)

pip install buzz-captions python -m buzz

第二步:导入并跑通第一个文件

启动后点工具栏的"+"(或按 Ctrl/Cmd + O),选一个音频或视频文件,比如一段 MP3 或 MP4。在右侧表单里确认任务(转录/翻译)、语言、模型,然后点 Run。第一次运行会先下载你选的模型,等状态变成 Completed 就成功了。

Buzz 主界面:导入文件、选择模型后点 Run 即可开始离线转录。

第三步:打开结果并导出

状态完成后,双击那一行打开转录查看器。你能逐句核对文本、拖动时间戳、边播放边改字。确认无误后,在导出菜单里选 TXT、SRT 或 VTT,结果就保存到本地。

转录查看器:逐句查看文本、调整时间戳,并导出为多种格式。

🧩 这些场景,插上就能用

播客主:把一集口播稿十分钟拉出来

  1. 导入整集的音频,语言选对应语种,模型用 small 或 medium。
  2. 点 Run,等转录完成后打开查看器。
  3. 导出 TXT,直接进剪辑软件当文字稿用。

小技巧:在高级设置里把节目里常被转错的嘉宾名、产品名填进 Initial prompt,能明显减少错别字。

内容创作者:给视频配好可直接导入的字幕

  1. 导入视频,Buzz 会自动抽出音频轨来转写。
  2. 勾选"词级时间戳",方便后续重新切分字幕。
  3. 导出 SRT 或 VTT,直接拖进剪辑软件。

字幕调整界面:按最大长度、标点或静音重新切分字幕行。

小技巧:用"Resize"功能把超长字幕按标点拆开,并给每条字幕统一加长停留时间,观感更稳。

会议记录员:让新录音自动变成纪要

  1. 在偏好里开启文件夹监视,指定一个输入目录。
  2. 把当天录音丢进去,Buzz 自动开始转录。
  3. 配好导出命名模板,纪要文件名自动带日期。

小技巧:导出文件名支持变量(如文件名、任务、时间),设一次后每场会议都省得手动改名。

⚙️ 用久了才会碰到的几件事

转得太慢——模型和后端怎么选

问题:长音频转一下要等很久。原因是模型越大越吃算力,小机器硬跑大模型必然慢。解法:低配机器换 tiny/base 模型或切到 Whisper.cpp 后端;有 NVIDIA 显卡(≥6GB 显存)就换 Faster Whisper;老显卡跑不稳可以强制走 CPU。

想批量和自动化——文件夹监视加命令行

问题:文件多,一个个点太累。原因是纯手动导入没有批量入口。解法:用文件夹监视自动处理新文件;脚本化场景直接用命令行,一条buzz add就能指定模型、语言、导出格式并跑多个文件。

导出格式怎么选——TXT、SRT、VTT

问题:导出来不知道选哪个。原因是三种格式用途不同。解法:纯文字整理选 TXT;本地剪辑软件用 SRT;在线视频平台用 VTT;需要程序处理再选 JSON。

🛟 卡住了?先查这里

模型存到哪里了?

  • Linux 在~/.cache/Buzz,macOS 在~/Library/Caches/Buzz,Windows 在%USERPROFILE%\AppData\Local\Buzz
  • 或在 帮助 → 偏好 → 模型 里点"显示文件位置"

转出来一堆错字怎么办?

  • 手动指定语言,别用自动检测
  • 在 Initial prompt 里补上专有名词
  • 重要内容换更大的模型再跑一遍

老电脑启动就崩?

  • 先删掉损坏的模型文件重新下载
  • 确认 CPU 支持 AVX2,太老的机器不支持

完全断网的机器怎么用?

  • 在有网的机器下好模型,整个模型文件夹拷过去放到对应缓存目录
  • 参考scripts/download-models.py提前准备离线模型包

延伸阅读:

  • 常见问题与模型说明:docs/docs/faq.md
  • AI 摘要等插件源码:plugins/ai_summary/
  • 命令行参数速查:docs/docs/cli.md

回到周五那个文件夹,现在把录音丢给 Buzz,等它转完你就能直接导出字幕收尾了。装好后先跑一段自己的录音试试,感受下离线转录的顺手。这就是 Buzz 想帮你做到的事。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询