Buzz 本地转录指南:三步把语音变文字,离线生成字幕
2026/9/7 7:30:38 网站建设 项目流程

Buzz 本地转录指南:三步把语音变文字,离线生成字幕

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

会议录音里只记住了零星的词,想把缺的补全只能倒带重听、逐字敲出来——Buzz 就是干这个活的本地转录工具。它跑在你自己的电脑上,用 OpenAI 开源的 Whisper 模型把语音转成文字,还能翻译成 99 种以上语言并导出离线字幕。对学生、内容创作者、不想把录音传上云的办公人来说,开箱即用。

🚀 安装 Buzz:挑一个最快的方式

Buzz 官方支持 Windows、macOS 和 Linux,三种系统都有现成方案,不需要自己编译:

  • macOS:下载 .dmg 安装文件,双击安装
  • Windows:下载安装包,弹出"未签名"警告时点"更多信息"→"仍要运行"即可
  • Linux:通过 Flatpak 或 Snap 包管理器一条命令装好
  • Python 开发者也可以直接从 PyPI 安装

下面两条命令任选其一就能跑起来:

flatpak install flathub io.github.chidiwilliams.Buzz
pip install buzz-captions python -m buzz

pip 安装前需先在系统装好 ffmpeg。首次启动后,软件会自动引导你挑选 Whisper 模型和默认语言,机器配置低就先选 tiny 模型,识别日常对话完全够用。

Buzz 模型设置:在这里挑选模型大小与语言,小硬盘、低配机器建议从 tiny 开始

⏱️ 跑通第一次转录

主界面就是一个任务队列,完整流程三步:

  1. 添加:点工具栏的"+",选一个本地音视频文件(MP3、WAV、FLAC、视频都支持),也可以直接粘贴 YouTube 链接,Buzz 会自动抓取音频
  2. 配置:在对应行设置模型大小和目标语言。只要转录选"transcribe",想把外语音频转成中文就选"translate"
  3. 运行:点开始,等队列处理完,双击那一行就打开转录界面

文件可以一次加多个,Buzz 会排队逐个处理,期间你可以关掉窗口去干别的。想深入了解每种模型(whisper.cpp、faster-whisper 等)的调用逻辑,代码都在buzz/transcriber/目录里。

Buzz 主界面任务队列:用"+"按钮添加文件,每行显示模型、语言和转录进度

🔍 核心能力拆解:Buzz 最拿手的三件事

实时录音,讲课时还有专门的演示窗口

Buzz 不只是处理现成文件。插上麦克风就能实时转录,会议、课堂直接出文字。它还内置"演示模式",把转录文本放大显示,适合演讲和教学时投屏。多人说话时,Buzz 能识别不同说话人并做标记,回看时不用猜哪句是谁说的。

转录界面:改字、搜索、随点随播

转录完成后打开编辑器,每段文字都带开始和结束时间戳。点一下时间戳,音频就从那一瞬间播起,校对时不用再拖进度条。文字可以直接改,长句可以拆开,短句可以合并,搜索框里敲一个关键词就能快速定位。所有改动实时存进本地数据库,软件闪退也不丢内容。

Buzz 转录界面:每段文字带时间戳,点击即可跳到对应位置播放,方便核对音文

按语义切分字幕行,一键导出

Whisper 首次转出来的字幕经常一行太长。用"Resize"功能设定你想要的行长度,Buzz 会依据标点符号和时间间隔重新断句,不用手工剪。调完之后直接导出 TXT、SRT 或 VTT,拖进剪辑软件就能用。项目还有插件系统,AI 摘要、自动调整字幕这类能力都是插件形式提供的,源码放在buzz/plugins/目录,好奇的话可以翻一翻。

Buzz 字幕调整:设定目标行长度后自动按标点和时间间隔重新切分字幕

🏠 本地转录到底图什么

在线转录服务有一个绕不开的环节:把音频上传到第三方服务器。Buzz 的本地转录路线让录音和生成的文字从头到尾不出你的电脑,换来三件实实在在的事:

  • 访谈录音、内部会议这类私密素材可以放心处理
  • 断网环境照常工作,不依赖任何云端服务在线
  • 速度取决于自己的硬件:N 卡走 CUDA 加速,Apple Silicon 的 Mac 用自带芯片跑

代价是首次要下载模型、占一点硬盘空间。机器不强的话选 tiny 或 base 模型,日常使用精度足够。

🎬 三件马上能做的事

  • 学生:把课堂录音转成文字,复习时点时间戳直接跳回重点段落
  • 视频创作者:生成 SRT 字幕文件,作为剪辑时的底稿再精修
  • 办公场景:开启文件夹监听,新文件放进去自动转录,不用每次打开软件

Buzz 本质上就是 Whisper 模型加一个图形界面,再加一套字幕编辑工具。下载安装包,三分钟完成第一次转录:打开主界面,选一个音频文件,点开始。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询