免费离线语音转文字工具 Buzz:三步完成第一次 Whisper 转录
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
还在逐字敲会议纪要?Buzz 是一款免费开源的离线语音转文字工具:基于 OpenAI Whisper,在你的电脑上本地完成转录,录音不会离开你的设备。
Buzz 离线语音转文字能做什么
- 转录音频/视频文件:支持本地文件与 YouTube 链接,输出 TXT、SRT、VTT 三种格式
- 麦克风实时转录:边录边出文字,另有独立演示窗口,适合现场投屏
- 说话人识别:区分录音中不同发言人,多人对话不再糊成一团
- 多种加速后端:NVIDIA CUDA、Apple Silicon、Whisper.cpp(可跑 CPU)
- 插件扩展:AI 摘要、字幕时长自动调整等按需开启
边界要说清楚:转录全程离线,但首次使用需要联网下载模型;纯离线环境可以从别的电脑拷贝模型文件,方法见 FAQ。
Buzz 转录设置:三步跑通第一次语音转文字
- 装好它:Windows 和 macOS 从官方发布页下载安装包;Linux 用
flatpak install flathub io.github.chidiwilliams.Buzz或snap install buzz。如果卡住了:Windows 安装包未签名,弹出安全警告时选"更多信息"再点"仍要运行"即可。 - 导入文件:按 Ctrl+O 选中音频,选任务(转录或翻译成英文)、明确指定语言(自动检测偶尔会认错)、挑一个模型,点 Run。如果卡住了:首次使用会先下载模型,看到下载进度别急,等它下完才真正开始转录。
- 拿到结果:任务状态变为 Completed 后,双击该行打开转录查看器,支持搜索、播放和调速。如果卡住了:总被认错的专有名词,加进高级设置里的"Initial prompt(初始提示)"。
Whisper 模型大小怎么选:按你的机器配
| 你的硬件 | 推荐后端 + 模型 | 预期速度 | 适用场景 |
|---|---|---|---|
| NVIDIA 独显(显存 6GB 以上) | Faster Whisper + small~large | 快 | 长录音批量处理 |
| 普通笔记本 / 纯 CPU | Whisper.cpp + tiny 或 base | 快,接近实时 | 实时录音、日常使用 |
| 无独显但追求准确率 | Whisper.cpp + medium | 较慢 | 专业级转录 |
| Mac(Apple Silicon) | Whisper.cpp | 快 | 全场景 |
小模型快但错得多,大模型准但费时间。准确率优先就按 Large-V2、Large-V3 顺序试(V3 多数情况最准,但偶尔会"编造"没说过词),求稳可选 Turbo 档。当前可选清单直接看"偏好设置 → 模型"。
三个真实用法:会议纪要、视频字幕、现场录音
场景一:会议纪要
- 操作:导入会议录音,指定会议语言,导出 TXT
- 产出物:带说话人区分的文本,直接整理成纪要
场景二:视频字幕
- 操作:导入 MP4 等视频文件,导出格式选 SRT
- 产出物:SRT 字幕文件,可直接导入剪辑软件
场景三:现场实时字幕
- 操作:选小模型 + Whisper.cpp 后端,选好麦克风点 Record
- 产出物:实时文字,可用演示窗口投到大屏,细节见 实时录音文档
Buzz 常见问题排查:转录慢、崩溃、麦克风报错
现象:转录速度很慢原因:模型超出硬件承受能力,或没用上加速后端 解法:换更小模型,或改用 Whisper.cpp / Faster Whisper,选择依据见 FAQ 第 2 条
现象:Buzz 崩溃或打开就闪退原因:模型下载不完整,文件损坏 解法:进入"偏好设置 → 模型",删掉该模型重新下载
现象:录音时报 Unanticipated host error[PaErrorCode-9999]原因:系统隐私设置禁止 Buzz 访问麦克风 解法:到系统设置 → 隐私与安全性 → 麦克风里允许 Buzz
Buzz 适合谁,下一步做什么
Buzz 适合需要把会议、采访、课程录音批量变成文字、又不想把音频传到云端的人——学生整理课堂笔记、创作者剪字幕都合适。
下一步动作:打开 FAQ 确认模型存放位置和离线使用方式;遇到文档没覆盖的问题,通过 Help → About → Show logs 找到日志文件,附在项目的 Issues 页面提一个 issue。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考