本地离线音频转文字一次搞定:Buzz 转录工具上手指南
2026/9/7 5:45:35 网站建设 项目流程

本地离线音频转文字一次搞定:Buzz 转录工具上手指南

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

你手上有小时的会议录音却不想逐字回放,传到在线服务又怕内容外泄?Buzz 是一款基于 OpenAI Whisper 模型的本地音频转文字工具,把语音转文字和翻译全部放在你自己的电脑里完成。需要整理访谈、课堂笔记或给视频加字幕的人,都可以把它当作日常工具。

💻 把 Buzz 装到电脑上

图形化安装(Windows 和 macOS)

到官方分发页下载 macOS 的.dmg或 Windows 安装包,双击一路下一步即可。注意 Windows 版未做签名,安装时系统会弹出警告,选择"更多信息 → 仍要运行"就能继续。

Linux 下用包管理器安装

系统已装好 Flatpak 或 Snap 的话,一条命令即可完成本地部署:

flatpak install flathub io.github.chidiwilliams.Buzz

用 pip 从源码生态安装

习惯 Python 环境的话,先在系统里装好 ffmpeg,再执行:

pip install buzz-captions python -m buzz

🎬 三步跑通第一次转录

把音频文件加入任务队列

打开 Buzz 后按Ctrl+O(macOS 为Cmd+O)或点击工具栏的"+"按钮,在弹出的导入窗口里选中 MP3、WAV、FLAC、M4A 等音频或 MP4 等视频文件。可以一次选中多个,它们会依次出现在左侧任务列表里。

选模型并启动转录

每行任务都有"模型"下拉框。第一次使用保持默认即可,点"Start"开始队列,Buzz 会逐个处理文件并在行内显示进度。语言一栏建议直接填录音的实际语言,比自动检测更稳。

查看并导出结果

任务完成后双击该行,进入转录查看器:文字按时间戳分段列出,下方有播放器,点哪一段就从哪一段开始播。确认无误后点右上角"Export",选 SRT、VTT 或 TXT 保存到你的文件夹。

✨ 三个功能亮点

四类 Whisper 后端任选

"Whisper"是 OpenAI 开源的语音识别模型,Buzz 把它换成了四种运行方式:原版 Whisper 精度高但偏慢;Faster Whisper 需要 6GB 以上显存的 Nvidia 显卡;Whisper.cpp 是 C++ 实现,纯 CPU 或任意显卡都能跑,也是 Mac 用户的最佳选择;HuggingFace 类型则能加载针对特定语言优化的第三方模型。适合你按手头的硬件和精度要求各取所需。

麦克风实时转录

在录音面板选好任务、语言和麦克风,点"Record"就能边说边出字,文字实时追加在下方。开启演示窗口还能把字幕放大投屏。适合现场会议记录、讲座速记这类"话音刚落就要成稿"的场景。

字幕行合并与拆分

点查看器里的"Resize"按钮,可以设定每条字幕的最大字数、按标点自动断句,还可以给每条字幕延长显示时长。生成给视频配字幕用的 SRT 时,能直接控制单行长度和阅读节奏,省去手工修剪。

💡 五条效率技巧

  1. 语言已知就手动指定,让 Buzz 跳过自动检测环节,转录更准。
  2. 文件很多时开启"监视文件夹",把待处理音频丢进去就会自动转录,不用手动点添加。
  3. 长录音先用小模型快速出一版,个别段落再换大模型精转,省时省力。
  4. 实时转录建议搭配 Whisper.cpp 加小模型,延迟低、系统占用小。
  5. 记住Ctrl+O导入、Ctrl+F在转录文本里搜索、Ctrl+G跳到当前播放位置,长录音校对快很多。

❓ 常见问题

Buzz 需要联网吗?不需要。转录计算全在本地完成,模型首次下载后就缓存在本机(Help → Preferences → Models 里能看到存放位置)。

支持哪些文件格式?MP3、WAV、FLAC、M4A 等常见音频和 MP4 等视频文件都可以导入,也支持直接粘贴 YouTube 链接。

结果能导出成什么?TXT 纯文本、SRT 字幕、VTT 网页字幕,查看器里一键选择。

转录速度太慢怎么办?换更小的模型,或改用 Whisper.cpp / Faster Whisper 后端;有 Nvidia 显卡的机器上 GPU 加速效果最明显。

完全断网的电脑能用吗?可以。在有网电脑上把所需模型下载好,再整个模型文件夹拷到离线电脑的相同目录即可。

Buzz 把"导入 → 转录 → 导出"整条链路都留在你的机器上,记者整理采访、学生整理课堂录音、创作者制作视频字幕,都能全程不碰云端。想深入了解各功能的细节,可以翻翻 docs/docs/ 里的使用文档,或直接从 buzz/transcriber/ 目录读起源码。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询