Buzz 3分钟离线转写音频,数据不出电脑
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
把会议录音传到云端转写,既按量收费又有数据泄露风险。Buzz 是一款基于 Whisper 的开源离线转录工具,在你自己的电脑上把音频转成带时间戳的文字,也支持翻译,全程免费。
Buzz 是什么:本地运行的离线语音转文字工具
Buzz 是一个支持 macOS、Windows、Linux 的桌面应用,技术底座是 OpenAI 的 Whisper 语音识别模型。原理不复杂:你在本地选一个模型尺寸和语言,音频在电脑上完成推理,输出带时间戳的文本,全程不上传任何音频。
📦 三步完成安装:按系统选一条路
Windows
- 从项目发布页下载 Buzz 安装程序
.exe,双击安装。 - 程序未签名,弹出警告时点「更多信息」再选「仍要运行」。
- 启动后导入一段音频试试。
macOS
- 从发布页下载
.dmg文件。 - 打开后将 Buzz 拖入应用程序文件夹,启动即可。
Linux(Snap 方式)
- 打开终端,依次执行:
sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzz sudo snap connect buzz:password-manager-servicePython 环境(跨平台,需 Python 3.12 并预装 ffmpeg)
pip install buzz-captions python -m buzz验证是否装好:导入任意一段 MP3,任务状态变为「Completed」,双击该行能看到带时间戳的文本,即成功。
🎬 Buzz 功能一览:从导入文件到导出字幕
| 功能 | 作用 | 适用场景 |
|---|---|---|
| 本地文件转写 | 导入音频/视频文件或粘贴 YouTube 链接,生成带时间戳文本 | 会议录音、播客整理 |
| 实时录音转写 | 麦克风输入边录边转,支持 Append and correct 等 3 种模式 | 讲座、采访 |
| 翻译 | 内置 Whisper 英文翻译;配置 AI 模型后可译成任意语言 | 外语播客、国际会议 |
| 多格式导出 | 导出 TXT、SRT、VTT,插件可再导出 DOCX | 字幕制作、文档归档 |
| 说话人识别 | 区分媒体中不同说话人 | 多人对话、访谈 |
| 监控文件夹 | 指定目录放入新文件即自动转写 | 批量处理 |
其中最常用的是转录查看器:双击任务进入后,可以搜索文本、循环播放某一段、把播放速度调到 0.5x~2.0x,还能以 0.5 秒为步长微调每段起止时间,边听边改错。适合所有需要校对转录内容的场景。
🧩 Buzz 进阶玩法:词级时间戳与自动字幕切分
词级时间戳 + Resize 自动切字幕。导入文件时,在「Advanced...」选项里勾选 Word-Level Timings,Buzz 会为每个单词记录时间戳。之后在转录查看器点 Resize,设定字幕最大长度并选择按标点拆分;如果原始音频还在磁盘上,重组时还会分析音频里的静音段,让字幕边界更自然。效果是一条命令把长段落变成长度可控的字幕,还能给每条字幕统一延长显示秒数。这套流程主要给字幕制作者和短视频剪辑用。
选对转写引擎。在「Preferences → Models」可以下载和管理模型,尺寸从 tiny 到 large 共 5 档,精度换速度。Buzz 内置 4 种 Whisper 实现:原版 Whisper 准确但慢;Faster Whisper 适合显存 6GB 以上的 NVIDIA 显卡;Whisper.cpp 是 C++ 实现,任何品牌 GPU 甚至纯 CPU 都能跑,官方建议实时录音用它;Hugging Face 实现额外支持 MMS 等上千语言模型。Mac 用户选 Whisper.cpp 最合适。
1.4.5 版本起还有插件系统:Help → Plugins 里可开关 AI 摘要、DeepFilterNet 降噪、跳过已转写文件等内置插件,也可以拖拽排序、填 URL 添加社区插件。想自己写插件,参考 buzz/plugins/ 目录下的源码即可。
🎯 Buzz 适合谁用
- 字幕与视频制作者:词级时间戳加 Resize 能直接产出 SRT/VTT 字幕,省去手动对齐。
- 学生和科研人员:讲座、访谈录音离线转文字,反复检索引用,数据留在本机。
- 记者和编辑:边采访边录音转写,导出 DOCX 直接进稿件流程。
- 隐私敏感用户:法律、医疗等录音不出内网,也支持无网环境离线使用。
不适合的场景:默认 Whisper 模型算力开销不小,低配机器上实时转写会吃力;需要云端批量跑几千个文件的话,用 API 服务更合适(Buzz 本身也提供 OpenAI API 后端)。
❓ Buzz 常见问题
Windows 安装时提示未验证的发布者,怎么办?程序未做数字签名,点「更多信息」→「仍要运行」即可继续,属于正常现象。
转写太慢有什么办法?换 tiny 或 base 等更小模型,或改用 Whisper.cpp 实现,它支持 CPU 运行。有 6GB 以上显存的 NVIDIA 显卡可以切到 Faster Whisper。
没网的环境能用吗?可以。在联网机器上 Preferences → Models 下载好模型并点「Show file location」,把模型文件夹原样拷到离线机器的相同路径即可。
写在最后
各功能的完整操作说明见官方文档。今天就导一段录音,体验一下数据不出电脑的转录流程。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考