Buzz 3分钟离线转写音频,数据不出电脑
2026/9/7 9:40:21 网站建设 项目流程

Buzz 3分钟离线转写音频,数据不出电脑

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

把会议录音传到云端转写,既按量收费又有数据泄露风险。Buzz 是一款基于 Whisper 的开源离线转录工具,在你自己的电脑上把音频转成带时间戳的文字,也支持翻译,全程免费。

Buzz 是什么:本地运行的离线语音转文字工具

Buzz 是一个支持 macOS、Windows、Linux 的桌面应用,技术底座是 OpenAI 的 Whisper 语音识别模型。原理不复杂:你在本地选一个模型尺寸和语言,音频在电脑上完成推理,输出带时间戳的文本,全程不上传任何音频。

📦 三步完成安装:按系统选一条路

Windows

  1. 从项目发布页下载 Buzz 安装程序.exe,双击安装。
  2. 程序未签名,弹出警告时点「更多信息」再选「仍要运行」。
  3. 启动后导入一段音频试试。

macOS

  1. 从发布页下载.dmg文件。
  2. 打开后将 Buzz 拖入应用程序文件夹,启动即可。

Linux(Snap 方式)

  1. 打开终端,依次执行:
sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzz sudo snap connect buzz:password-manager-service

Python 环境(跨平台,需 Python 3.12 并预装 ffmpeg)

pip install buzz-captions python -m buzz

验证是否装好:导入任意一段 MP3,任务状态变为「Completed」,双击该行能看到带时间戳的文本,即成功。

🎬 Buzz 功能一览:从导入文件到导出字幕

功能作用适用场景
本地文件转写导入音频/视频文件或粘贴 YouTube 链接,生成带时间戳文本会议录音、播客整理
实时录音转写麦克风输入边录边转,支持 Append and correct 等 3 种模式讲座、采访
翻译内置 Whisper 英文翻译;配置 AI 模型后可译成任意语言外语播客、国际会议
多格式导出导出 TXT、SRT、VTT,插件可再导出 DOCX字幕制作、文档归档
说话人识别区分媒体中不同说话人多人对话、访谈
监控文件夹指定目录放入新文件即自动转写批量处理

其中最常用的是转录查看器:双击任务进入后,可以搜索文本、循环播放某一段、把播放速度调到 0.5x~2.0x,还能以 0.5 秒为步长微调每段起止时间,边听边改错。适合所有需要校对转录内容的场景。

🧩 Buzz 进阶玩法:词级时间戳与自动字幕切分

词级时间戳 + Resize 自动切字幕。导入文件时,在「Advanced...」选项里勾选 Word-Level Timings,Buzz 会为每个单词记录时间戳。之后在转录查看器点 Resize,设定字幕最大长度并选择按标点拆分;如果原始音频还在磁盘上,重组时还会分析音频里的静音段,让字幕边界更自然。效果是一条命令把长段落变成长度可控的字幕,还能给每条字幕统一延长显示秒数。这套流程主要给字幕制作者和短视频剪辑用。

选对转写引擎。在「Preferences → Models」可以下载和管理模型,尺寸从 tiny 到 large 共 5 档,精度换速度。Buzz 内置 4 种 Whisper 实现:原版 Whisper 准确但慢;Faster Whisper 适合显存 6GB 以上的 NVIDIA 显卡;Whisper.cpp 是 C++ 实现,任何品牌 GPU 甚至纯 CPU 都能跑,官方建议实时录音用它;Hugging Face 实现额外支持 MMS 等上千语言模型。Mac 用户选 Whisper.cpp 最合适。

1.4.5 版本起还有插件系统:Help → Plugins 里可开关 AI 摘要、DeepFilterNet 降噪、跳过已转写文件等内置插件,也可以拖拽排序、填 URL 添加社区插件。想自己写插件,参考 buzz/plugins/ 目录下的源码即可。

🎯 Buzz 适合谁用

  • 字幕与视频制作者:词级时间戳加 Resize 能直接产出 SRT/VTT 字幕,省去手动对齐。
  • 学生和科研人员:讲座、访谈录音离线转文字,反复检索引用,数据留在本机。
  • 记者和编辑:边采访边录音转写,导出 DOCX 直接进稿件流程。
  • 隐私敏感用户:法律、医疗等录音不出内网,也支持无网环境离线使用。

不适合的场景:默认 Whisper 模型算力开销不小,低配机器上实时转写会吃力;需要云端批量跑几千个文件的话,用 API 服务更合适(Buzz 本身也提供 OpenAI API 后端)。

❓ Buzz 常见问题

Windows 安装时提示未验证的发布者,怎么办?程序未做数字签名,点「更多信息」→「仍要运行」即可继续,属于正常现象。

转写太慢有什么办法?换 tiny 或 base 等更小模型,或改用 Whisper.cpp 实现,它支持 CPU 运行。有 6GB 以上显存的 NVIDIA 显卡可以切到 Faster Whisper。

没网的环境能用吗?可以。在联网机器上 Preferences → Models 下载好模型并点「Show file location」,把模型文件夹原样拷到离线机器的相同路径即可。

写在最后

各功能的完整操作说明见官方文档。今天就导一段录音,体验一下数据不出电脑的转录流程。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询