Buzz 本地语音转文字完整指南:离线转录,免费开源,99+ 种语言
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
一小时的访谈录音不想传到云端,怕客户的声音数据出内网。Buzz 把 OpenAI 的 Whisper 语音识别模型(把说话内容转成文字)搬到你自己的电脑上:导入音频或视频,离线完成转录,结果导出成文本和字幕文件。没有注册、没有订阅、没有上传。
一屏看懂 Buzz
- 解决什么:音频、视频文件和 YouTube 链接的语音转文字,全部在本机完成
- 不做什么:不上传文件到任何服务器,不依赖云端转录,没有付费服务
- 关键卖点:免费开源(MIT 协议);导出 TXT、SRT、VTT 三种格式,字幕可直接进剪辑软件
- 麦克风实时转录,附带面向演讲场合的全屏展示窗口
- 多个 Whisper 后端可选:NVIDIA 显卡 CUDA 加速、Apple Silicon、集显可用的 Vulkan
安装与第一次转录
安装按平台各占一行:
- macOS:下载
.dmg,双击打开 - Windows:运行安装包,提示"未签名"时选"更多信息 → 仍要运行"
- Linux:
sudo snap install buzz,或flatpak install flathub io.github.chidiwilliams.Buzz - Python 环境:先装好 FFmpeg 并使用 Python 3.12,然后:
pip install buzz-captions第一次转录共 4 步:
- 选一个 Whisper 模型,首次会自动下载,之后就是纯离线
- 把音频、视频文件拖进主界面(YouTube 链接也可粘贴),任务自动排队
- 点运行,表格实时显示每个任务的进度
- 完成后双击该行打开转写查看器,按需要的格式导出
全程没有注册,没有强制配置项,装完就能用。
选哪个 Whisper 模型
| 模型 | 速度 | 精度 | 硬件门槛 |
|---|---|---|---|
| Tiny | 最快 | 草稿级,错字较多 | 几乎无要求 |
| Base | 快 | 日常够用 | 低 |
| Small | 中等 | 速度与精度平衡 | 低 |
| Medium | 较慢 | 明显更好 | 中等 |
| Large | 最慢 | 最高 | 吃内存,吃算力 |
Turbo 在速度和精度之间取折中。没有银弹,官方建议:用你自己的语言实测几个再拍板。
三个真实场景
📁 一批录音批量转录
十来个访谈或会议录音一次拖进去,任务排队依次处理,做完自动落盘。嘈杂环境或多人对话,勾选"转录前做语音分离"先把人声分离出来,准确率会明显更稳。
🎤 会议与讲座的实时转录
点麦克风按钮开始实时录音转录,文字边说边出。想翻回查一句原话,在转写查看器里搜关键词,直接跳到那一秒。对外授课或演讲时切到演示窗口,转写内容放大投给听众。
🎬 给视频做字幕
视频文件走同样的转录流程。完成后进查看器逐句校对:改错字、以 0.5 秒为步长调时间戳、按 2 倍速快进复查。内置的字幕调整功能能把每条字幕切到目标长度,并按标点重新切分,导出的 SRT / VTT 拿来即用。
实用技巧与常见问题
技巧:
- 在"初始提示"(Initial Prompt)里填入专业术语和人名,专名拼错率明显下降
- 手动指定语言,别依赖自动检测,官方文档明确这样质量更好
- 长音频、嘈杂录音先勾选语音分离再转录
- 开启文件夹监控,新录音丢进指定文件夹就自动开始转录
- 勾选字级时间戳,再用字幕调整工具按最大长度切分字幕
- 需要批量自动化时,命令行接口(
buzz add)可以直接跑脚本
高频问题:
转得慢怎么办?换 Tiny / Base 小模型,或换后端:Whisper.cpp 用集显甚至核显也能实时转录,NVIDIA 显卡可开 CUDA 加速,Mac 用 Apple Silicon 加速。
转出来出现原文没有的"幻觉"词句?Large-V3 偶尔会编造内容,换成 Large-V2 或 Turbo 试试。
完全没有网络能用吗?可以。在另一台有网的机器上下载好模型,把模型文件夹复制到离线机器的相同位置,Buzz 可完全脱机工作。
小语种:Whisper 系覆盖 99+ 种语言;Hugging Face 后端还能选 Meta 的 MMS 模型族,覆盖 1000+ 种语言。
收尾
Buzz 做的事很单纯:把本地离线转录装进一个开箱即用的桌面程序,录音不出门,转录不花订阅费。找一个敏感或难处理的文件,花几分钟跑一遍。
- 官方文档:docs/docs/
- 插件源码:buzz/plugins/
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考