Buzz 本地语音转文字:三步跑通离线音频转录,录音不用出电脑
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
开完会把录音丢给在线转写服务,心里总不踏实——录音里有客户名、合同细节、内部观点,传上去就不在自己手里了。在线工具还按时长计费,高峰期要排队。Buzz 就是把这个活儿搬回本地的:这篇 Buzz 使用教程面向第一次本地语音转文字的你,全程只用到自己的电脑。
Buzz 是什么:装在自己电脑上的本地转写服务
Buzz 是个桌面应用:把音频丢进去,它调用 OpenAI 的 Whisper(开源语音转文字模型,不是云端接口)在你本机完成识别。声音不出硬盘,这就是音频转文字不上传——不注册账号、断网能用、不收时长费。对接触客户通话、合同录音、内部会议的人来说,这是"放心"和"提心吊胆"的区别。
从零到第一次转出文字:三步
第 1 步,安装。最省事的路径是走 PyPI(Python 的官方包仓库)装好再启动:
pip install buzz-captions python -m buzz需要 Python 3.12,并提前装好 ffmpeg(处理音视频的命令行工具)。Windows 和 Mac 用户也可以直接下载官方安装包,Windows 版没有签名,系统报警告时点"更多信息"→"仍要运行"即可;Linux 一行命令:flatpak install flathub io.github.chidiwilliams.Buzz。想尝鲜最新版,先克隆仓库:
git clone https://gitcode.com/GitHub_Trending/buz/buzz再按仓库内文档构建;求稳用 PyPI 版即可。
第 2 步,选模型。首次转录时 Buzz 会自动下载模型(一个几十 MB 的语音识别文件),不用手动摆弄。这是最省心的 Whisper 本地部署:在偏好设置 → Models 里选 Whisper.cpp 后端(用 C++ 优化的 Whisper,普通 CPU 就能跑,也兼容多数显卡)+ tiny 模型。
第 3 步,转第一段音频。点"+"选个音频文件,开始。第一次慢,模型在预热,很正常,第二次就快了。
熟悉之后也可以不进图形界面,直接一条命令跑完:
buzz add -m whispercpp -s small -l zh --srt meeting.mp3-s是模型大小,--srt输出字幕文件,完整参数见 docs/docs/cli.md。
先上手:三个常见情境
两小时访谈:长音频,准确率优先
- 导入录音文件(拖进主窗口即可),语言选"自动检测"或中文。
- 模型别再用 tiny:换 whispercpp + medium。tiny 转 30 秒语音备忘够用,两小时访谈就糙了。
- 让它跑。两小时的音频,普通笔记本也要一段时间——去倒杯水回来。
- 完成后双击打开转录编辑器:边播放边校对,Buzz 还支持说话人识别,能把访谈里你问我答的两方分开标注。
- 校订关键引用,导出 TXT 收工。
播客剪字幕:SRT 直接进剪辑软件
- 导入播客成片,whispercpp + base 模型就够——播客收音干净,base 的准确率足够。
- 转完先别逐字校对,把字幕导出来再说。
- 导出 SRT(Buzz 原生支持 TXT / SRT / VTT 三种格式)。
- 导出的行往往太长:打开转录,用 Resize 功能把每行最大字数设成 40 左右,它会按新长度重排时间轴。
- SRT 拖进剪辑软件,完事。
临时会议纪要:边说边录
- 会前打开 Buzz,点红色录音按钮🔴,看电平表动了没有,动了就是麦克风正常。
- 开会时 Buzz 实时转录,需要投给别人看就切到演示窗口,大字显示。
- 散会停止,校一遍关键数字和决定,复制进纪要。
比事后回听快,录音文件同样留在本地,随时可以重转。
容易卡住的点
- 转得慢:换小一号的模型,或把后端切到 Whisper.cpp;N 卡显存 6GB 以上可以试 faster-whisper(优化版,N 卡上快很多)。
- 首次启动慢:模型是第一次用到才下载,缓存在本地(Linux 在
~/.cache/Buzz)。完全断网的机器,先在别的电脑下好模型再整个复制 models 文件夹过去,仓库里的 scripts/download-models.py 就是干这个的。 - 麦克风报 9999 错误:多半是系统权限,Windows 去 设置 → 隐私 → 麦克风 里把 Buzz 打开。
- 闪退或转出来乱码:模型文件损坏了,偏好设置 → Models 里删掉重下。
- 老电脑:Buzz 需要 CPU 支持 AVX2 指令集(近十年基本都有),再老的机器可能直接跑不起来。
- 新文件想自动转:偏好设置里开 Folder Watch(文件夹监视),丢进指定目录的音频会自动开始转录,适合每天收一堆访谈录音的人。
录音留在自己电脑里,文字照样交差。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考