news 2026/9/6 23:43:20

Buzz 本地语音转文字:三步跑通离线音频转录,录音不用出电脑

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Buzz 本地语音转文字:三步跑通离线音频转录,录音不用出电脑

Buzz 本地语音转文字:三步跑通离线音频转录,录音不用出电脑

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

开完会把录音丢给在线转写服务,心里总不踏实——录音里有客户名、合同细节、内部观点,传上去就不在自己手里了。在线工具还按时长计费,高峰期要排队。Buzz 就是把这个活儿搬回本地的:这篇 Buzz 使用教程面向第一次本地语音转文字的你,全程只用到自己的电脑。

Buzz 是什么:装在自己电脑上的本地转写服务

Buzz 是个桌面应用:把音频丢进去,它调用 OpenAI 的 Whisper(开源语音转文字模型,不是云端接口)在你本机完成识别。声音不出硬盘,这就是音频转文字不上传——不注册账号、断网能用、不收时长费。对接触客户通话、合同录音、内部会议的人来说,这是"放心"和"提心吊胆"的区别。

从零到第一次转出文字:三步

第 1 步,安装。最省事的路径是走 PyPI(Python 的官方包仓库)装好再启动:

pip install buzz-captions python -m buzz

需要 Python 3.12,并提前装好 ffmpeg(处理音视频的命令行工具)。Windows 和 Mac 用户也可以直接下载官方安装包,Windows 版没有签名,系统报警告时点"更多信息"→"仍要运行"即可;Linux 一行命令:flatpak install flathub io.github.chidiwilliams.Buzz。想尝鲜最新版,先克隆仓库:

git clone https://gitcode.com/GitHub_Trending/buz/buzz

再按仓库内文档构建;求稳用 PyPI 版即可。

第 2 步,选模型。首次转录时 Buzz 会自动下载模型(一个几十 MB 的语音识别文件),不用手动摆弄。这是最省心的 Whisper 本地部署:在偏好设置 → Models 里选 Whisper.cpp 后端(用 C++ 优化的 Whisper,普通 CPU 就能跑,也兼容多数显卡)+ tiny 模型。

第 3 步,转第一段音频。点"+"选个音频文件,开始。第一次慢,模型在预热,很正常,第二次就快了。

熟悉之后也可以不进图形界面,直接一条命令跑完:

buzz add -m whispercpp -s small -l zh --srt meeting.mp3

-s是模型大小,--srt输出字幕文件,完整参数见 docs/docs/cli.md。

先上手:三个常见情境

两小时访谈:长音频,准确率优先

  1. 导入录音文件(拖进主窗口即可),语言选"自动检测"或中文。
  2. 模型别再用 tiny:换 whispercpp + medium。tiny 转 30 秒语音备忘够用,两小时访谈就糙了。
  3. 让它跑。两小时的音频,普通笔记本也要一段时间——去倒杯水回来。
  4. 完成后双击打开转录编辑器:边播放边校对,Buzz 还支持说话人识别,能把访谈里你问我答的两方分开标注。
  5. 校订关键引用,导出 TXT 收工。

播客剪字幕:SRT 直接进剪辑软件

  1. 导入播客成片,whispercpp + base 模型就够——播客收音干净,base 的准确率足够。
  2. 转完先别逐字校对,把字幕导出来再说。
  3. 导出 SRT(Buzz 原生支持 TXT / SRT / VTT 三种格式)。
  4. 导出的行往往太长:打开转录,用 Resize 功能把每行最大字数设成 40 左右,它会按新长度重排时间轴。
  5. SRT 拖进剪辑软件,完事。

临时会议纪要:边说边录

  1. 会前打开 Buzz,点红色录音按钮🔴,看电平表动了没有,动了就是麦克风正常。
  2. 开会时 Buzz 实时转录,需要投给别人看就切到演示窗口,大字显示。
  3. 散会停止,校一遍关键数字和决定,复制进纪要。

比事后回听快,录音文件同样留在本地,随时可以重转。

容易卡住的点

  • 转得慢:换小一号的模型,或把后端切到 Whisper.cpp;N 卡显存 6GB 以上可以试 faster-whisper(优化版,N 卡上快很多)。
  • 首次启动慢:模型是第一次用到才下载,缓存在本地(Linux 在~/.cache/Buzz)。完全断网的机器,先在别的电脑下好模型再整个复制 models 文件夹过去,仓库里的 scripts/download-models.py 就是干这个的。
  • 麦克风报 9999 错误:多半是系统权限,Windows 去 设置 → 隐私 → 麦克风 里把 Buzz 打开。
  • 闪退或转出来乱码:模型文件损坏了,偏好设置 → Models 里删掉重下。
  • 老电脑:Buzz 需要 CPU 支持 AVX2 指令集(近十年基本都有),再老的机器可能直接跑不起来。
  • 新文件想自动转:偏好设置里开 Folder Watch(文件夹监视),丢进指定目录的音频会自动开始转录,适合每天收一堆访谈录音的人。

录音留在自己电脑里,文字照样交差。

【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/6 23:36:05

从“什么型号好”到“怎么选型”:一套可复用的硬件与模型决策法

如果你也在某个技术群、论坛或同事闲聊里问过一句话——“这个到底买什么型号好?”,那这篇文章就是给你写的。先给一个判断:“什么型号才算好”本质上是一道错题。不同人问这句话时,脑子里装的场景完全不一样。有人是给家里的旧电…

作者头像 李华
网站建设 2026/9/6 23:35:41

论文降重服务避坑指南:从风险识别到可控流程的完整方案

引言 毕业论文写作中,降重与文本改写服务常被视为"救命稻草"。然而,选择不当可能引发连锁问题,轻则返工重改,重则影响查重结果与论文质量。本文将从风险信号、成因分析、核对方法、风险控制到流程搭建,系统…

作者头像 李华
网站建设 2026/9/6 23:35:17

四轴后处理报错?先别改后处理,编程路径才是排查核心

PowerMill群里每隔几天就会有人发一张四轴输出后处理报错的截图,抱怨后处理不行。说实话,我早期也犯过这个错,把责任全推给后处理文件,重装、替换、找人改,折腾一晚上,最后发现是编程路径里一个很小但很关键…

作者头像 李华
网站建设 2026/9/6 23:32:32

Verity数据验证框架:从规则引擎到自动化数据质量监控

在数据平台和微服务架构里,一个经常被忽视但又绕不开的问题是:数据到底对不对。开发时看接口返回觉得没问题,测试环境数据量小也发现不了异常,等上了生产,业务方拿着报表问为什么对不上数,这个时候才意识到…

作者头像 李华
网站建设 2026/9/6 23:32:25

PowerMill四轴后处理报错:从编程路径到后处理配置的定位指南

四轴输出后处理报错,很多编程人员和操作师傅第一反应就是“后处理文件写错了”。但实际排查下来,有相当比例的问题根源在编程路径侧:刀轴矢量变化太剧烈、旋转轴行程超限、曲线公差不合理、坐标输出方式不匹配,这些都会让后处理在…

作者头像 李华