Buzz 离线音频转录工具:本地录音 3 分钟转成可编辑字幕
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
你有一段 40 分钟的访谈录音,明天要交稿。云端转录要上传文件、按分钟收费。Buzz 是开源的离线音频转录工具,基于 Whisper 模型跑在你电脑上,把音频转成带时间戳的文字和字幕,全程不上传、不联网。
分平台安装 Buzz 与第一次转录
装哪份取决于你的系统。命令行能装的就用命令行,其余走安装包。
# Linux(Flatpak) flatpak install flathub io.github.chidiwilliams.Buzz # Linux(Snap) sudo snap install buzz # 从 PyPI 装(先装好 ffmpeg,推荐 Python 3.12) pip install buzz-captions python -m buzzmacOS 和 Windows 从 官方发布页文档 下载对应安装包;Windows 未签名,安装时选"更多信息 → 仍然运行"。
第一次转录按这个顺序走:
- 打开 Buzz,点工具栏的"+",选一段音频或视频文件,也可以粘贴一个网页地址。
- 在该行的"模型"列挑一个模型(默认 Whisper),"任务"列选 Transcribe(转写)或 Translate(翻译)。
- 点"Transcribe"按钮,"Status"列会实时更新进度和已耗时。
- 转完双击这一行,打开转录查看器,能搜索、点时间戳播放、导出。
主界面用一张任务表管住所有文件,状态列实时报进度。
Buzz 的四个核心功能:能帮你做什么
文件与链接转录——本地音视频一次转完
把 MP3、WAV、MP4 拖进去,Buzz 自动抽出音轨转文字,也接受一个网页地址直接下载后转。转写、翻译两种任务都能选,一批文件排队跑,不用逐个盯。
实时麦克风转录——边开会边出带时间戳的文字
打开录音窗口(Ctrl+R),Buzz 从麦克风边听边写,新句子按你选的模式排好。散会直接带走一份带时间戳的纪要,省掉事后补记。
多语言翻译——99 种语言本地处理
选 Translate 任务,Buzz 先把外语转写再翻成目标语言。语言列表覆盖中英日等 99 种,全在本机跑,文字不出电脑。
字幕编辑与导出——TXT、SRT、VTT 一键生成
转录查看器里能全文搜索、点时间戳跳转、调播放速度。改完导出成 TXT、SRT 或 VTT,直接给剪辑软件用。
每行带开始、结束时间戳,点一下就把播放头跳到对应位置。
模型选择与字幕重排怎么配
这是 Buzz 和普通转写工具拉开差距的两处,配置都在 偏好(Ctrl+,)里。
后端与模型。Buzz 内置四个后端:Whisper、Whisper.cpp、Faster Whisper、Hugging Face。在 偏好 > 模型 里能下载和删除模型,Whisper.cpp 还能填一个.bin地址装自定义模型。关键看两条:一是模型大小,tiny、base 转得快但准度低,medium、large 更准也更吃内存,Whisper.cpp 支持量化版(如 q5)省显存;二是加速路径,N 卡走 CUDA、Mac 走 Apple Silicon、多数显卡含核显靠 Whisper.cpp 的 Vulkan。显存小就选量化版,或设BUZZ_FORCE_CPU=true强制走 CPU。
模型面板把已下载和可下载的规格都列出来,自定义模型直接贴地址下载。
字幕重排。目标是把一句过长的字幕切成屏幕上放得下的长度。操作路径:在转录查看器点 Resize,设目标长度(例如 42 字符)、按间隙合并(0.2 秒)、按标点断开,点 Merge。可量化结果:原来 90 字符的一行拆成两行、每行不超过 42,导出 SRT 后不再溢出屏幕。参数见 偏好文档 的字幕重排一节。
目标长度、按间隙合并、按标点断开三个旋钮,控制字幕最终切成多长。
按设备性能选模型与省时间技巧
先按硬件定模型,再抠细节:
- 只有 CPU 或老显卡:Whisper 的 tiny、base,或 Whisper.cpp 量化版,优先求快。
- 有 N 卡:Whisper.cpp 加 CUDA,或 Faster Whisper,选 medium、large 求准。
- Mac:Apple Silicon 直接跑,显存紧就选量化版。
三条省时间的设置。快捷键把常用动作挪到键盘上:Ctrl+O 导入、Ctrl+F 搜索、Ctrl+P 播放/暂停,改字幕用 Ctrl+左右箭头 微调起止时间。批量处理开 偏好 的 Folder Watch:设好输入、输出目录,往输入目录丢文件就自动转,还能勾上转完删源文件。调线程:16 线程的机器把BUZZ_WHISPERCPP_N_THREADS设成 8,实测比默认快约 15%,再拉高反而变慢。
Buzz 与云端转录的差别
挑几个你在意的维度对比:
- 数据去向:Buzz 全程在本机,音频和文字不出电脑;云端要先传文件上去。
- 联网:Buzz 断网照样转;云端必须在线。
- 费用:Buzz 开源免费;云端一般按分钟或订阅收钱。
- 可控性:Buzz 能换模型、换后端、装插件;云端参数基本锁死。
- 覆盖:Buzz 支持 Whisper 的 99 种语言和本地常见音视频格式;云端常有格式或语言限制。
常见问题解答
转得很慢,怎么提速?第一步换成更小的模型,比如 base 或 tiny。第二步确认走对加速路径,N 卡开 CUDA。第三步把BUZZ_WHISPERCPP_N_THREADS按一半核心数设,别拉太高。
怎么让结果更准?第一步换更大的模型,比如 medium 或 large。第二步尽量在安静环境录音。第三步多人对话时先做语音分离,把人声拆干净再转。
支持哪些语言?Whisper 一套模型覆盖 99 种,含中文、英文、日文、韩文、西班牙文等。完整列表在 偏好 的语言下拉里能看到,留空则自动识别。
能批量转一堆文件吗?第一步在 偏好 打开 Folder Watch。第二步设好输入目录、输出目录。第三步把文件丢进输入目录,Buzz 自动转并把结果放进输出目录。
三步跑起来
- 按你的系统装好 Buzz,跑通一段自己的短录音。
- 在 偏好 里按硬件选模型,顺手记熟几个常用快捷键。
- 需要批量就开 Folder Watch,日常转写交给它。
更多用法见 docs/docs/index.md,插件在 plugins/,脚本化用 buzz/cli.py。装好之后从一段短录音开始,跑通了再谈提速。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考