
本地语音转文字实用教程5 分钟跑通 Buzz 离线转录与调优避坑【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz每次把会议录音丢给云端转写服务都绕不开两个问题内容被别人看到费用按分钟算。Buzz 是一个本地语音转文字工具基于 OpenAI Whisper音频转录和翻译全部在你自己的电脑上完成录音不用出机器。它和云端 API 的区别说白了就是免费、离线代价是吃你的算力。所以这篇文章不急着教你装先帮你判断这台机器、这个场景到底适不适合跑它。 先想清楚你的机器和场景适不适合 Buzz硬件上有两个硬门槛CPU 需要支持 AVX2。很老的电脑会直接起不来这是 Buzz 的明确限制。有 NVIDIA 显卡显存 6GB 以上体验最好可以跑 Faster Whisper 这类 GPU 加速后端没有独显、用 Mac 或核显也没关系走 Whisper.cpp 后端CPU 上也能实时转录。场景上分两类。适合会议录音整理、给视频做字幕、播客转文字、以及音频根本不能上云的敏感场合。不太适合对实时延迟要求极苛刻的直播场景实时录音有几秒到几十秒的延迟或者一次要批量处理几百小时音频、只想图个省事——那种情况云端服务可能更划算。如果你机器不旧、场景是上面这些就可以往下走了。 最短路径3 步装好并跑通第一条转录安装按系统挑一条macOS下载 dmg 安装包拖进应用程序文件夹。Windows下载安装文件运行程序未签名弹窗时选更多信息→仍要运行。Linux 或开发者Flatpak 或 pip 二选一flatpak install flathub io.github.chidiwilliams.Buzzpip install buzz-captions python -m buzzpip 方式需要 Python 3.12 环境并且系统里先装好 ffmpeg。跑通第一条转录就三步点工具栏或 Ctrl/CmdO导入一个短音频视频 → 选任务转录或翻译成英文、手动指定语言官方建议别用自动检测容易翻车、选模型 → 点 Run状态变成 Completed 后双击那行打开结果。⚙️ 模型大小与后端怎么选不白装不白跑新手最容易在这一步乱选。后端看硬件你的硬件推荐后端说明NVIDIA 显卡显存 ≥ 6GBFaster Whisper速度最快吃 GPU无独显 / Mac / 核显Whisper.cpp支持 Vulkan 加速纯 CPU 也能实时想用特定社区模型Hugging Face支持的模型种类最多模型大小看用途5 档从上到下速度递减、准确率递增模型速度适用场景tiny最快实时录音预览base快日常会议记录small中等多数场景的平衡之选medium慢播客、重要材料large最慢追求最高准确率、有强 GPU官方 FAQ 的观点很实在没有最好的模型只有在你的语言上测出来最合适的模型。实时录音场景建议直接用 Whisper.cpp 配小模型别用默认 Whisper 后端硬扛。这些都在帮助 → 首选项 → Models里设置还能看到模型缓存位置和自定义模型地址。✂️ 转录之后编辑、字幕调整与导出双击转录列表里的行打开的是转录查看器带搜索和播放控制双击时间戳能直接跳到音频对应位置文本可以原地改。如果你生成时勾了单词级时间戳转录页的 Resize 按钮还能重排字幕按标点分割长句、限制单条字幕最大长度、把每条字幕的停留时间往后延长几秒。没勾单词级时间戳的话只能按最大长度重合并。导出支持 TXT、SRT、VTT 三种格式SRT 基本能直接喂给所有剪辑软件。多人对话的录音还可以用说话人识别功能区分发言人。 批量与自动化文件夹监控和 CLI 各讲一个文件多的时候一个个导入太蠢Buzz 有两个现成方案。第一个是文件夹监控在首选项里配置一个监听目录新放进来的音频文件会被自动转录适合随手往一个文件夹扔录音的工作流。第二个是命令行适合写进脚本。最小可用的命令长这样一次可传多个文件buzz add --model-type whispercpp --model-size small -l zh --srt --txt input.mp3--task translate可以改成直接翻译成英文-w开启单词级时间戳完整参数见 官方 CLI 文档。 3 个常见翻车点与排查方法症状转录速度慢得没法用原因模型选大了或者你以为在走 GPU 其实还是 CPU。解决先降到 base 或 small 模型再按上文的硬件对照表换后端——NVIDIA 卡确认加速真的生效没有独显就切 Whisper.cpp别用原始 Whisper 后端。更多排查思路看 官方 FAQ。症状实时录音报错 PaErrorCode-9999原因系统没给麦克风权限或者杀毒软件拦了访问。解决去系统的隐私设置里给 Buzz 开麦克风权限Windows 在 设置 → 隐私 → 麦克风必要时临时禁用杀毒软件再试。症状下载完模型转录就闪退原因模型文件没下完或损坏。解决进帮助 → 首选项 → Models删掉对应模型文件重新下载一次。✅ 5 分钟上手清单按系统装好 Buzz确认主界面能打开导入一个短音频手动指定语言用 Whisper.cpp small 模型跑通一次转录双击结果检查纠错导出 SRT 或 TXT 存一份打开帮助 → 首选项 → Models按硬件把后端和模型大小定下来别再乱选有批量需求时开一个监听文件夹或把buzz add写进脚本【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考