Buzz 完全指南:如何用本地 Whisper 实现离线音频转录

发布时间:2026/9/7 10:07:40
Buzz 完全指南:如何用本地 Whisper 实现离线音频转录 Buzz 完全指南如何用本地 Whisper 实现离线音频转录【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款免费开源的桌面应用基于 OpenAI Whisper 模型在个人电脑上完成音频的离线转录与翻译无需把文件上传云端适合处理会议、访谈等对隐私敏感的音频内容。 适合谁用Buzz 适合四类用户制作播客与课程的内容创作者、整理访谈素材的记者与研究员、需要处理敏感录音的办公人员以及想用外语材料做听写练习的学习者。它解决的痛点很直接——云端转录服务需要上传音频、依赖网络并按量收费而 Buzz 全程在本地运行免费且可离线使用。 安装与首次运行三大平台都有现成渠道macOS 下载 .dmg 安装包Windows 下载安装程序应用未签名安装时选择更多信息→仍要运行Linux 推荐 Flatpakflatpak install flathub io.github.chidiwilliams.Buzz也可以用 PyPI 安装需要 Python 3.12 与环境中的 ffmpegpip install buzz-captions python -m buzz首次运行步骤启动 Buzz在偏好设置→模型中确认所需 Whisper 模型并等待其下载完成模型保存在本地缓存目录。点击工具栏或文件→导入媒体文件选择音频或视频文件。选择任务转录或翻译成英文、源语言与模型大小。点击 Run等待状态变为 Completed。双击任务行打开转录查看器检查文本并导出结果。 功能详解从音频文件到字幕导出导入支持 MP3、WAV、FLAC 等常见音视频格式也接受视频链接导入后自动提取音轨。配置转录前可指定任务、语言与模型官方建议手动选择源语言而非自动检测准确率更稳生僻人名可写进高级选项的 Initial prompt 里。运行提供 Whisper、Whisper.cpp、Faster Whisper、Hugging Face 等后端NVIDIA GPU 走 CUDA 加速其他显卡可用 Whisper.cpp 的 Vulkan 路径相关实现集中在 buzz/transcriber/。后处理查看器支持逐段编辑、全文搜索、变速播放与段落循环可运行说话人识别并给每段标注发言人开启词级时间戳后还能用 Resize 工具把碎词合并成字幕段。导出一键导出 TXT、SRT、VTT导出文件名支持按源文件名、任务、日期等变量自定义。 场景演练访谈整理把一小时的访谈录音导入并转录打开查看器用识别说话人把问答双方分开再把自动生成的标签改成两位受访者的真实姓名最后导出 TXT 校对成文字稿发言人归属一目了然。播客后期一期播客成稿后先转录全文在查看器里按时间戳定位到想强调的片段把关键词句摘抄进节目简介再导出 SRT 作为章节字幕供发布平台使用。课程复盘把网课录音转录并勾选词级时间戳用 Resize 按标点与最大长度把碎段合并成可读的句子再配合 AI 翻译功能得到目标语言版本方便整理成双语笔记。⚙️ 优化与进阶技巧按需选模型在偏好设置→模型中管理模型赶时间用 tiny 或 base追求准确用 large-v3 或 turbo6GB 显存以上的 NVIDIA 显卡可启用 Faster Whisper。调整线程Whisper.cpp 默认使用一半 CPU 核心设置环境变量BUZZ_WHISPERCPP_N_THREADS例如设为 8可在部分机型上进一步提速。批量与自动化命令行接口支持脚本化处理例如buzz add -t transcribe -m whispercpp -s small -l zh --srt interview.mp4完整参数见 docs/docs/cli.md 与源码 buzz/cli.py。纯离线环境在有网机器上下载好模型后把模型目录拷贝到离线机器的同一位置即可也可用 scripts/download-models.py 预先准备模型缓存。与传统方式的区别对比项云端转录服务Buzz音频是否上传需要不需要全程本地网络依赖必须在线离线可用费用按量订阅免费开源此外Buzz 允许在多个本地模型之间自由切换以在速度和准确率之间自行权衡而云端服务通常只能按固定档位付费。❓ 常见问题Q转录太慢怎么办A换更小的模型tiny 或 base或改用 Whisper.cpp 后端有 6GB 以上显存的 NVIDIA 显卡可启用 Faster Whisper。Q语言识别不准、专有名词总是写错A导入时手动指定源语言并在高级选项的 Initial prompt 中填入人名、术语嘈杂音频可开启提取语音先把人声分离出来再转录。QWindows 下提示无法访问麦克风PaErrorCode-9999A到系统设置的隐私→麦克风中给 Buzz 授权或临时关闭拦截的杀毒软件后重试。行动清单按上文命令安装 Buzz 并启动导入一段短音频选 tiny 模型跑通第一个离线转录任务再尝试说话人识别、Resize 合并与 SRT 导出。更多细节可查阅项目内的官方文档 docs/docs/涵盖安装、偏好设置、实时录音与命令行用法。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考