Buzz 离线音频转录指南:本地 Whisper,三步把录音变成字幕

发布时间:2026/9/7 18:34:35
Buzz 离线音频转录指南:本地 Whisper,三步把录音变成字幕 Buzz 离线音频转录指南本地 Whisper三步把录音变成字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款跑在自己电脑上的离线音频转录工具底层是 OpenAI 开源的 Whisper 语音识别模型把会议录音、访谈音频在本地转成文字或字幕音频文件全程不上传到任何服务器。录音送在线服务转文字要付的三笔账把音频丢给在线转录服务流程并不复杂卡点在三处隐私会议录音、客户访谈要先传到别人家服务器敏感内容不敢发成本按分钟计费是常态一小时的录音反复试参数就是一笔开销效率不上传就得自己听、自己敲几小时的录音敲不动Buzz 把这些环节全砍掉Whisper 模型跑在本地转录不依赖网络文件不出机器。离线安装三步跑通第一次转录按平台三选一macOS 和 Windows 从 SourceForge 的 Buzz 项目页下载安装包Windows 未签名安装时弹警告点更多信息选仍要运行即可Linux 用 Flatpak 或 SnapPython 环境走 PyPI。pip install buzz-captions python -m buzzPyPI 方式需要 Python 3.12 环境和 ffmpeg。Linux 用 Flatpak 一条命令flatpak install flathub io.github.chidiwilliams.Buzz装完打开程序拖入音频或视频文件选好模型、语言和任务转录或翻译成英文开始转录。任务进队列处理完成后双击就能进入转录查看器。主界面转录任务队列里可以看到每个任务用的模型、语言和进行状态转录准确率怎么调模型和引擎各选其一Whisper 有 tiny、base、small、medium、large 五档模型规律固定越大越准也越慢越吃内存。第一次建议用 small 跑一遍对比效果和耗时再定。模型之外还有引擎可选Whisper.cpp 走 Vulkan 加速多数独立显卡和核显都能跑NVIDIA 显卡可用 CUDAMac 走 Apple Silicon 本地算力。模型首次使用要联网下载一次之后离线反复用不必每次下。模型偏好页管理 tiny 到 large 各档模型的下载和已下载列表 开会边说边出字麦克风实时转录选一个录音任务设好麦克风、语言和模型点 Record说的话会实时变成文字随新句子滚动修正。演示、发布会场景可以开演示窗口把实时字幕投到大屏上。长会议建议 Whisper.cpp 配小模型官方文档明确提示默认 Whisper 模型资源消耗较大。静默阈值、转录步长等进阶参数见实时录音文档。转录后处理切字幕、找说话人、导出文件转录完不是终点。查看器里能直接搜关键词、逐段播放、调播放速度校对转录查看器时间戳文本列表配播放控件逐段回听校对字幕用 Resize 功能切勾选词级时间戳转录后可按最大字幕长度重新切分、按标点断句还能延长每条字幕的停留时间。导出支持 TXT、SRT、VTT 三种格式。多人对话开说话人识别区分谁在说嘈杂录音开语音分离先分声音再转录准确率更高。插件目录里现成的有 AI 摘要、导出 docx把文件丢进监听文件夹可自动转录适合攒了一批素材要批量处理的场景。Resize 面板按最大长度和标点重新切分字幕片段先从哪一步试起有存量录音装好后用 small 模型跑一段 10 分钟以内的音频导出 SRT 看质量常开会对话把实时录音挂上麦克风试演示窗口的投屏字幕要自动化命令行一条命令批量转例如转一个 mp4 并直接出 SRTbuzz add --model-type whispercpp --model-size small --srt meeting.mp4完整参数见CLI 文档。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考