Buzz完整指南:5分钟跑通本地离线语音转文字,录音到SRT字幕一步到位

发布时间:2026/9/6 16:31:31
Buzz完整指南:5分钟跑通本地离线语音转文字,录音到SRT字幕一步到位 Buzz完整指南5分钟跑通本地离线语音转文字录音到SRT字幕一步到位【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz你有没有过这样的经历把一段采访录音发给云端转录服务之后反复担心它被拿去训练或外泄开完40分钟的会还要逐句听回音、手动敲纪要Buzz是基于OpenAI Whisper的桌面工具主打离线语音转文字——所有音频留在你自己的电脑里处理直接给你带时间戳的文本和字幕。不用注册、不用上传装完就能用。手工敲字幕和云端转录到底卡在哪几个真实的场景看看是不是你的日常视频创作者剪片子40分钟的vlog要配字幕只能一边倒带一边手敲台词、对时间轴一个下午就耗在字幕上HR或法务整理访谈录音里涉及候选人薪酬、当事人陈述发给第三方在线平台心里不踏实但逐字听写又太慢记者批量处理外访录音一次出差回来十几条录音按分钟计费的云端服务成本高而且每个文件都要手动上传、下载做分享、发布会需要即时文字在线转录工具要么要联网上传要么延迟大很难撑住现场这些麻烦的共同点不在能不能转而在音频必须离开你的设备或你必须手动干最脏的活。Buzz的思路是把这两件事同时干掉。本地处理给你带来什么音频不落地到任何服务器转录在你的CPU或GPU上完成唯一需要联网的环节是首次下载模型转录和翻译二合一同一个任务里既能转写成原文也能翻译成目标语言不用来回切工具字幕直接交付导出SRT、VTT、TXT三种格式字幕文件拿到视频软件里就能用批量与自动化多文件排队处理还可以开启文件夹监视新录音落盘即自动转录可扩展插件系统提供AI摘要、降噪、文档导出等能力不用改代码就能叠加Buzz功能全景输入、处理、输出三层看输入端——素材怎么进来本地音频/视频文件MP3、WAV、FLAC、M4A、MP4、MKV等视频会自动提取音轨网络链接直接粘贴YouTube等URL导入麦克风实时录音支持现场活动用的演示窗口把实时文字投到另一块屏上处理端——引擎怎么选多个Whisper后端Whisper、Whisper.cpp、Faster Whisper、Hugging Face模型以及OpenAI Whisper API硬件加速Nvidia GPU走CUDA多数独立/核显GPU走VulkanMac用Apple Silicon原生跑语音分离转录前先把人声从背景噪声里抽出来嘈杂录音的准确率明显受益说话人识别在转录结果里自动区分不同说话人对话结构一目了然输出端——结果怎么出去导出TXT、SRT、VTT插件还能加DOCX转录查看器逐段编辑、搜索、播放控制、倍速调节字幕调整工具按间隙合并、按标点切分控制每条字幕的时长安装与首次运行每个平台3步以内Windows与macOS到SourceForge的buzz-captions下载页拿对应安装包Windows是exemacOS是dmgWindows因应用未签名会弹警告点更多信息→仍要运行即可打开应用首次使用时下载一个模型之后彻底离线Linuxflatpak install flathub io.github.chidiwilliams.Buzz或者用Snapsudo snap install buzzPython环境安装适合开发者先装好ffmpeg用Python 3.12环境然后pip install buzz-captions python -m buzz命令行首跑Buzz自带CLI一条命令就能完成转录导出SRTbuzz add -m whispercpp -s small --srt --vtt ~/Downloads/meeting.mp4常用参数-t选任务transcribe/translate、-m选后端、-s选模型大小、-l指定语言、--txt/--srt/--vtt选导出格式。不指定语言时会自动检测。界面走查四个关键位置任务管理主界面把音频或视频拖进来即可加入转录队列也可以粘贴URL每个任务一行状态、所用模型、进度一目了然支持多任务并行排队长音频和大文件互不阻塞顶部工具栏覆盖导入、实时录音等高频操作转录查看器文本按片段逐段展示带时间戳点击即可跳到对应音频位置支持全文搜索、播放控制和倍速调节每段文字可直接编辑改完即保存导出菜单在这里TXT、SRT、VTT按格式选偏好设置与模型管理常规页可配API密钥、Base URL以及默认导出文件名模板模板支持变量比如按输入文件名、任务、日期自动拼出导出名实时转录有三种模式追加在下方、追加在上方、追加并纠错在这里下载新模型、删除用不上的旧模型不同后端Whisper、Whisper.cpp等的模型分开管理磁盘空间紧张时优先清理不用的大模型字幕调整工具针对导出的SRT/VTT做二次整形不用重跑转录可按音频间隙合并过短的片段可按标点切分过长的字幕设置期望的每条字幕时长自动对齐格式源码地图五个核心模块转录引擎目录buzz/transcriber/ —— 文件转录、实时录音、Whisper.cpp、API等各类引擎实现转录查看器buzz/widgets/transcription_viewer/ —— 查看、编辑、导出、说话人识别等界面组件实时录音界面buzz/widgets/recording_transcriber_widget.py —— 麦克风采集与实时转录的UI逻辑文件夹监视buzz/widgets/transcription_task_folder_watcher.py —— 监听目录并自动为新文件建转录任务命令行入口buzz/cli.py ——buzz add命令的参数解析与任务创建插件相关逻辑集中在buzz/plugins/每个插件一个目录写处理逻辑后由加载器注册进系统。实战场景三种角色各走一条工作流视频创作者出字幕拖入成片MP4选Whisper.cpp small模型勾选SRT导出任务完成后拿到字幕文件字幕直接导入剪辑软件再用调整工具修整时长——一个下午的字幕活缩到一杯咖啡记者现场整理采访开启实时录音转录打开演示窗口投屏采访进行中就能看到文字稿雏形漏问的问题当场补结束后导出TXT进入编辑环节企业自动处理会议录音配置文件夹监视指向会议录音归档目录配好默认导出文件名模板录音一落盘就自动出文字纪要会后不用人催进阶调优模型怎么选、参数怎么加模型大小对照相对概念非精确指标模型体积速度准确率适合场景tiny最小最快基础实时转录、低配设备base较小快良好日常批量处理small/medium中等中等良好到优秀正式稿件、访谈整理large最大慢最佳关键会议、对准确率敏感的内容常用进阶参数-w生成词级时间戳做逐字对齐时用-e转录前做语音分离噪声大的录音建议加上-p给初始提示把专有名词、术语提前告诉模型-l zh手动指定语言比自动检测更稳显存紧张时选Whisper.cpp后端开Vulkan或勾选Reduce GPU RAM偏好常见问题支持哪些格式音频走ffmpegMP3、WAV、FLAC、M4A、OGG等都行视频如MP4、AVI、MOV、MKV会自动抽音轨。必须联网吗转录本身完全离线。只有首次下载模型以及用OpenAI API后端做翻译时需要网络。能转中文吗可以。语言列表覆盖百余种含普通话-l zh即可指定。实时转录够快吗官方提示该功能比较吃资源可能达不到严格意义的实时建议用较小的模型并留意硬件配置。能写进脚本吗能。CLI就是为自动化设计的buzz add ... --hide-gui可以隐藏主窗口纯后台跑。下一步做什么Buzz把音频出设备这个最大的顾虑拿掉了剩下的只是把流程跑顺。按下面四步走今天就能用起来按你的系统装好Buzz下载一个base或small模型挑一段真实录音跑通导入→转录→导出SRT全流程打开偏好设置配好默认导出文件名模板和模型目录开一个归档目录试跑文件夹监视让新录音自动转成文字稿【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考