
Buzz离线语音转文字工具5 分钟装完就能用【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz周五下午手机里躺着一段 47 分钟的录音周五下午五点你刚结束 90 分钟的客户电话手机里多了一段 47 分钟的录音而对方晚上九点前要文字版。用云端语音转文字服务得把这段敏感录音上传到别人的服务器你更想要一个离线的方案在自己的电脑上把录音转成文字。Buzz 就是干这个的。Buzz 是什么离线语音转文字Buzz 是一款离线语音转文字工具基于 WhisperOpenAI 开源的语音识别模型所有识别都在你自己的电脑上跑。和直接上传到云端相比本质区别是你的录音文件从头到尾没有离开过你的硬盘断网也能转录。它不只是文件转文字除了转写音频和视频文件还支持翻译成英文、麦克风实时转录、给多人口播标记说话人输出 TXT、SRT、VTT 三种格式。全程免费。Buzz 安装步骤三步跑起来以 Windows 为例这是最快的路径从官方发布页Releases下载 Windows 安装包运行安装程序。应用未签名系统弹出未知发布者提示时点更多信息→仍要运行打开 Buzz点左上角或按 CtrlO选择文件选好音频语言和模型点 Run任务行状态变成 Completed 后双击该行打开转录结果第一次用要在选项里选一个模型Buzz 会自动下载模型文件最小的 tiny 模型只有几十 MB笔记本就能跑。macOS 下载 .dmg 拖进应用程序文件夹即可Linux 用 flatpak 一条命令装好。习惯 Python 的开发者也可以直接装pip install buzz-captions python -m buzz装完就能用。Buzz 实时转录、说话人识别与字幕合并 Buzz 实时录音转录怎么用它能做什么选好麦克风点 Record屏幕上就随你的说话实时长出文字。有三种模式——新句子追加在底部、顶部或者追加并纠正会回头修正上一句末尾的错认。还配一个展示窗口大字显示转录结果。具体怎么操作在 Live recording 界面选麦克风、语言和模型点 Record。实时场景建议选 tiny 或 base 这类小模型才能跟上说话速度文档明确建议用 Whisper.cpp 后端它在核显甚至纯 CPU 的笔记本上也能实时跑。什么时候会用到演讲和播客直播出字、会议实时上字幕、访谈时边聊边出初稿。Buzz 说话人识别怎么用它能做什么文件转录完成后自动把不同声音聚类每句话打上 Speaker 1、Speaker 2 之类的标签可以改成真名还能试听某位说话人 10 秒的随机语句来确认身份。具体怎么操作双击任务行进入转录查看器点Identify speakers按钮核对标签后保存勾选合并说话人句子后同一人连续说的话会并成一段。什么时候会用到双人或多人的访谈、客户电话、会议凡是需要区分谁说了什么的场合。Buzz 字幕太长怎么自动合并它能做什么默认转录的分段经常长到一行放不下Resize 功能可以把带词级时间戳的转录重新切成字幕长度的块——按静音间隙合并、按标点分割并限制单条字幕最大长度如果原始音频还在它会分析音频里的静音来校准时间轴。具体怎么操作导入文件时在选项里勾选 Word-Level Timings转录完成后点查看器里的Resize设好最大长度直接导出 SRT 或 VTT。什么时候会用到给视频做字幕导出后可以直接拖进剪辑软件。Buzz 批量转录从 3 段录音到字幕文件的一天说一个播客编辑的完整一天。早上九点他收到 3 段采访录音。他把文件夹设为 Buzz 的监视目录——文件夹监视功能会在检测到新音频文件落盘时自动开始转录结果按设定保存到输出位置。三个任务在队列里并行跑他去做了杯咖啡。十点第一段转完。这段是双人对谈他打开查看器跑了一次说话人识别把标签改成主播和嘉宾导出 TXT 给文案同学改稿。另外两段要剪成视频导入时他勾了 Word-Level Timings转完用字幕合并把单条长度压到 18 字以内导出 SRT直接丢进剪辑软件。中午3 段录音变成 1 份文字稿加 2 份字幕文件全程录音没有离开过他的电脑。Buzz 常见问题转录慢、错字多、没网转录跑了 20 分钟才出一半症状47 分钟的音频跑了半小时还没完。 原因模型选大了或者纯 CPU 在硬扛没用到 GPU 加速。 解决模型类型换成 Whisper.cppC 实现Nvidia、核显、纯 CPU 都能用配更小的模型有 6GB 以上显存的 Nvidia 显卡可以直接用 Faster Whisper速度快一个量级。识别结果里专有名词全是错别字症状产品名、人名被转成形近的词。 原因模型对没见过的词只能猜自动检测语言也可能带偏。 解决导入选项里点Advanced…在 Initial prompt初始提示里把容易错的词写进去语言手动选准别依赖自动检测。完全断网的电脑也能用 Buzz 吗症状目标电脑没有网络而模型首次要用时要下载。 解决在有网的电脑上打开 帮助 → Preferences → Models把要用的模型下好点显示文件位置打开模型目录整个拷到离线电脑相同位置Linux 在家目录的 .cache/Buzz 下Buzz 照常离线工作。谁适合用 Buzz下一步做什么录音内容敏感、经常离线工作、或要批量处理音频的人Buzz 能帮你省下上传和等待的麻烦只是偶尔转一段公开视频云端服务更省事。下一步去官方发布页拉一个对应系统的安装包把你的第一段录音丢进去试试。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考