Buzz 离线音频转文字:两小时访谈录音怎么变成文字稿

发布时间:2026/9/7 15:47:07
Buzz 离线音频转文字:两小时访谈录音怎么变成文字稿 Buzz 离线音频转文字两小时访谈录音怎么变成文字稿【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz周五下午四点你刚录完一场两小时的访谈对方周一就要文字稿。把音频传到某个在线服务你不太放心自己听写又不现实。Buzz 就是冲着这种场景来的它是一款基于 OpenAI Whisper一组语音识别模型的离线转录工具所有转写处理都在你电脑上完成音频文件不出本机没网的环境一样能用。它对文件格式也不太挑剔MP3、WAV、FLAC、MP4 这些音频视频直接丢进去就行转出来的结果还能翻译成其他语言。️ 安装 Buzz 并把音频喂进队列挑一种安装方式Windows 和 macOS 用户直接下载对应平台的安装包跟着向导点两下就装好了。Linux 上 Flatpak 和 Snap 都有在软件源里搜 Buzz 即可。习惯 Python 的跑两条命令pip install buzz-captions python -m buzz把音频丢进队列打开应用点工具栏的号挑选音频文件或者按 CtrlO。可以一次勾选多个文件Buzz 会把它们排进队列依次处理。左侧任务列表实时显示每个文件的进度转录跑着的时候你完全可以去做别的事。装好之后的第一件事就是把手头最急着出稿的材料丢进去让它先跑起来。 转录模型怎么选装好、喂完文件之后还剩一个判断用什么来转。点开始之前要先定三件事。语言知道录音是什么语言就直接指定自动检测偶尔会认错。任务Transcribe 产出原语言文字Translate 统一翻成英文处理外语材料时用得上。模型分三种标准 Whisper、速度更快的 Faster Whisper以及支持 GPU 加速的 Whisper.cpp。小模型跑得快大模型更准中模型是折中。录音干净小模型够用环境嘈杂或者内容重要就换大一号。在模型偏好设置里提前配好之后每个文件直接过就行不必每次都纠结一遍。 打开文字稿边听边改状态变成完成后双击这一行转录视图就开了。每行文字都带着起止时间戳下方播放控件可以来回拖动哪句听着不对就回到那一段重听。文字本身可以直接编辑CtrlF 能搜关键词。长录音建议开跟随音频文字会自动滚到正在播放的位置省得你满屏找。✂️ 调整字幕长度并导出 SRT如果目的是给视频配字幕这里还有一步点Resize设定每条字幕的最大字符数或勾选按标点符号切分Buzz 会把过短的字幕自动合并或拆开。导入时如果勾了词级时间戳它还会借助音频里的静音段来辅助断句。改到顺手之后在导出菜单里挑格式SRT、VTT 或者纯文本 TXT直接导出去用。想翻实现的话各种转录方式的逻辑在 buzz/transcriber/界面组件在 buzz/widgets/说话人分离这类额外能力则由 插件系统 提供。️ 麦克风点下去就是实时转录如果内容还没录那就更直接点工具栏的麦克风按钮选好话筒Buzz 边听边出文字会议记录、讲座笔记、现场字幕都适用。长时间实时转写建议挑小一点型号控制负载Buzz 还能再开一个演示窗口把实时字幕投到大屏上。如果你经常要处理访谈录音、会议音频或课程资料同时又不想把材料传到任何服务器上这套离线转文字的工具值得放进工具箱。今晚把 Buzz 装上丢一段录音进去文字稿趁热就能摆在桌上。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考