TMSpeech免费开源指南:Windows离线实时语音转文字工具,从摸鱼神器到会议纪要生成器

发布时间:2026/8/20 11:16:45
TMSpeech免费开源指南:Windows离线实时语音转文字工具,从摸鱼神器到会议纪要生成器 TMSpeech免费开源指南Windows离线实时语音转文字工具从摸鱼神器到会议纪要生成器【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech还在担心开会走神被突然点名还在为记不全老板讲的要点而焦虑或者上网课时老师语速飞快、手写笔记根本跟不上如果你曾经经历过这些手忙脚乱的瞬间那么今天介绍的这款Windows实时语音转文字工具——TMSpeech可能就是你的救星。它是一款完全免费、开源的离线语音识别软件能把电脑播放的任何声音实时转成文字字幕CPU占用不到5%你的对话内容全程留在本地隐私安全有保障。无论是会议记录、在线学习还是想看视频时顺便留下文字稿它都能轻松胜任。它到底是个什么样的工具一句话概括TMSpeech 是一个常驻屏幕的语音速记员。它通过 WASAPI 音频捕获技术监听电脑声音把语音实时转成文字像歌词字幕一样悬浮在屏幕上。开会、上课、看视频全程自动记录识别结果按日期自动存档随时可以回看。适合谁上班族、网课学生、直播主播、视频剪辑爱好者以及一切不想手动打字的人解决什么问题会议走神、笔记跟不上、回看找不到重点、担心语音上传云端泄露隐私它有多轻实测在 AMD 5800u 笔记本上 CPU 占用稳定在 5% 以下内存占用不到 500MB挂着它办公几乎无感三步完成离线安装最快一分钟上手第1步获取程序克隆项目仓库git clone https://gitcode.com/gh_mirrors/tm/TMSpeech然后在 Release 页面下载最新的安装包解压即可。第2步启动双击运行TMSpeech.exe程序会自动创建配置文件。顺手在桌面建个快捷方式以后用起来更方便。第3步首次识别打开主界面点击红色按钮开始识别屏幕上马上就会出现实时字幕就这么简单不用注册、不用联网三分钟就能跑起来。核心能力拆解按场景选配置TMSpeech 的强大之处在于识别器和音频源都可以自由组合按场景灵活切换。进入设置界面即可配置识别器三选一怎么选识别器类型适用场景性能特点推荐人群Sherpa-Onnx 离线识别器日常办公、会议记录CPU优化资源占用低普通用户默认首选Sherpa-Ncnn 离线识别器直播、追求速度可调用 GPU识别极快游戏主播、性能党命令行识别器集成任意外部引擎可接入 Whisper、云端API等开发者、技术爱好者音频源怎么选音频源类型捕获什么声音典型场景系统音频电脑播放的全部声音会议软件、视频、网课麦克风你的说话声个人录音、口述进程音频指定程序的输出只想录某个应用的声音进程音频有个妙用开会时只捕获腾讯会议这一个进程的声音其他软件的提示音完全不会干扰识别背景干净、准确率更高。相关实现可以在src/Plugins/TMSpeech.AudioSource.Windows/目录下查看。一次完整演练从开会到自动生成会议纪要假设你正在开一场腾讯会议我们走一遍完整流程第1步装模型打开设置 → 资源页面看到中文、英文、中英双语三种模型点击安装按钮等待下载完成模型存储位置内置资源在[应用目录]/plugins/用户安装的资源在%AppData%/TMSpeech/plugins/后者可以放心删除。第2步选识别器与音频源推荐配置识别器选Sherpa-Onnx 离线识别器音频源选系统音频或进程音频采样率保持默认的 16kHz 即可。第3步开启识别点击红色按钮字幕开始实时滚动。右下角的计时器会记录本次会话时长红色即代表正在识别中。第4步会后复盘识别结果会自动按日期保存到我的文档/TMSpeechLogs文件夹再也不用对着录音一笔一笔地听写。想看某句话打开历史记录窗口右键即可复制或全选一段会议开完会议纪要初稿已经躺在文档里了剩下的只是简单整理。这就是一键生成会议纪要的完整链路。进阶玩法让工具更懂你个性化字幕样式字幕窗口支持无边框悬浮、任意拖动和缩放。在设置里你可以自由调整字号、字体、颜色、阴影、背景甚至做成半透明字幕条叠在视频上观感几乎和视频网站的歌词字幕一样。锁定按钮可以防止误触拖动识别运行中字幕纹丝不动。敏感词提醒担心错过关键信息在通知设置里配置敏感词比如方案预算截止一旦识别到这些词系统就会弹出通知提醒你——摸鱼也能精准回魂。接入你自己的识别引擎命令行识别器让 TMSpeech 变成万能平台它启动你指定的子进程把标准输出当作字幕单个换行更新当前句、多个换行表示句子完成。示例脚本在external_recognizer/目录下。比如你想接入 Whisper只需写一个脚本输出标准格式文本即可参考代码结构如下print(临时识别结果, end\n, flushTrue) # 单个换行更新当前句 print(\n, flushTrue) # 多个换行本句结束存入历史避坑指南新手常踩的五个坑识别不准怎么办先确认环境安静其次确认选对了语言模型中文场景别用英文模型最后可以在资源页面更换效果更好的流式模型或改用 GPU 加速的 Ncnn 识别器。为什么抓不到系统声音部分电脑需要先启用立体声混音设备右键托盘音量图标 → 声音设置 → 录制 → 启用立体声混音再在 TMSpeech 中选择对应音频源即可。进程音频一直报错检查所选进程是否还在运行或者该进程的音频会话是否被独占。Windows 版本低于 10.0.20348 时进程音频不可用这时切回系统音频即可。命令行识别器启动就退出给批处理脚本加上前缀隐藏命令回显不要在结尾加pause参数带空格时记得用双引号转义。日志文件记得填上报错信息都写在 stderr 日志里。识别结果存哪了默认在我的文档/TMSpeechLogs按日期组织文件也可以在通用设置里自定义保存路径。横向对比它凭什么值得推荐对比项TMSpeech云识别服务其他本地字幕工具是否联网完全离线依赖网络部分离线隐私安全数据不出本机音频上传云端视工具而定资源占用CPU5%内存500MB无明显占用普遍偏高扩展性插件化可换引擎固定接口大多封闭成本免费开源按量付费部分收费会议场景系统音频直录自动存档需单独录屏支持较少它最大的差异化在于三点完全离线保护隐私、系统音频直接捕获开会神器、插件化架构自由扩展。核心与插件分离的设计见src/TMSpeech.Core/与src/Plugins/意味着你可以像搭积木一样自由组合音频源、识别器甚至翻译器。现在就开始让 TMSpeech 成为你的效率搭子自测清单你适合用 TMSpeech 吗✅ 开会怕走神想要一份自动生成的会议纪要 ✅ 上网课记笔记跟不上想要实时字幕 ✅ 担心语音上传云端坚持本地处理 ✅ 电脑配置一般想要轻量级低占用工具 ✅ 想给视频生成文字稿、字幕文件 ✅ 想要免费开源、可自己动手扩展的软件只要符合任何一项现在就动手吧git clone https://gitcode.com/gh_mirrors/tm/TMSpeech装好模型点下那个红色按钮让每一句重要的话都留在你的文档里。TMSpeech 还是一个活跃发展的开源项目如果你发现更好的模型、有新的功能想法或者愿意一起参与开发和文档编写随时欢迎加入。每一份反馈和贡献都在让这个本地方案变得更强大——毕竟最好的工具永远是大家一起来打磨的那一个。愿你再也不用在会议里手忙脚乱愿每一次关键信息都不被错过。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考