news 2026/8/27 2:19:40

TMSpeech:免费的 Windows 离线语音转文字实时字幕工具指南

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
TMSpeech:免费的 Windows 离线语音转文字实时字幕工具指南

TMSpeech:免费的 Windows 离线语音转文字实时字幕工具指南

【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech

TMSpeech 是一款免费开源的 Windows 离线语音转文字工具:它捕获电脑正在播放的内音,把语音实时转成文字,以字幕形式上屏,同时按日期写入日志文件。音频全程不出本机、断网可用,适合做会议纪要、课程笔记、给无字幕视频补字幕的人。

先跑起来:下载、装模型、点开始

从 Release 页面下载压缩包并解压,双击运行TMSpeech.exe,首次启动会自动生成配置文件和日志目录,无需手动初始化;也可以在TMSpeech.exe上建一个桌面快捷方式,方便日常启动。

接着装模型:打开设置窗口的"资源"页,给中文、英文或中英双语模型之一点"安装",等下载完成。中文模型约 300MB。装完后回主界面点"开始",字幕就会开始滚动。

想从源码构建:执行git clone https://gitcode.com/gh_mirrors/tm/TMSpeech拉取代码,用 Visual Studio 以 Release 方式发布 .NET 6 项目即可。

哪一步改乱了配置,运行 Release 包自带的重置 bat 脚本删除现有配置文件,即可恢复出厂状态。

音频源、识别器、模型怎么选

三组核心选项,直接对号入座:

部件选项适用场景怎么选
音频源系统音频电脑播放的全部声音:会议、课程、视频默认项,系统静音也能取到内音
音频源麦克风录你本人的说话声语音笔记、口述草稿时用
音频源进程音频只捕获指定应用要隔离某个程序的声音时切换
识别器SherpaOnnx面向普通 CPU 优化默认项,装好模型即用
识别器SherpaNcnn支持 Vulkan GPU 加速,encoder/decoder/joiner 三模型架构对速度和资源占用有要求时尝试
识别器命令行识别器接入任意能输出文字的外部程序进阶用户,见下节
模型中文 / 英文 / 中英双语均为 Zipformer-transducer 流式模型纯中文场景装中文模型

识别器与模型都在设置窗口里切换,改动即时生效,不用重启程序。

字幕、历史记录与配置都放在哪

  • 字幕显示在一个无边框小窗口里,可任意拖动、缩放;在窗口上右键可以调整字体、字号、颜色、透明度与阴影。
  • 识别结果按日期自动存到"我的文档"下的TMSpeechLogs文件夹,一天一个文件。
  • 打开历史记录窗口,可以右键复制或按 Ctrl-C 复制整段内容,摘取重点很方便。
  • 配置写在%AppData%/TMSpeech/config.json,JSON 格式,程序启动时读取,修改后即时应用。
  • 资源占用方面,作者在一台 AMD 5800u 笔记本上实测,默认配置下 CPU 占用不到 5%。

进阶:接上你自己的识别程序

设置里切换到"命令行识别器"后,TMSpeech 会按你填的程序和参数启动一个子进程,并约定一套简单协议:

  • 子进程的标准输出作为字幕来源;输出新行(一个换行)表示当前句子刷新,跟两个换行表示这句结束,写入历史记录;
  • 标准错误输出写入日志文件;双方统一 UTF-8 编码。
  • 协议允许模型在出字过程中回头修正前面内容,最终只留存稳定句子。

两个坑提前说:此模式下音频由子进程自己采集,设置里的音频源切换不生效;批处理脚本开头加@隐藏回显,结尾不要写pause,否则程序检测不到子进程退出。参考脚本在 external_recognizer/ 目录,包含基于 SenseVoice 和流式 Zipformer 的两种示例。

底层是插件架构:插件管理、任务调度、配置管理、资源管理集中在 TMSpeech.Core,音频源、各识别器等具体功能以独立插件放在 src/Plugins/ 下,程序启动时扫描plugins目录,按各目录中的tmmodule.json加载程序集。想加新的音频来源或识别引擎,实现IAudioSourceIRecognizerITranslator接口,放到插件目录即可,核心代码不用动。

常见故障怎么处理

  • 识别准确率不高:先排除环境噪声、多人同时说话、音频源选错;都没问题就换语言模型,或在设置里手动指向另一个合适的流式模型路径。
  • 录不到系统声音:多数是 Windows 设备设置问题。打开"声音控制面板"的"录制"页,启用"立体声混音"设备(面板里看不到时勾选"显示禁用的设备"),再把它设为音频源。
  • 找不到日志文件:确认"我的文档\TMSpeechLogs"文件夹存在且可写;权限异常时以管理员身份运行程序。
  • CPU 占用偏高:换更省资源的识别器、改小模型、关闭标点等附加处理;5800u 上默认配置实测低于 5%。

TMSpeech 的定位就一句话:Windows 上的免费离线语音转文字与实时字幕工具,音频不出本机、解压即跑,开会、记课、补字幕的刚需场景直接上手。

【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/27 2:17:26

Marp 免费把 Markdown 转幻灯片:一条命令导出 PDF 的新手指南

Marp 免费把 Markdown 转幻灯片:一条命令导出 PDF 的新手指南 【免费下载链接】marp The entrance repository of Markdown presentation ecosystem 项目地址: https://gitcode.com/gh_mirrors/mar/marp Marp 是开源的 Markdown 转幻灯片工具:你写…

作者头像 李华
网站建设 2026/8/27 2:14:05

计算机毕业设计之基于Android平台下的食堂采样管理系统

本文介绍了一款使用springboot基于Android平台下的食堂采样管理系统,及其设计与实现过程。根据软件工程对软件系统开发定制的规则和标准,详细的介绍了系统的分析与设计过程,并且详细的概括了系统的开发与测试过程。本文的管理系统使用了HBuil…

作者头像 李华
网站建设 2026/8/27 2:14:03

2026年AI产品经理转行指南:6周掌握大模型、RAG与Agent

如果你正准备转行 AI 产品经理,或者在普通产品经理岗位上想往 AI 方向靠拢,那么这篇文章值得认真看完。2026 年的招聘市场里,AI 产品经理已经不是一个笼统的岗位概念,而是被拆分成了多个细分方向:大模型应用产品经理、…

作者头像 李华
网站建设 2026/8/27 2:13:15

DDrawCompat 兼容指南:让 DirectDraw 老游戏在 Windows 11 上跑起来

DDrawCompat 兼容指南:让 DirectDraw 老游戏在 Windows 11 上跑起来 【免费下载链接】DDrawCompat DirectDraw and Direct3D 1-7 compatibility, performance and visual enhancements for Windows Vista, 7, 8, 10 and 11 项目地址: https://gitcode.com/gh_mirr…

作者头像 李华
网站建设 2026/8/27 2:12:47

从零构建Multi-Key电子长笛:传感器矩阵、指法映射与固件实现

1. 为什么做一把多键电子长笛,而不是直接用MIDI键盘先说个可能有点反常识的结论:MIDI键盘虽然能把音符送进DAW,但它完全表达不了管乐器的“气口”。长笛的魅力恰恰在于气息和指法的强耦合——同样的指法,吹得急一点就高半个音&…

作者头像 李华