TMSpeech:免费的 Windows 离线语音转文字实时字幕工具指南

📅 2026/8/27 2:19:44
TMSpeech:免费的 Windows 离线语音转文字实时字幕工具指南
TMSpeech免费的 Windows 离线语音转文字实时字幕工具指南【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeechTMSpeech 是一款免费开源的 Windows 离线语音转文字工具它捕获电脑正在播放的内音把语音实时转成文字以字幕形式上屏同时按日期写入日志文件。音频全程不出本机、断网可用适合做会议纪要、课程笔记、给无字幕视频补字幕的人。先跑起来下载、装模型、点开始从 Release 页面下载压缩包并解压双击运行TMSpeech.exe首次启动会自动生成配置文件和日志目录无需手动初始化也可以在TMSpeech.exe上建一个桌面快捷方式方便日常启动。接着装模型打开设置窗口的资源页给中文、英文或中英双语模型之一点安装等下载完成。中文模型约 300MB。装完后回主界面点开始字幕就会开始滚动。想从源码构建执行git clone https://gitcode.com/gh_mirrors/tm/TMSpeech拉取代码用 Visual Studio 以 Release 方式发布 .NET 6 项目即可。哪一步改乱了配置运行 Release 包自带的重置 bat 脚本删除现有配置文件即可恢复出厂状态。音频源、识别器、模型怎么选三组核心选项直接对号入座部件选项适用场景怎么选音频源系统音频电脑播放的全部声音会议、课程、视频默认项系统静音也能取到内音音频源麦克风录你本人的说话声语音笔记、口述草稿时用音频源进程音频只捕获指定应用要隔离某个程序的声音时切换识别器SherpaOnnx面向普通 CPU 优化默认项装好模型即用识别器SherpaNcnn支持 Vulkan GPU 加速encoder/decoder/joiner 三模型架构对速度和资源占用有要求时尝试识别器命令行识别器接入任意能输出文字的外部程序进阶用户见下节模型中文 / 英文 / 中英双语均为 Zipformer-transducer 流式模型纯中文场景装中文模型识别器与模型都在设置窗口里切换改动即时生效不用重启程序。字幕、历史记录与配置都放在哪字幕显示在一个无边框小窗口里可任意拖动、缩放在窗口上右键可以调整字体、字号、颜色、透明度与阴影。识别结果按日期自动存到我的文档下的TMSpeechLogs文件夹一天一个文件。打开历史记录窗口可以右键复制或按 Ctrl-C 复制整段内容摘取重点很方便。配置写在%AppData%/TMSpeech/config.jsonJSON 格式程序启动时读取修改后即时应用。资源占用方面作者在一台 AMD 5800u 笔记本上实测默认配置下 CPU 占用不到 5%。进阶接上你自己的识别程序设置里切换到命令行识别器后TMSpeech 会按你填的程序和参数启动一个子进程并约定一套简单协议子进程的标准输出作为字幕来源输出新行一个换行表示当前句子刷新跟两个换行表示这句结束写入历史记录标准错误输出写入日志文件双方统一 UTF-8 编码。协议允许模型在出字过程中回头修正前面内容最终只留存稳定句子。两个坑提前说此模式下音频由子进程自己采集设置里的音频源切换不生效批处理脚本开头加隐藏回显结尾不要写pause否则程序检测不到子进程退出。参考脚本在 external_recognizer/ 目录包含基于 SenseVoice 和流式 Zipformer 的两种示例。底层是插件架构插件管理、任务调度、配置管理、资源管理集中在 TMSpeech.Core音频源、各识别器等具体功能以独立插件放在 src/Plugins/ 下程序启动时扫描plugins目录按各目录中的tmmodule.json加载程序集。想加新的音频来源或识别引擎实现IAudioSource、IRecognizer或ITranslator接口放到插件目录即可核心代码不用动。常见故障怎么处理识别准确率不高先排除环境噪声、多人同时说话、音频源选错都没问题就换语言模型或在设置里手动指向另一个合适的流式模型路径。录不到系统声音多数是 Windows 设备设置问题。打开声音控制面板的录制页启用立体声混音设备面板里看不到时勾选显示禁用的设备再把它设为音频源。找不到日志文件确认我的文档\TMSpeechLogs文件夹存在且可写权限异常时以管理员身份运行程序。CPU 占用偏高换更省资源的识别器、改小模型、关闭标点等附加处理5800u 上默认配置实测低于 5%。TMSpeech 的定位就一句话Windows 上的免费离线语音转文字与实时字幕工具音频不出本机、解压即跑开会、记课、补字幕的刚需场景直接上手。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考