TMSpeech 离线语音转文字怎么装:3 步出字幕的免费 Windows 工具指南

TMSpeech 离线语音转文字怎么装:3 步出字幕的免费 Windows 工具指南 TMSpeech 离线语音转文字怎么装3 步出字幕的免费 Windows 工具指南【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeechTMSpeech 是一款 Windows 平台的免费离线语音转文字工具用 WASAPI Loopback直接截取系统播放声音的技术抓电脑内音在本地完成语音识别结果实时上屏为字幕并同步存成日志文件。适合需要会议纪要、课程笔记和无字幕视频补字幕的用户全程不依赖网络。它先适合谁经常开会的人 → 替你实时转写会议内容被点名时看一眼历史记录就能接上话网课学习者 → 把讲解声变成跟随字幕漏听的段落事后从历史记录回看视频制作者 → 给无字幕视频生成字幕条窗口放播放器下方不挡画面外语练习者 → 装英文或中英双语模型边听边对照字幕校准理解3 步从解压到出字幕从 Release 页面下载压缩包解压想用源码构建的话执行git clone https://gitcode.com/gh_mirrors/tm/TMSpeech双击运行TMSpeech.exe首次启动自动建好配置文件和日志目录打开设置窗口的资源页给中文、英文或中英双语模型均为 Zipformer-transducer 系列之一点安装下完回到主界面点开始字幕即出配置改乱了不用重装运行 Release 包自带的重置脚本bat即可恢复出厂默认。音频源、识别器与模型配置怎么选选项作用什么时候选系统音频截取电脑正在播放的全部声音会议、课程、视频场景默认项系统静音也能取到麦克风采集你本人的说话声口述草稿、语音笔记进程音频只截某个应用的声音需要隔离单一程序时Sherpa-Onnx基于 CPU 的离线识别器默认选择装完模型即可用Sherpa-Ncnn可走 GPU 加速的识别器追求更低延迟、更小占用命令行识别器接任意能向标准输出吐文字的外部程序进阶用户自接模型中文 / 英文 / 中英双语模型识别语言均为 Zipformer-transducer 系列按会议或课程语言对号选择运行中你会看到什么字幕显示在无边框小窗口里可随意拖动、缩放右键改字体、字号、颜色、透明度、阴影配置存在%AppData%/TMSpeech/config.json保存后即时生效不用重启完成的句子按日期落盘到我的文档下的TMSpeechLogs文件夹历史记录窗口支持鼠标拖选后 Ctrl-C 或右键复制程序运行在托盘随时暂停、继续、退出常见现象自查识别错得多 → 判断依据安静单人环境下仍错说明选错了模型语言 → 换对应语言的模型或在设置里手动指向别的流式模型路径录不到系统声音 → 判断依据麦克风源正常、仅内音无声 → 在声音控制面板录制页启用立体声混音默认隐藏勾显示禁用的设备再把它设为音频源找不到日志 → 判断依据我的文档\TMSpeechLogs目录不存在 → 手动建目录并确认有写权限仍不行就改用管理员身份运行CPU 占用高 → 判断依据任务管理器里只有本程序吃资源 → 换 Sherpa-Ncnn、改小模型、关掉实时标点等附加项作者在 AMD 5800u 上测默认配置占用不足 5%开发者扩展点通用能力插件管理、任务调度、配置、资源下载集中在 src/TMSpeech.Core/具体功能以插件放在 src/Plugins/启动时按各插件目录里的tmmodule.json加载。新增功能只需实现IAudioSource、IRecognizer、ITranslator之一放入插件目录核心代码不动。命令行识别器走固定协议子进程标准输出的单换行刷新当前句双换行表示句子完成并写入历史标准错误写日志文件全程 UTF-8批处理脚本开头加隐藏回显、结尾不要pause参考实现见 external_recognizer/ 目录。注意此模式下音频由子进程自己采集设置里切音频源不生效。写在最后TMSpeech 就是给 Windows 的一台本地语音识别器音频不出机器、断网可用、解压就跑。开会、做笔记、补字幕命中任意一条就可以直接上手用得不顺就提 Issue会 C# 就发 PR发现更好的开源模型也欢迎推荐进社区。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考