TMSpeech:Windows 实时语音转文字工具,一场会议结束纪要就自动写好了
TMSpeechWindows 实时语音转文字工具一场会议结束纪要就自动写好了【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech凌晨一点我在腾讯会议里对着 PPT 发呆——老板上上周布置的周报还没写会上又讲了一堆重点和务必。散会后我盯着录音文件发愁两小时音频转文字要排队自己回听要命。直到我装了 TMSpeech一个完全免费的 Windows 实时语音转文字工具事情才彻底变了样。动笔前先回答你三个问题它能替代付费的会议转写软件吗大部分场景可以而且它还是本地离线识别声音不离开你的电脑。我的电脑配置一般跑得动吗开发者在 AMD 5800u 笔记本上实测CPU 占用不到 5%。上手要几分钟下载解压点开就能用配置模型也就是点几个按钮的事。一句话速览值不值得装TMSpeech 是一款开源、免费、完全离线的 Windows 实时字幕工具它通过 WASAPI 捕获电脑正在播放的任何声音包括会议软件、视频、网课用 sherpa-onnx 模型本地识别成文字像歌词一样挂在屏幕上。会议结束后识别记录已经按日期自动存进了我的文档/TMSpeechLogs。你要做的只有打开它然后专心听讲。快速上手从下载到第一次识别第一步从项目 Release 页面下载最新压缩包解压双击运行TMSpeech.exe。想开机就用可以在桌面建个快捷方式万一配置搞乱了还能运行自带的重置配置 bat 脚本一键复原。第二步打开主界面右下角的齿轮进入资源页这里能看到待安装的语音识别模型中文、英文、中英双语三款流式模型大小从 200MB 到 500MB 不等。点一下右侧的安装等下载完成就绪。识别器和采集器这两个插件是内置的默认已装好。第三步回到主界面点一下开始按钮——屏幕上的红色计时器开始跳动你电脑里正在播放的任何说话声都会实时变成字幕浮在窗口上。对比视角这套工具和录音转写方案差在哪用传统方法记会议至少要做三件事开录音软件、会后等转写、再手动核对时间点。TMSpeech 把这套流程压缩成了一步对比维度录音后手动转写TMSpeech 实时字幕出稿时间会后数小时说话的同时是否联网云端转写依赖网络全程离线隐私不出机错漏更正需要手动核对识别器会持续修正本句结束才定稿额外成本付费软件按小时计费免费开源识别引擎也给了三档选择你可以在语音识别标签页里切换Sherpa-Onnx 离线识别器纯 CPU 计算普通办公机首选安静、省资源。Sherpa-Ncnn 离线识别器支持 Vulkan 调用 GPU追求最快出字的场景比如直播字幕选它。命令行识别器面向开发者可以把任何能输出文本的识别程序比如 Whisper 或云端 API接进来项目里还附了现成的 Python 示例脚本见 external_recognizer/。音频来源同样有三个系统音频捕获电脑播放的所有声音麦克风只录你说话进程音频则精准锁定某个应用的输出。这里有个特别实用的细节系统音频走的是 WASAPI 回环采集哪怕你把系统音量静音字幕照样工作——摸鱼和记笔记两不误。一次真实的会议实录我偷偷走神了 20 分钟我用一台 i5 的办公本做了次实测。下午的跨部门会议讲的全是我不熟悉的业务名词。我把 TMSpeech 挂在小角落自己低头回工作消息。开会 40 分钟我的操作只有开软件、选系统音频、点开始。会议结束时历史记录窗口里躺着 40 分钟完整的文字稿从第三季度的营收目标到下周三之前把方案发给各负责人一句没落。顺手检查了一下资源占用任务管理器里 TMSpeech 的 CPU 稳定在 3%~5%内存不到 400MB我同时开着浏览器、Excel 和微信一点不卡。会后我把我的文档/TMSpeechLogs里今天的记录文件复制出来改两版错别字就是现成的会议纪要省下的时间够我多摸一小时鱼。对了识别窗口还能玩出花来无边框、可拖动、可缩放点锁形按钮后字幕窗口会变成鼠标穿透模式——你在它上面正常点别的东西字幕就在底下静静躺着。避坑清单最常见的五个坑踩过就记住坑 1中文识别不准总出同音字先确认你装的是中文模型而不是英文或双语。其次别对着喇叭太远环境噪音大的话优先用系统音频而非麦克风。模型这块想升级可以去换 sherpa-onnx 社区的其他流式模型在识别器配置里指定模型路径即可。坑 2装了模型还提示识别器起不来模型下载中断或目录被改动过。去资源页点刷新看状态是否是已安装不行就移除后重装一次重启软件再试。坑 3电脑明明在放声音字幕却是空的检查当前选的音频源是不是系统音频以及是否有别的软件独占了声卡。切换音频源后记得重新点一次开始。坑 4用命令行识别器结果不显示命令行识别器读的是子进程的 stdout且单个换行只更新临时结果连续换行才代表一句定稿并入历史。很多脚本只打print不换行自然什么都看不到。另外它需要子进程自己采集音频所以此时在设置里切换音频源是不会生效的。坑 5历史记录怎么找不到了默认存在我的文档/TMSpeechLogs按日期组织。如果找不到先看设置里的日志保存路径有没有被改过顺带说一句它支持右键复制单条或 CtrlC/CtrlA 全选想整理归档直接复制走。收束三个问题现在都有了答案它能替代付费软件吗是日常会议、网课、面试记录这些场景绰绰有余还是免费开源的。对普通电脑友好吗是5% 的 CPU 占用多数办公本都能轻松扛住。上手要多久不完全是要学下载解压、点两个按钮三分钟内就能看到第一行字幕。至于怎么得到它直接下载 Release 解压即可用想自己改、想给社区贡献新模型或插件的git clone https://gitcode.com/gh_mirrors/tm/TMSpeech把源码拿回去折腾。它基于插件化架构核心、界面和识别引擎彼此解耦入口和插件都在src/下加一个新识别器或新音频源并不复杂。下次开会别再一边假装记笔记一边内心崩溃了。让 TMSpeech 替你听着你负责把心思放在真正重要的地方——毕竟腾讯会议摸鱼工具这个名字可不是白叫的。【免费下载链接】TMSpeech腾讯会议摸鱼工具项目地址: https://gitcode.com/gh_mirrors/tm/TMSpeech创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考