近日钉钉新版本上线智能语音输入功能成为首个支持全场景 AI 语音输入的协同办公平台。不近日钉钉新版本上线智能语音输入功能成为首个支持全场景 AI 语音输入的协同办公平台。不同于传统语音转文字钉钉在语音识别基础上叠加了 AI 语义理解能力开口即可成章语音由此成为用户在钉钉上的原生工作语言。目前该功能已覆盖千问办公、IM 消息、搜索栏、文档、AI 表格等钉内高频场景同时支持在外部浏览器、桌面智能体平台等任何需要文字输入的环境中使用。语音输入并不新鲜但过去的语音输入解决的是听清留下的是未经加工的口语原貌。钉钉智能语音输入要解决的是下一步说完之后内容能不能直接用。口语中常见的“嗯、那个”等填充词在转写时被直接过滤语序散乱的长内容自动整理为清晰要点说话时的口误和自我修正比如“不对不对我意思是”不会留下改口痕迹只保留最终意图。一段碎碎念说完输出的就是能直接发的话。在钉钉内这意味着一个快捷键即可调度整个工作台在千问办公中给 AI 下达指令在 IM 对话框快速回复消息在搜索栏用说话代替打字找人找内容在文档中口述灵感和段落在 AI 表格中用自然语言录入数据。用户不需要“想好再说”AI 把“想到哪说到哪”变成“说完就能用”。当 AI 的执行速度越来越快人的表达速度就是新的生产力上限。支撑这一体验的是阿里自研语音识别大模型Qwen-Audio-3.0-ASR-Flash-Message。在全球权威 AI 评测平台 Artificial Analysis 上Qwen-Audio 家族模型以 1.7% 字符错误率位列全球第一超越 GPT-Realtime-2 等国际顶尖模型。钉钉智能语音输入所接入的正是这一模型家族中面向消息场景深度优化的ASR引擎在识别精度之上进一步强化了语义整理和意图提取能力。即日起所有用户升级至钉钉最新版即可免费使用Windows 端长按右 Alt 键唤起Mac 端长按 fn 键唤起移动端点击对话框话筒按钮即可开口。