DOC2X语音识别

引擎内测 · API 规划中

语音识别,
重点优化气声场景

NoEdgeAI 语音识别能力针对轻声、气声与低音量说话场景优化,面向不方便大声说话时的语音输入。相关引擎用于默录 MuteScribe 内测,公开语音识别 API 仍在规划中,可在开放平台关注后续进展。

AUDIO → TEXT
00:00
00:12

语音转录流程示意 · 具体结果需核对

本页内容

专门关注气声和轻声

在开放办公区、图书馆或夜间,用户可能需要压低声音。语音识别能力的优化重点包括气声和低音量场景,让轻声输入更实用。

用真实场景评价结果

气声强弱、麦克风位置和环境噪声都会影响识别。对专有名词和同音字,需检查转写结果,不能把场景优化理解为所有音频都能无误识别。

当前可用范围

引擎已用于默录 MuteScribe 内测。这里介绍能力方向,尚不承诺公共 API 的上线日期、价格或开放调用方式。

常见问题

Doc2X 网页版现在有通用语音识别 API 吗?

公开语音识别 API 仍在规划中。请在开放平台查看最新状态,不要把引擎内测视为正式开放。

内容核对:2026-10-04 · 功能条件与配额以当前产品界面为准