XJP 平台 · 实时语音识别

开口,成文。

中英混说,边说边上屏;停顿即定稿——你的话,拿来就能用。

点击按钮,允许麦克风,开口即可。
访问令牌(登录后不需要)
转写
你说的话会实时出现在这里:淡墨是正在识别的预览,实墨是已经落定的句子。

中英混说

一句话里夹中文和 English 不用切换,兼识上海话、粤语、四川话等方言。多家识别引擎接入,自动选路。

淡墨预览 → 实墨定稿

识别结果逐字上屏;停顿约 0.8 秒后该句落定,之后不再改写。适合边说边看、说完即取。

规整输出

自动加标点、把"一百二十三"写成 123。定稿文本无需二次整理,可直接进消息框和文档。

接进你的产品

一条 WebSocket,三种消息。浏览器端凭子协议携带令牌,发 16 kHz 单声道 PCM,收 JSON 转写。

// 连接(令牌走 WebSocket 子协议)
const ws = new WebSocket(
  "wss://xjp-realtime-asr.xiaojins.com/v1/asr/live",
  ["xjp.bearer." + token]
);

// 1. 开始:声明采样率
ws.send(JSON.stringify({ type: "start", sample_rate: 16000 }));

// 2. 推流:16 kHz mono s16le PCM,约 200ms 一帧
ws.send(pcmChunk);

// 3. 结束
ws.send(JSON.stringify({ type: "end" }));

// 收:ready → result(增量,utterances 带 definite) → final
// GET /v1/asr/schema 查看完整契约;/health 看服务状态