浏览 SDKs · HarmonyOS
平台
SDKsHarmonyOS商业版

识别音频文字

将 Base64 编码的音频内容识别为文字。

复制

不能直接传录音路径、ArrayBuffer 或带 data:*;base64, 前缀的数据 URL。

import sdk, { SpeechToTextReq, SpeechToTextResp } from '@openimsdk/imsdk';

const request: SpeechToTextReq = {
  filename: 'voice.m4a',
  data: audioBase64,
};
const response: SpeechToTextResp = await sdk.speechToText(request);
showTranscript(response.text);

filename 应带真实音频格式的扩展名,data 只包含 Base64 内容。调用前按语音识别能力校验格式、采样率、时长和字节数。识别结果不会修改原语音消息,也不会触发消息事件。