语音识别

Speech Recognition

蒙古语/中文语音转文字,支持音频文件转写与 WebSocket 实时流式识别。

产品介绍

面向蒙古语优化的语音识别服务,提供两种形态:音频文件转写(上传整段音频返回全文)与实时流式识别(WebSocket 连续送入音频帧、实时返回中间与最终结果)。对牧区口音、新闻播报、会议对话等场景语料充分训练,适用于字幕生成、会议记录、语音输入法、呼叫中心质检等场景。按音频时长(秒)计费。

接口能力

点击任一接口进入产品文档查看参数、响应与代码示例。

代码示例

音频文件转写 · /v1/asr/transcriptions

curl -X POST "https://cloud.heimori.cn/v1/asr/transcriptions" \
  -H "Authorization: Bearer sk-heimori-..." \
  -F "file=@example.wav" \
  -F "audioUrl=https://example.com/meeting.mp3" \
  -F "language=xle_mw" \
  -F "diarization=false"