语音识别
Speech Recognition
蒙古语/中文语音转文字,支持音频文件转写与 WebSocket 实时流式识别。
产品介绍
面向蒙古语优化的语音识别服务,提供两种形态:音频文件转写(上传整段音频返回全文)与实时流式识别(WebSocket 连续送入音频帧、实时返回中间与最终结果)。对牧区口音、新闻播报、会议对话等场景语料充分训练,适用于字幕生成、会议记录、语音输入法、呼叫中心质检等场景。按音频时长(秒)计费。
接口能力
点击任一接口进入产品文档查看参数、响应与代码示例。
代码示例
音频文件转写 · /v1/asr/transcriptions
curl -X POST "https://cloud.heimori.cn/v1/asr/transcriptions" \
-H "Authorization: Bearer sk-heimori-..." \
-F "file=@example.wav" \
-F "audioUrl=https://example.com/meeting.mp3" \
-F "language=xle_mw" \
-F "diarization=false"