语音翻译

Speech Translation

语音识别与翻译一次完成:音频进、原文与译文同时出,支持文件与实时流式两种形态。

产品介绍

语音识别与机器翻译一体化的组合能力:一次调用内完成语音转写与目标语翻译,返回带时间戳的分段原文与译文。提供两种形态——录音文件识别翻译(上传整段音频同步返回结果)与实时流式识别翻译(WebSocket 连续送入音频帧,实时返回识别中间结果、最终分句与对应译文)。适用于跨语言会议记录、双语字幕生成、口语对话翻译等场景。按音频时长(秒)计费,翻译不额外收费。

代码示例

语音翻译(识别 + 翻译一体) · /v1/translate/speech

curl -X POST "https://cloud.heimori.cn/v1/translate/speech" \
  -H "Authorization: Bearer sk-heimori-..." \
  -F "file=@example.wav" \
  -F "audioUrl=https://example.com/meeting.mp3" \
  -F "targetLang=zh" \
  -F "language=mn" \
  -F "diarization=false"