语音翻译
Speech Translation
语音识别与翻译一次完成:音频进、原文与译文同时出,支持文件与实时流式两种形态。
产品介绍
语音识别与机器翻译一体化的组合能力:一次调用内完成语音转写与目标语翻译,返回带时间戳的分段原文与译文。提供两种形态——录音文件识别翻译(上传整段音频同步返回结果)与实时流式识别翻译(WebSocket 连续送入音频帧,实时返回识别中间结果、最终分句与对应译文)。适用于跨语言会议记录、双语字幕生成、口语对话翻译等场景。按音频时长(秒)计费,翻译不额外收费。
接口能力
点击任一接口进入产品文档查看参数、响应与代码示例。
代码示例
语音翻译(识别 + 翻译一体) · /v1/translate/speech
curl -X POST "https://cloud.heimori.cn/v1/translate/speech" \
-H "Authorization: Bearer sk-heimori-..." \
-F "file=@example.wav" \
-F "audioUrl=https://example.com/meeting.mp3" \
-F "targetLang=zh" \
-F "language=mn" \
-F "diarization=false"