语音合成

Text-to-Speech

将中文与蒙古文文本合成为自然流畅的语音,支持多发音人。

产品介绍

提供蒙古语与中文的语音合成能力:基于神经声学模型的发音自然、韵律流畅,蒙古语发音人覆盖新闻播报与日常口语风格。支持调节语速、音量与输出格式(MP3/WAV 等),适用于有声读物、播报系统、语音助手、无障碍阅读等场景。按合成字符数计费。

接口能力

点击任一接口进入产品文档查看参数、响应与代码示例。

代码示例

语音合成(单发音人 / 多说话人多语种混合) · /v1/tts

curl -X POST "https://cloud.heimori.cn/v1/tts" \
  -H "Authorization: Bearer sk-heimori-..." \
  -H "Content-Type: application/json" \
  -d '{
  "text": "Сайн байна уу",
  "segments": [
    {
      "text": "Сайн байна уу",
      "voice": "saikhan"
    },
    {
      "pause": 400
    },
    {
      "text": "你好,欢迎使用讯蒙智能云。",
      "lang": "zh",
      "voice": "zh-CN-YunxiNeural"
    }
  ],
  "lang": "xle_mw",
  "voice": "saikhan",
  "speed": 1,
  "format": "mp3",
  "encoding": "standard"
}' \
  --output output.mp3