MiniMax Speech 2.8 语音合成 API

speech-2.8-hd 高保真与 speech-2.8-turbo 极速两个版本,按字符计费,OpenAI 兼容的 /v1/audio/speech 接口一行代码接入。

MiniMax Speech 2.8 语音合成

Speech 2.8 是 MiniMax 最新一代文本转语音(TTS)模型,提供两个版本:speech-2.8-hd 追求高保真音质与细腻的情感表达,适合有声书、配音与广告;speech-2.8-turbo 以更低延迟与更低价格适合实时对话、客服播报与批量生成。两者都支持中英日韩等多语言与丰富的官方音色。

MiniMax 语音合成 API 价格

模型定位价格
speech-2.8-hd高保真$0.5224 / 万字符($52.24 / 百万字符)
speech-2.8-turbo极速$0.2985 / 万字符($29.85 / 百万字符)

按输入文本的字符数计费,中英文均按一个字符计一次。例如合成一篇 2,000 字的文章,turbo 版约 $0.06,hd 版约 $0.10。

快速开始(OpenAI 兼容 /v1/audio/speech)

curl

curl https://yiduochan.com/v1/audio/speech \
  -H "Authorization: Bearer $YIDUOCHAN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "speech-2.8-turbo",
    "input": "你好,欢迎使用 MiniMax 语音合成服务。",
    "voice": "male-qn-qingse",
    "response_format": "mp3"
  }' --output speech.mp3

Python(OpenAI SDK)

from openai import OpenAI

client = OpenAI(base_url="https://yiduochan.com/v1", api_key="YIDUOCHAN_API_KEY")
with client.audio.speech.with_streaming_response.create(
    model="speech-2.8-hd",
    voice="female-shaonv",
    input="你好,欢迎使用 MiniMax 语音合成服务。",
    response_format="wav",
) as response:
    response.stream_to_file("speech.wav")

参数说明

参数说明
modelspeech-2.8-hdspeech-2.8-turbo
input要合成的文本,按字符计费
voiceMiniMax 音色 ID,例如 male-qn-qingsefemale-shaonvEnglish_expressive_narrator
response_formatmp3wavflacpcm,默认 mp3
speed语速,0.5 到 2.0
metadata透传 MiniMax 专有参数,例如 voice_setting.emotionaudio_setting.sample_rate

适用场景

常见问题

MiniMax 语音合成 API 怎么计费?

按输入文本的字符数计费,speech-2.8-hd 为 $0.5224 每万字符,speech-2.8-turbo 为 $0.2985 每万字符,合成失败不收费。

speech-2.8-hd 和 speech-2.8-turbo 怎么选?

追求音质与情感表现选 hd,适合配音、有声书;追求低延迟与低成本选 turbo,适合实时对话与大批量生成。

支持哪些音频格式?

通过 response_format 可以选择 mp3、wav、flac 或 pcm,接口直接返回音频二进制,可以保存为文件或流式播放。

可以用 OpenAI SDK 调用吗?

可以,接口与 OpenAI 的 /v1/audio/speech 完全兼容,只需把 base_url 改为 https://yiduochan.com/v1,voice 填 MiniMax 的音色 ID。

支持音色克隆吗?

音色克隆与音色设计属于 MiniMax 平台的独立能力,目前不通过本站接口提供,合成接口可使用 MiniMax 官方全部预置音色。

免费注册获取 API Key 查看完整模型定价