MiniMax API 费用计算器

充值之前,先估算你在 YiduoChan 上每月的 MiniMax API 花费。选择模型,输入每月的 token 或字符用量,就能得到一个美元金额,所用的每百万单价与你实际被计费的单价相同。

本页用来估算一项 MiniMax 工作负载在 YiduoChan 上每月的费用。计算器使用的每百万单价,与定价页上列出、并从你的预付额度中扣除的价格相同,所以它算出的金额,就是这个用量下你会被计费的金额。计算在你的浏览器里完成,不会向服务器发送任何数据。

月度费用计算器

价格为美元,按每 1,000,000 tokens 或字符计,与定价页完全一致。费用 = 用量 / 1,000,000 × 单价。不含缓存写入。

估算是怎么算的

YiduoChan 上的 MiniMax 文本模型都按 token 计费,语音模型都按输入字符计费。计算器对每个字段套用同一个公式,再把结果相加:

cost_usd = units / 1,000,000 × price_per_1M

文本模型的月用量分成三个字段,因为三者分别定价:

对 speech-2.8-turbo 和 speech-2.8-hd 来说,唯一的变量是 input 文本的字符数。计算器还会按每小时 54,000 字符(约每分钟 900 字符,按英文文本估算)把字符数换算成大致时长。请把它当作规划用的数字;实际时长取决于语言、音色和文本本身,中文文本的换算比例不同,请用自己的样本实测。

有三点是有意没有计入的。缓存写入(MiniMax-M2.7 和 MiniMax-M2.7-highspeed 上每百万 $0.375)没有对应字段,如果你的工作负载会创建新的缓存条目,请手动加上。MiniMax-M3 按每次请求的提示长度定价,所以请选择与你的典型提示相符的档位,不要指望计算器把一个月的用量拆到两个档位上。最后,结果在求和之后才四舍五入到美分,所以各分项加起来可能与合计不完全相等。

在 MiniMax-M2.7 和 MiniMax-M2.7-highspeed 之间选择,纯粹是延迟上的取舍:highspeed 版本质量相同,输入和输出单价约为两倍,缓存读取和缓存写入的价格则两者一样。分别选中两个模型运行计算器,就能看到在你的用量下差多少。

YiduoChan 上的 MiniMax 价格表

所有价格均为美元。文本模型按 MiniMax 刊例价水平定价,预付、无订阅,通过标准的 OpenAI 与 Anthropic 接口提供。短横线表示该模型公布的价格表中没有这一项。

模型 ID计费单位输入输出缓存读取缓存写入
MiniMax-M2.7每百万 tokens$0.30$1.20$0.06$0.375
MiniMax-M2.7-highspeed每百万 tokens$0.60$2.40$0.06$0.375
MiniMax-M3,提示不超过 512K tokens每百万 tokens$0.30$1.20$0.06—
MiniMax-M3,提示在 512K 到 1M tokens 之间每百万 tokens$0.60$2.40$0.12—
speech-2.8-turbo每百万字符$60.00(每千字符 $0.0600)———
speech-2.8-hd每百万字符$100.00(每千字符 $0.1000)———

MiniMax-M3 的上下文窗口为 1,048,576 tokens;提示不超过 512K tokens 的请求按第一档计费,更长的提示按第二档。模型 ID 就是 MiniMax-M2.7、MiniMax-M2.7-highspeed 和 MiniMax-M3;档位不属于 ID 的一部分,而是按每次请求的提示大小确定。语音按输入字符计费,hd 为每百万字符 $100,turbo 为每百万字符 $60。视频模型 MiniMax-H3 暂时不可用,所以不在表中。各模型详情见 MiniMax-M2.7、MiniMax-M3 和 speech-2.8 页面。

计算示例

每个示例都按计算器的步骤来算。用量是假设值,换成你自己的数字,算法不变。单价按每百万计,所以 token 总数先除以 1,000,000 再相乘。

1. 基于 MiniMax-M2.7 的客服机器人

一个客服机器人每月处理 20,000 次会话。每次会话平均 6 个请求,每个请求约 1,500 个输入 tokens(系统提示、检索到的文章和进行中的对话),返回约 200 个输出 tokens。

  1. 请求数:20,000 × 6 = 120,000
  2. 输入:120,000 × 1,500 = 180,000,000 tokens → 180 × $0.30 = $54.00
  3. 输出:120,000 × 200 = 24,000,000 tokens → 24 × $1.20 = $28.80
  4. 合计:$54.00 + $28.80 = 每月 $82.80,每次会话约 $0.0041

如果为了更低的延迟把同样的流量换到 MiniMax-M2.7-highspeed,两项单价都大约翻倍:180 × $0.60 + 24 × $2.40 = $165.60。

2. 基于 MiniMax-M2.7、命中提示缓存的编码 Agent

一个团队通过 Claude Code 运行编码 Agent,调用 MiniMax-M2.7,在 22 个工作日里每天 1,000 个请求。Agent 的提示很长,平均 40,000 tokens,但大部分是从上一轮重复过来的仓库上下文和工具定义。假设 40,000 个提示 tokens 中有 35,000 个是缓存读取、5,000 个是新输入,每次响应 800 个输出 tokens。

  1. 请求数:22 × 1,000 = 22,000
  2. 缓存读取:22,000 × 35,000 = 770,000,000 tokens → 770 × $0.06 = $46.20
  3. 输入:22,000 × 5,000 = 110,000,000 tokens → 110 × $0.30 = $33.00
  4. 输出:22,000 × 800 = 17,600,000 tokens → 17.6 × $1.20 = $21.12
  5. 合计:$46.20 + $33.00 + $21.12 = 每月 $100.32

缓存的拆分很关键。如果全部 880,000,000 个提示 tokens 都按输入计费,光提示部分就是 880 × $0.30 = $264.00,整月会达到 $285.12。上面没有计入缓存写入;如果 110,000,000 个新输入 tokens 也全部写入了缓存,再加上 110 × $0.375 = $41.25。完整配置见 Claude Code 页面,最少需要以下环境变量:

export ANTHROPIC_BASE_URL=https://yiduochan.com
export ANTHROPIC_AUTH_TOKEN=<API key>
export ANTHROPIC_MODEL=MiniMax-M2.7
export ANTHROPIC_DEFAULT_HAIKU_MODEL=MiniMax-M2.7-highspeed

3. 用 speech-2.8-turbo 制作播客旁白

一家出版方每月用 speech-2.8-turbo 和 English_expressive_narrator 音色为 8 期节目生成旁白,每期约 45 分钟。

  1. 音频:8 × 45 = 360 分钟 = 6 小时
  2. 字符数:6 × 54,000 = 324,000
  3. 费用:324,000 / 1,000,000 × $60.00 = 每月 $19.44
  4. 同样的稿子用 speech-2.8-hd:0.324 × $100.00 = $32.40

折合每小时成品音频,turbo 为 $3.24,hd 为 $5.40。这个流程中的一个请求如下:

curl https://yiduochan.com/v1/audio/speech \
  -H "Authorization: Bearer $YIDUOCHAN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "speech-2.8-turbo",
    "input": "Welcome back to the show. This week we look at ...",
    "voice": "English_expressive_narrator",
    "response_format": "mp3"
  }' \
  --output episode-12-intro.mp3

用真实的 token 数代替猜测

YiduoChan 不提供 Anthropic 兼容的 count_tokens 接口,所以估算文本工作负载最可靠的办法,是跑一批有代表性的样本请求,读取 /v1/chat/completions 每个响应里返回的 usage 对象:

curl https://yiduochan.com/v1/chat/completions \
  -H "Authorization: Bearer $YIDUOCHAN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MiniMax-M2.7",
    "messages": [{"role": "user", "content": "Summarize this ticket in one sentence: ..."}]
  }'

响应末尾会有这样一段(数值仅作示意):

"usage": {
  "prompt_tokens": 1483,
  "completion_tokens": 212,
  "total_tokens": 1695
}

用 prompt_tokens 乘以输入单价、completion_tokens 乘以输出单价,就是单次请求的费用;也可以把一天的流量加总,放大到一个月,再填进计算器。控制台的使用日志记录了每个请求的计费 tokens,上线之后这是最简单的数据来源。语音的计费量就是 input 字符串的字符数,所以你自己代码里的字符串长度就是精确值。

从估算到充值

YiduoChan 从预付美元额度中按量扣费,无订阅。最低充值 $5,预设档位有 $5、$10、$20、$50、$100、$200 和 $500,也接受任意自定义金额,额度有效期 12 个月。失败的请求从不计费,所以按成功请求量做出的估算,就是你花费的上限。实际操作顺序如下:

  1. 在上面的计算器中输入预计一个月的用量。
  2. 创建账号,按高于估算值的最近一个预设档位充值;示例 2 对应 $200 档,按那个用量能用将近两个月。
  3. 在控制台创建 API Key,把客户端指向 https://yiduochan.com/v1,并带上 Authorization: Bearer <API key>。
  4. 一周后,把控制台的使用日志与估算对比,再调整下一次充值金额。

模型对比和完整的接口列表见 MiniMax 模型总览。计费问题请发邮件至 support@yiduochan.com。

常见问题

MiniMax-M2.7 每月要花多少钱?

只取决于用量:按每百万输入 tokens $0.30、每百万输出 tokens $1.20 计算,5,000 万输入 tokens 加 1,000 万输出 tokens 的费用是 $15.00 + $12.00 = $27.00。在本页的计算器里输入你自己的月度总量,或查看 MiniMax-M2.7 页面了解详情。

上线前怎么估算 MiniMax 的 token 用量?

本站不提供 count_tokens 接口,所以请跑一批真实请求作为样本,读取每个响应里的 usage 对象,再把总量放大到一个月。上线之后,YiduoChan 控制台的使用日志会显示每个请求的计费 tokens。

MiniMax 语音合成每小时音频要多少钱?

按英文每小时约 54,000 字符的规划值,一小时在 speech-2.8-turbo 上约 $3.24(每百万字符 $60.00),在 speech-2.8-hd 上约 $5.40(每百万字符 $100.00)。音色与格式见 speech-2.8 页面。

MiniMax-M3 比 MiniMax-M2.7 贵吗?

提示不超过 512K tokens 时不贵,两者都是每百万 tokens 输入 $0.30、输出 $1.20。MiniMax-M3 上 512K 到 1M tokens 之间的提示,按每百万输入 $0.60、输出 $2.40、缓存读取 $0.12 计费;详见 MiniMax-M3 页面。

计算器包含提示缓存写入的费用吗?

不包含。MiniMax-M2.7 和 MiniMax-M2.7-highspeed 的缓存写入为每百万 tokens $0.375;把你预计写入缓存的 tokens 数乘以这个单价,再加到计算器的合计上。

在 YiduoChan 使用 MiniMax 有月度最低消费或订阅吗?

没有订阅:你充值预付美元额度(最低 $5,有效期 12 个月),按 token 或按字符付费,失败的请求从不计费。在 /register 注册,完整价格表见 /pricing。

免费注册获取 API Key 查看完整模型定价