MiniMax API 费用计算器
充值之前,先估算你在 YiduoChan 上每月的 MiniMax API 花费。选择模型,输入每月的 token 或字符用量,就能得到一个美元金额,所用的每百万单价与你实际被计费的单价相同。
本页用来估算一项 MiniMax 工作负载在 YiduoChan 上每月的费用。计算器使用的每百万单价,与定价页上列出、并从你的预付额度中扣除的价格相同,所以它算出的金额,就是这个用量下你会被计费的金额。计算在你的浏览器里完成,不会向服务器发送任何数据。
月度费用计算器
估算是怎么算的
YiduoChan 上的 MiniMax 文本模型都按 token 计费,语音模型都按输入字符计费。计算器对每个字段套用同一个公式,再把结果相加:
cost_usd = units / 1,000,000 × price_per_1M
文本模型的月用量分成三个字段,因为三者分别定价:
- 输入 tokens:没有命中提示缓存的提示 tokens,包括系统提示、对话历史、工具定义和用户消息。
- 输出 tokens:模型返回的 tokens。
- 缓存读取 tokens:命中缓存的提示 tokens。在 MiniMax-M2.7 上按每百万 $0.06 计费,是 $0.30 输入价的五分之一,所以提示很长且反复重复的 Agent 工作负载,实际花费远低于只按输入价估算的结果。
对 speech-2.8-turbo 和 speech-2.8-hd 来说,唯一的变量是 input 文本的字符数。计算器还会按每小时 54,000 字符(约每分钟 900 字符,按英文文本估算)把字符数换算成大致时长。请把它当作规划用的数字;实际时长取决于语言、音色和文本本身,中文文本的换算比例不同,请用自己的样本实测。
有三点是有意没有计入的。缓存写入(MiniMax-M2.7 和 MiniMax-M2.7-highspeed 上每百万 $0.375)没有对应字段,如果你的工作负载会创建新的缓存条目,请手动加上。MiniMax-M3 按每次请求的提示长度定价,所以请选择与你的典型提示相符的档位,不要指望计算器把一个月的用量拆到两个档位上。最后,结果在求和之后才四舍五入到美分,所以各分项加起来可能与合计不完全相等。
在 MiniMax-M2.7 和 MiniMax-M2.7-highspeed 之间选择,纯粹是延迟上的取舍:highspeed 版本质量相同,输入和输出单价约为两倍,缓存读取和缓存写入的价格则两者一样。分别选中两个模型运行计算器,就能看到在你的用量下差多少。
YiduoChan 上的 MiniMax 价格表
所有价格均为美元。文本模型按 MiniMax 刊例价水平定价,预付、无订阅,通过标准的 OpenAI 与 Anthropic 接口提供。短横线表示该模型公布的价格表中没有这一项。
| 模型 ID | 计费单位 | 输入 | 输出 | 缓存读取 | 缓存写入 |
|---|---|---|---|---|---|
| MiniMax-M2.7 | 每百万 tokens | $0.30 | $1.20 | $0.06 | $0.375 |
| MiniMax-M2.7-highspeed | 每百万 tokens | $0.60 | $2.40 | $0.06 | $0.375 |
| MiniMax-M3,提示不超过 512K tokens | 每百万 tokens | $0.30 | $1.20 | $0.06 | — |
| MiniMax-M3,提示在 512K 到 1M tokens 之间 | 每百万 tokens | $0.60 | $2.40 | $0.12 | — |
| speech-2.8-turbo | 每百万字符 | $60.00(每千字符 $0.0600) | — | — | — |
| speech-2.8-hd | 每百万字符 | $100.00(每千字符 $0.1000) | — | — | — |
MiniMax-M3 的上下文窗口为 1,048,576 tokens;提示不超过 512K tokens 的请求按第一档计费,更长的提示按第二档。模型 ID 就是 MiniMax-M2.7、MiniMax-M2.7-highspeed 和 MiniMax-M3;档位不属于 ID 的一部分,而是按每次请求的提示大小确定。语音按输入字符计费,hd 为每百万字符 $100,turbo 为每百万字符 $60。视频模型 MiniMax-H3 暂时不可用,所以不在表中。各模型详情见 MiniMax-M2.7、MiniMax-M3 和 speech-2.8 页面。
计算示例
每个示例都按计算器的步骤来算。用量是假设值,换成你自己的数字,算法不变。单价按每百万计,所以 token 总数先除以 1,000,000 再相乘。
1. 基于 MiniMax-M2.7 的客服机器人
一个客服机器人每月处理 20,000 次会话。每次会话平均 6 个请求,每个请求约 1,500 个输入 tokens(系统提示、检索到的文章和进行中的对话),返回约 200 个输出 tokens。
- 请求数:20,000 × 6 = 120,000
- 输入:120,000 × 1,500 = 180,000,000 tokens → 180 × $0.30 = $54.00
- 输出:120,000 × 200 = 24,000,000 tokens → 24 × $1.20 = $28.80
- 合计:$54.00 + $28.80 = 每月 $82.80,每次会话约 $0.0041
如果为了更低的延迟把同样的流量换到 MiniMax-M2.7-highspeed,两项单价都大约翻倍:180 × $0.60 + 24 × $2.40 = $165.60。
2. 基于 MiniMax-M2.7、命中提示缓存的编码 Agent
一个团队通过 Claude Code 运行编码 Agent,调用 MiniMax-M2.7,在 22 个工作日里每天 1,000 个请求。Agent 的提示很长,平均 40,000 tokens,但大部分是从上一轮重复过来的仓库上下文和工具定义。假设 40,000 个提示 tokens 中有 35,000 个是缓存读取、5,000 个是新输入,每次响应 800 个输出 tokens。
- 请求数:22 × 1,000 = 22,000
- 缓存读取:22,000 × 35,000 = 770,000,000 tokens → 770 × $0.06 = $46.20
- 输入:22,000 × 5,000 = 110,000,000 tokens → 110 × $0.30 = $33.00
- 输出:22,000 × 800 = 17,600,000 tokens → 17.6 × $1.20 = $21.12
- 合计:$46.20 + $33.00 + $21.12 = 每月 $100.32
缓存的拆分很关键。如果全部 880,000,000 个提示 tokens 都按输入计费,光提示部分就是 880 × $0.30 = $264.00,整月会达到 $285.12。上面没有计入缓存写入;如果 110,000,000 个新输入 tokens 也全部写入了缓存,再加上 110 × $0.375 = $41.25。完整配置见 Claude Code 页面,最少需要以下环境变量:
export ANTHROPIC_BASE_URL=https://yiduochan.com
export ANTHROPIC_AUTH_TOKEN=<API key>
export ANTHROPIC_MODEL=MiniMax-M2.7
export ANTHROPIC_DEFAULT_HAIKU_MODEL=MiniMax-M2.7-highspeed
3. 用 speech-2.8-turbo 制作播客旁白
一家出版方每月用 speech-2.8-turbo 和 English_expressive_narrator 音色为 8 期节目生成旁白,每期约 45 分钟。
- 音频:8 × 45 = 360 分钟 = 6 小时
- 字符数:6 × 54,000 = 324,000
- 费用:324,000 / 1,000,000 × $60.00 = 每月 $19.44
- 同样的稿子用 speech-2.8-hd:0.324 × $100.00 = $32.40
折合每小时成品音频,turbo 为 $3.24,hd 为 $5.40。这个流程中的一个请求如下:
curl https://yiduochan.com/v1/audio/speech \
-H "Authorization: Bearer $YIDUOCHAN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "speech-2.8-turbo",
"input": "Welcome back to the show. This week we look at ...",
"voice": "English_expressive_narrator",
"response_format": "mp3"
}' \
--output episode-12-intro.mp3
用真实的 token 数代替猜测
YiduoChan 不提供 Anthropic 兼容的 count_tokens 接口,所以估算文本工作负载最可靠的办法,是跑一批有代表性的样本请求,读取 /v1/chat/completions 每个响应里返回的 usage 对象:
curl https://yiduochan.com/v1/chat/completions \
-H "Authorization: Bearer $YIDUOCHAN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M2.7",
"messages": [{"role": "user", "content": "Summarize this ticket in one sentence: ..."}]
}'
响应末尾会有这样一段(数值仅作示意):
"usage": {
"prompt_tokens": 1483,
"completion_tokens": 212,
"total_tokens": 1695
}
用 prompt_tokens 乘以输入单价、completion_tokens 乘以输出单价,就是单次请求的费用;也可以把一天的流量加总,放大到一个月,再填进计算器。控制台的使用日志记录了每个请求的计费 tokens,上线之后这是最简单的数据来源。语音的计费量就是 input 字符串的字符数,所以你自己代码里的字符串长度就是精确值。
从估算到充值
YiduoChan 从预付美元额度中按量扣费,无订阅。最低充值 $5,预设档位有 $5、$10、$20、$50、$100、$200 和 $500,也接受任意自定义金额,额度有效期 12 个月。失败的请求从不计费,所以按成功请求量做出的估算,就是你花费的上限。实际操作顺序如下:
- 在上面的计算器中输入预计一个月的用量。
- 创建账号,按高于估算值的最近一个预设档位充值;示例 2 对应 $200 档,按那个用量能用将近两个月。
- 在控制台创建 API Key,把客户端指向
https://yiduochan.com/v1,并带上Authorization: Bearer <API key>。 - 一周后,把控制台的使用日志与估算对比,再调整下一次充值金额。
模型对比和完整的接口列表见 MiniMax 模型总览。计费问题请发邮件至 support@yiduochan.com。
常见问题
MiniMax-M2.7 每月要花多少钱?
只取决于用量:按每百万输入 tokens $0.30、每百万输出 tokens $1.20 计算,5,000 万输入 tokens 加 1,000 万输出 tokens 的费用是 $15.00 + $12.00 = $27.00。在本页的计算器里输入你自己的月度总量,或查看 MiniMax-M2.7 页面了解详情。
上线前怎么估算 MiniMax 的 token 用量?
本站不提供 count_tokens 接口,所以请跑一批真实请求作为样本,读取每个响应里的 usage 对象,再把总量放大到一个月。上线之后,YiduoChan 控制台的使用日志会显示每个请求的计费 tokens。
MiniMax 语音合成每小时音频要多少钱?
按英文每小时约 54,000 字符的规划值,一小时在 speech-2.8-turbo 上约 $3.24(每百万字符 $60.00),在 speech-2.8-hd 上约 $5.40(每百万字符 $100.00)。音色与格式见 speech-2.8 页面。
MiniMax-M3 比 MiniMax-M2.7 贵吗?
提示不超过 512K tokens 时不贵,两者都是每百万 tokens 输入 $0.30、输出 $1.20。MiniMax-M3 上 512K 到 1M tokens 之间的提示,按每百万输入 $0.60、输出 $2.40、缓存读取 $0.12 计费;详见 MiniMax-M3 页面。
计算器包含提示缓存写入的费用吗?
不包含。MiniMax-M2.7 和 MiniMax-M2.7-highspeed 的缓存写入为每百万 tokens $0.375;把你预计写入缓存的 tokens 数乘以这个单价,再加到计算器的合计上。