在 Cline 与 Roo Code(VS Code)中使用 MiniMax

配置 Cline 或 Roo Code,经 YiduoChan 的 OpenAI 兼容 API 运行 MiniMax-M2.7 与 MiniMax-M3。本文给出扩展所需的准确 Base URL、模型 ID 和上下文窗口,以及让费用统计准确的 token 单价。

Cline 和 Roo Code 是运行 Agent 式编码循环的 VS Code 扩展:读取文件、提出修改、执行终端命令,再根据结果继续迭代。两者都能向任何 OpenAI 兼容接口发送请求,因此无需插件或封装层,就能通过 YiduoChan 使用 MiniMax 模型。本指南逐一介绍两个扩展的配置,给出需要填写的准确模型 ID 与 token 单价,让编辑器里显示的费用与账单一致,并说明对长时间 Agent 会话有影响的设置。

准备工作

设置项取值
API ProviderOpenAI Compatible
Base URLhttps://yiduochan.com/v1
API Key你在 YiduoChan 控制台获取的 Key(以 Authorization: Bearer <API key> 的形式发送)
Model IDMiniMax-M2.7、MiniMax-M2.7-highspeed 或 MiniMax-M3

改动扩展设置之前,先在终端确认 Key 可用。只要这个请求返回了补全结果,之后遇到的问题就出在扩展配置上,而不是账号。

curl https://yiduochan.com/v1/chat/completions \
  -H "Authorization: Bearer $YIDUOCHAN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MiniMax-M2.7",
    "messages": [{"role": "user", "content": "Reply with OK."}]
  }'

列出接口接受的模型 ID:

curl https://yiduochan.com/v1/models \
  -H "Authorization: Bearer $YIDUOCHAN_API_KEY"

模型 ID 与价格

请严格按下表填写模型 ID。价格单位为美元 / 每百万 tokens,与 YiduoChan 实际计费使用的数字相同,把它们填进扩展,得到的费用估算就能与控制台对得上。

模型 ID输入输出缓存读取缓存写入说明
MiniMax-M2.7$0.30$1.20$0.06$0.375Agent 式编码的默认选择
MiniMax-M2.7-highspeed$0.60$2.40$0.06$0.375质量与 M2.7 相同,延迟更低
MiniMax-M3(提示不超过 512K tokens)$0.30$1.20$0.06—1,048,576 tokens 上下文
MiniMax-M3(提示在 512K 到 1M tokens 之间)$0.60$2.40$0.12—单次提示超过 512K tokens 后适用

Cline 和 Roo Code 每个模型只接受一个输入价和一个输出价。MiniMax-M3 请填 512K 以内那一档。如果某个任务把提示撑到 512K tokens 以上,扩展对那次请求的估算会偏低;控制台的用量日志始终显示实际扣费。各模型详情见 MiniMax-M2.7 与 MiniMax-M3 页面,当前价格表见定价页。

配置 Cline

  1. 在 VS Code 侧边栏打开 Cline 面板,点击设置齿轮图标。
  2. 把 API Provider 设为 OpenAI Compatible。
  3. 把 Base URL 设为 https://yiduochan.com/v1。不要在后面加 /chat/completions,Cline 会自己拼上这段路径。
  4. 把你的 Key 粘贴到 API Key 字段。
  5. 把 Model ID 设为 MiniMax-M2.7(或上面的其他 ID)。
  6. 展开模型配置区域,按下一节的表格填写上下文窗口、输出上限和价格。
  7. 保存,然后发一个简短任务,例如“列出这个工作区里的文件”,确认扩展收到了响应,并显示出非零的费用。

Cline 可以为 Plan 模式和 Act 模式分别使用不同的提供方。一种实用的分工是:Plan 用 MiniMax-M3,这一阶段一次读入仓库的一大块内容很有用;Act 用 MiniMax-M2.7,这一阶段每轮请求更小,更多流量按标准价计费。如果两种模式共用一个模型,MiniMax-M2.7 是稳妥的默认选择。

Cline 模型配置取值

字段MiniMax-M2.7MiniMax-M2.7-highspeedMiniMax-M3
Context Window Size扩展默认值扩展默认值1048576
Max Output Tokens扩展默认值扩展默认值扩展默认值
Input Price / 1M tokens0.300.600.30
Output Price / 1M tokens1.202.401.20
Cache Reads Price / 1M tokens0.060.060.06
Cache Writes Price / 1M tokens0.3750.375留空
Supports Images关闭关闭关闭

上下文窗口这个值只是告诉扩展何时开始截断或压缩对话历史,并不改变 API 能接受的内容。MiniMax-M2.7 与 MiniMax-M2.7-highspeed 保持扩展默认值即可,模型详情见 MiniMax-M2.7 页面。MiniMax-M3 公布的上下文窗口为 1,048,576 tokens,请准确填写这个数字。不同版本 Cline 的字段名称略有差异;如果你的版本没有缓存价格字段,跳过即可,此时估算会把缓存输入按完整输入价计算。

配置 Roo Code

Roo Code 使用配置档案(configuration profile),你可以为每个 MiniMax 模型各保存一个档案并在它们之间切换,也可以把不同档案分别绑定到 Code、Architect、Ask 和 Debug 模式。

  1. 打开 Roo Code 面板,点击设置齿轮图标,再进入 Providers 标签页。
  2. 新建一个配置档案(例如 yiduochan-m2.7),以免这些设置覆盖已有的提供方。
  3. 把 API Provider 设为 OpenAI Compatible。
  4. 把 Base URL 设为 https://yiduochan.com/v1。
  5. 把 Key 粘贴到 API Key。
  6. 在 Model 字段输入 MiniMax-M2.7。Roo Code 可能会提供一个根据 /v1/models 生成的下拉列表;不管有没有,手动输入 ID 都可以。
  7. 展开 Model 字段下方的模型设置,按上面 Cline 表格中的相同取值填写上下文窗口、价格和缓存价格。如果显示了提示缓存(prompt caching)开关,把它打开。
  8. 图片支持和 computer use 保持关闭,这些都是文本模型。
  9. 保存后跑一个小任务,确认费用读数会更新。

如果想为超大代码库单独准备一个档案,就照样为 MiniMax-M3 再建一个,上下文窗口填 1048576。价格字段保存在档案里,所以无论当前启用哪个档案,Roo Code 任务标题栏显示的单任务费用都会按正确的价格计算。

提示缓存,以及费用显示的含义

Agent 循环每一轮都会重新发送系统提示、工具定义和整段对话,所以一次会话中的大部分输入 tokens 都是前几轮的重复。费用差异正体现在缓存输入上:MiniMax-M2.7 的缓存读取按每百万 tokens $0.06 计费,未命中缓存的输入为 $0.30,缓存读取只有标准价的五分之一;缓存写入为 $0.375。MiniMax-M3 的缓存读取价在 512K tokens 以内为 $0.06,512K 到 1M 之间为 $0.12。

Cline 和 Roo Code 的费用数字是在本地算出来的:用每个响应的 usage 对象报告的 token 数,乘以你填写的价格。usage 对象报告了缓存 tokens 时,扩展会对这部分按缓存读取价计算;没有报告时,所有输入 tokens 都按标准输入价计算,估算就会高于实际扣费。请把编辑器里的数字当作实时估算,把 YiduoChan 控制台的用量日志当作计费记录。无论扩展显示什么,失败的请求从不计费。

Agent 式编码的推荐设置

常见报错排查

如果做完这些检查问题仍然存在,请发邮件至 support@yiduochan.com,附上请求时间和模型 ID。

改用 Claude Code?

如果你选用的是 Claude Code 而不是 VS Code 扩展,配置方式有所不同:它使用 /v1/messages 这个 Anthropic 兼容的 Messages 接口,通过 ANTHROPIC_BASE_URL=https://yiduochan.com、ANTHROPIC_AUTH_TOKEN=<API key> 以及 ANTHROPIC_MODEL=MiniMax-M2.7 或 MiniMax-M3 进行配置。完整步骤见 Claude Code 指南,其中包括可选的 ANTHROPIC_DEFAULT_HAIKU_MODEL=MiniMax-M2.7-highspeed 设置,以及 count_tokens 不可用的说明。YiduoChan 提供的全部 MiniMax 模型见 MiniMax 模型总览页面。

常见问题

Cline 支持 MiniMax 模型吗?

支持。选择 OpenAI Compatible 提供方,Base URL 设为 https://yiduochan.com/v1,粘贴你的 YiduoChan API Key,模型 ID 填 MiniMax-M2.7 或 MiniMax-M3,不需要任何插件。

在 Roo Code 里使用 MiniMax M2.7,模型 ID 填什么?

准确填写 MiniMax-M2.7。其他可用的 ID 是 MiniMax-M2.7-highspeed 和 MiniMax-M3。

在 Cline 或 Roo Code 里,MiniMax-M3 的上下文窗口该设多少?

填 1048576,即该模型公布的 1M tokens 上下文。MiniMax-M2.7 保持扩展默认值即可;这个设置只决定扩展何时压缩历史记录。

为什么 Cline 或 Roo Code 使用 MiniMax 时费用显示 $0.00?

因为价格字段是空的,扩展不会从接口获取价格。为 MiniMax-M2.7 填入每百万 tokens 输入 $0.30、输出 $1.20,估算就会与账单一致。

提示缓存能降低 Cline 和 Roo Code 中的 MiniMax 费用吗?

MiniMax-M2.7 的缓存读取按每百万 tokens $0.06 计费,是 $0.30 输入价的五分之一;每个请求的实际扣费可以在 YiduoChan 控制台的用量日志里查看。

可以不用 VS Code 扩展,改在 Claude Code 里使用 MiniMax 吗?

可以。Claude Code 使用 Anthropic 兼容接口,设置 ANTHROPIC_BASE_URL=https://yiduochan.com 和 ANTHROPIC_MODEL=MiniMax-M2.7 即可;详见 /zh/minimax/claude-code/ 的 Claude Code 指南。

免费注册获取 API Key 查看完整模型定价