MiniMax 订阅 vs API 按量付费 · 折扣测算

问题:Token Plan 订阅若折算成 API 按量付费,按「用满」算大概有多少折扣? · 数据截至 2026-08-16

① 两端定价(国行人民币口径,USD/CNY≈7.18)

订阅 · MiniMax Token Plan(包月配额,全模态共享)

档位月费包内 token约合单次*
Plus¥496 亿≈12,000 次
Max¥11918 亿≈36,000 次
Ultra¥46955 亿≈140,000 次

*MiniMax 按「单次 ~50K token」估算的月度调用次数。包年立省 2 月(约 9 折)。

API 按量付费 · M3 Standard(永久 5 折促销价)

类型单价(元 / 百万 token)
输入(≤512K 上下文)¥2.10
缓存命中输入¥0.42
输出¥8.40
>512K 长上下文¥4.20 / ¥1.68 / ¥16.80

Credits 积分 = 1000 credits≈$1(≈¥7.18),按资源 list price 扣,本质即按量付费等价物。H3 等特殊模型不在 Token Plan 内,必须按量。

② 「用满」下的等效折扣(订阅费 ÷ 同量按量付费成本)

因 Token Plan 配额不区分 input/output,按量成本取决于混合比例。下表给 4 种典型场景(折扣率 = 省下的百分比)。

档位重输出
(3:7)
均衡
(5:5)
输入主导
(8:2)
高频复用
(带缓存)
Plus ¥49 / 6亿98.7%98.4%97.6%97.0%
Max ¥119 / 18亿99.0%98.7%98.0%97.5%
Ultra ¥469 / 55亿98.7%98.4%97.5%96.8%
1.0–3.2%
订阅费 ÷ 等效按量成本
(用满理想值)
97–99%
等效折扣率
(按量付费是订阅的 30–100 倍)
¥0.066/M
Max 单位 token 成本
(三档最低,最划算)

读表:Max 档在「重输出」场景折扣最高(订阅仅为按量的 1.02%),即省 99.0%。单位 token 成本:Plus ¥0.082/M、Max ¥0.066/M、Ultra ¥0.085/M(均衡场景按量 ¥5.25/M 作基准)。

③ 必须纠正:理论值 ≠ 真实值

「用满」是极端理想上限,实际折扣远小于此。Token Plan 配额采用 5 小时滚动窗口 + 周窗口,用不完不结转。 Ultra 55 亿 token ≈ 11 万次 50K 调用/月,几乎不可能在窗口内用满;即便 Max 18 亿、Plus 6 亿,普通开发者也难 100% 消耗。 真实等效折扣 = (实际用掉比例)× 理论折扣。若只用了额度的 30%,真实折扣约骤降至 90% 量级(仍显著,但非 99%)。

另一层本质:该价格差是 获客/生态补贴,非成本结构反映。MiniMax 官方明确定位 Token Plan 面向「个人开发者 / Agent 实验」,生产级应走按量付费(更真实反映推理成本,且 H3、Voice Design 等特殊模型不在订阅覆盖内)。因此「订阅折扣」更像补贴力度指标,而非可无脑迁移的生产成本。

④ 横向参照:与 Claude 订阅的量价比

MiniMax 官方口径:相同价格下 Token Plan 约为 Claude 订阅的 15 倍用量(Plus ¥49≈Claude Pro $20 月容量的 5 倍;Ultra ¥469≈Claude Max 20x $200 月容量的 3 倍)。这从侧面印证——其订阅 token 单价显著低于国际一线闭源厂,是「用满」折扣惊人的根因之一。

结论:对重度、能稳定用满窗口的个人/小团队,订阅相比按量付费的省钱幅度极大(理论 97–99%,实际视消耗率 85–98%);对用量波动大或生产级场景,按量付费更稳妥且覆盖更全。