问题:Token Plan 订阅若折算成 API 按量付费,按「用满」算大概有多少折扣? · 数据截至 2026-08-16
订阅 · MiniMax Token Plan(包月配额,全模态共享)
| 档位 | 月费 | 包内 token | 约合单次* |
|---|---|---|---|
| Plus | ¥49 | 6 亿 | ≈12,000 次 |
| Max | ¥119 | 18 亿 | ≈36,000 次 |
| Ultra | ¥469 | 55 亿 | ≈140,000 次 |
*MiniMax 按「单次 ~50K token」估算的月度调用次数。包年立省 2 月(约 9 折)。
API 按量付费 · M3 Standard(永久 5 折促销价)
| 类型 | 单价(元 / 百万 token) |
|---|---|
| 输入(≤512K 上下文) | ¥2.10 |
| 缓存命中输入 | ¥0.42 |
| 输出 | ¥8.40 |
| >512K 长上下文 | ¥4.20 / ¥1.68 / ¥16.80 |
Credits 积分 = 1000 credits≈$1(≈¥7.18),按资源 list price 扣,本质即按量付费等价物。H3 等特殊模型不在 Token Plan 内,必须按量。
因 Token Plan 配额不区分 input/output,按量成本取决于混合比例。下表给 4 种典型场景(折扣率 = 省下的百分比)。
| 档位 | 重输出 (3:7) | 均衡 (5:5) | 输入主导 (8:2) | 高频复用 (带缓存) |
|---|---|---|---|---|
| Plus ¥49 / 6亿 | 98.7% | 98.4% | 97.6% | 97.0% |
| Max ¥119 / 18亿 | 99.0% | 98.7% | 98.0% | 97.5% |
| Ultra ¥469 / 55亿 | 98.7% | 98.4% | 97.5% | 96.8% |
读表:Max 档在「重输出」场景折扣最高(订阅仅为按量的 1.02%),即省 99.0%。单位 token 成本:Plus ¥0.082/M、Max ¥0.066/M、Ultra ¥0.085/M(均衡场景按量 ¥5.25/M 作基准)。
另一层本质:该价格差是 获客/生态补贴,非成本结构反映。MiniMax 官方明确定位 Token Plan 面向「个人开发者 / Agent 实验」,生产级应走按量付费(更真实反映推理成本,且 H3、Voice Design 等特殊模型不在订阅覆盖内)。因此「订阅折扣」更像补贴力度指标,而非可无脑迁移的生产成本。
MiniMax 官方口径:相同价格下 Token Plan 约为 Claude 订阅的 15 倍用量(Plus ¥49≈Claude Pro $20 月容量的 5 倍;Ultra ¥469≈Claude Max 20x $200 月容量的 3 倍)。这从侧面印证——其订阅 token 单价显著低于国际一线闭源厂,是「用满」折扣惊人的根因之一。
结论:对重度、能稳定用满窗口的个人/小团队,订阅相比按量付费的省钱幅度极大(理论 97–99%,实际视消耗率 85–98%);对用量波动大或生产级场景,按量付费更稳妥且覆盖更全。