权重 token 详解:选对套餐,让额度用得更久
apmix 如何用一份额度统计所有模型的用量,如何把套餐换算成任意模型上的实际 token,以及让每月额度用得更久的实用方法。
apmix 团队发布于 3 分钟阅读
每个模型的价格都不一样。快速模型的一个 token 只值前沿模型的零头,推理模式又更贵。多数网关的做法是给每个模型一张价目表,月底再寄一张你看不太懂的账单。apmix 则对所有模型只用一种单位:权重 token。
所有模型通用一种单位
你的套餐是每月一份权重 token 预算,由套餐内的所有模型和账号下的所有密钥共享。每个模型都有一个倍率:在该模型上,一个实际 token 需要消耗多少权重 token。
- 在 1× 模型上,一个实际 token 消耗一个权重 token。
- 在 3× 模型上,同一个 token 消耗三个。
- 输入和输出 token 都会计入,包括推理 token,然后乘以模型的倍率。
所以,一次 1,000 token 的对话,在 1× 模型上消耗 1,000 权重 token,在 3× 模型上消耗 3,000。倍率按模型设定;价格页、每个模型的详情页和你的控制台都会显示当前数值。
把套餐换算成实际 token
真正有用的问题不是“我有多少权重 token”,而是“我能给我用的模型实际发送多少”。答案只需一次除法:
每月实际 token = 套餐额度 ÷ 模型倍率
下面是各套餐的月度额度在几种倍率下能换到的实际 token:
撰写本文时,部分快速模型的倍率甚至低于 1×:在 0.5× 的模型上,Starter 的 60M 能换到 120M 实际 token;在 0.1× 的模型上则是 600M。

价格页会对目录中的每个模型做这个换算,所以在选套餐之前,你可以先查到自己常用模型的准确数字。
哪个套餐适合你?
- Starter(每月 $4.99,60M):适合业余项目、评测和偶尔的智能体会话,主要使用快速模型。
- Pro(每月 $14.99,200M):为每天用 Claude Code 或 Codex 等命令行智能体写代码而设计,并包含更多模型。
- Max(每月 $29.99,500M):适合高强度、全天候的智能体工作负载。它覆盖整个模型目录,API 密钥不限数量,并享优先路由。
套餐是分级的:更高的套餐包含所有更低套餐的模型。年付在十二个月内提供同样的月度额度,价格更低,一次付清。

让额度用得更久
以下几个习惯效果很明显,尤其是在智能体会发送很长上下文的时候:
- 按任务选模型。 日常修改、写测试和小型重构用快速、低倍率的模型,难的部分再换前沿模型。同样的额度,在 1× 模型上能比在 3× 或 5× 模型上多用三到五倍。
- 有意识地使用推理模式。 推理模式按更高的倍率计费。用它来做架构设计、排查棘手的 bug,而不是改变量名。
- 让智能体会话保持聚焦。 每一轮都会重新发送整段对话。新任务开一个新会话,比拖着巨大的上下文更省。
- 关注实时日志。 控制台 → 日志会实时显示每个请求的模型、token 和权重费用。
- 设置自己的限额。 在设置中配置可选的每日和每周上限,防止失控的循环;在 50%、70%、80% 或 90% 时发送的邮件提醒会告诉你当前进度。
开发者也可以在代码里读取用量。每个响应都带有 x-apmix-weighted-tokens(该请求的消耗)和 x-apmix-remaining(本月剩余额度)。
当月额度不够时
如果额度用完,请求会返回明确的 allowance_exhausted 错误,直到每月重置。你有两种方式立即继续:
- 升级套餐。 立即生效,差价按比例收取。
- 购买加油包。 一次性加油包有 10M、30M、60M 或 100M 权重 token,10M 的价格在 Max 上为 $1.49、Pro 上为 $1.79、Starter 上为 $1.99。加油包在月度额度之后消耗,只要你有套餐就永不过期。
公平的计费
月付套餐在当月额度使用不足 5% 时可全额退款,未使用的加油包在 14 天内可退款。年付套餐不可退款。退款政策列出了每个套餐的具体数字。
还在犹豫?新账号可以获得用于免费模型的免费 token,无需绑卡,这样你可以在选择套餐之前,先看看自己用权重 token 计算的实际用量。创建账号,第一次会话之后看看用量表吧。



