本文へスキップ

加重トークン解説:自分に合うプランを選び、利用枠を長持ちさせる

apmix が 1 つの利用枠ですべてのモデルの使用量をどう計測するのか、プランを各モデルの実トークンに換算する方法、そして月の利用枠を長持ちさせる実践的なコツを解説します。

apmix チーム公開 5 分で読めます
白い台の上で半透明の円盤が高さを変えて積み重なり、小さな黒い重りで釣り合っている。
このページの内容
  1. すべてのモデルに共通の単位
  2. プランを実トークンに換算する
  3. どのプランが合う?
  4. 利用枠を長持ちさせるコツ
  5. 月の途中で足りなくなったら
  6. 公正な請求

モデルの価格はそれぞれ違います。高速モデルの 1 トークンはフロンティアモデルの何分の一かで、推論モードはさらに高くなります。多くのゲートウェイはモデルごとの価格表で対応し、月末になってようやく分かる請求書を送ってきます。apmix はその代わりに、すべてに共通の単位を使います。それが加重トークンです。

すべてのモデルに共通の単位

プランは加重トークンの月間予算で、プランに含まれるすべてのモデルとアカウントのすべてのキーで共有されます。各モデルには倍率があります。そのモデルで実際の 1 トークンが、加重トークンいくつ分になるかという数字です。

  • 1× のモデルでは、実トークン 1 つが加重トークン 1 つです。
  • 3× のモデルでは、同じトークンが 3 つ分になります。
  • 入力と出力のトークンは、推論トークンも含めてすべて数えられ、モデルの倍率が掛けられます。

つまり 1,000 トークンのやり取りは、1× のモデルなら 1,000 加重トークン、3× のモデルなら 3,000 加重トークンです。倍率はモデルごとに設定され、料金ページ、各モデルのページ、ダッシュボードに常に最新の値が表示されます。

プランを実トークンに換算する

大事なのは「加重トークンがいくつあるか」ではなく「使っているモデルに実際どれだけ送れるか」です。答えは割り算 1 回で出ます。

月の実トークン = プランの利用枠 ÷ モデルの倍率

各プランの月間利用枠が、いくつかの倍率でどれだけの実トークンになるかをまとめました。

プラン利用枠1×2×3×5×
Starter60M60M30M20M12M
Pro200M200M100M66.7M40M
Max500M500M250M166.7M100M

執筆時点では、倍率が 1× 未満の高速モデルもあります。0.5× なら Starter の 60M で 120M、0.1× なら 600M の実トークンを使えます。

apmix 料金ページのモデル倍率表
料金ページの倍率表:各モデルの倍率と、各プランでそのモデルに使える実トークン。

料金ページではカタログ内のすべてのモデルについてこの計算が載っているので、プランを選ぶ前に、よく使うモデルの正確な数字を確認できます。

どのプランが合う?

  • Starter(月額 $4.99、60M):個人プロジェクトや評価、ときどきのエージェント作業に。主に高速モデルを使う方向けです。
  • Pro(月額 $14.99、200M):Claude Code や Codex のような CLI エージェントで毎日コーディングする方向けで、使えるモデルも増えます。
  • Max(月額 $29.99、500M):一日中エージェントを動かす重いワークロード向け。カタログ全体を使え、API キーは無制限、優先ルーティングも付きます。

プランは段階制で、上位プランには下位プランのすべてのモデルが含まれます。年払いは同じ月間利用枠を 12 か月分、より安い料金で一括払いするものです。

apmix のプラン:Starter、Pro、Max
3 つのプラン。年払いなら同じ月間利用枠をより安く使えます。

利用枠を長持ちさせるコツ

特に長いコンテキストを送るエージェントでは、いくつかの習慣で大きな差が出ます。

  1. 作業に合わせてモデルを選ぶ。 日常的な修正やテスト、小さなリファクタリングには倍率の低い高速モデルを使い、難しい部分だけフロンティアモデルに切り替えます。同じ利用枠でも、1× のモデルなら 3× や 5× のモデルより 3〜5 倍長く使えます。
  2. 推論モードは目的を持って使う。 推論モードは高い倍率で数えられます。設計や厄介なバグには使い、変数名の変更には使わないようにしましょう。
  3. エージェントのセッションを絞り込む。 毎ターン、会話全体が送り直されます。新しいタスクは新しいセッションで始めたほうが、巨大なコンテキストを引きずるより安く済みます。
  4. ライブログを見る。 「ダッシュボード → ログ」では、すべてのリクエストのモデル、トークン数、加重コストがリアルタイムで表示されます。
  5. 自分で上限を決める。 設定で任意の 1 日・1 週間の上限を決めれば暴走したループを止められ、50%、70%、80%、90% で届くメール通知で現在地が分かります。

開発者はコードからも使用量を読み取れます。すべてのレスポンスに、そのリクエストのコストを示す x-apmix-weighted-tokens と、月の残りを示す x-apmix-remaining が付きます。

月の途中で足りなくなったら

利用枠を使い切ると、月のリセットまでリクエストには分かりやすい allowance_exhausted エラーが返ります。すぐに作業を続ける方法は 2 つあります。

  • アップグレードする。 すぐに反映され、差額は日割りで請求されます。
  • 追加チャージを購入する。 10M、30M、60M、100M 加重トークンの 1 回限りのパックで、10M なら Max で $1.49、Pro で $1.79、Starter で $1.99 です。追加チャージ分は月間利用枠の後に消費され、プランがある限り有効期限はありません。

公正な請求

月額プランは、その月の利用枠の使用が 5% 未満なら全額返金され、未使用の追加チャージは 14 日間返金できます。年額プランは返金できません。プランごとの正確な数字は返金ポリシーをご覧ください。

まだ迷っていますか?新規アカウントには無料モデルで使える無料トークンが付き、カード登録は不要です。プランを選ぶ前に、自分の使い方が加重トークンでどれくらいになるかを確かめられます。アカウントを作成して、最初のセッションの後にメーターを見てみてください。

トップモデルのすべてを、1 つのキーで。

GPT、Claude、Gemini、Grok、DeepSeek、Qwen を 1 つの API キーと 1 つの月額プランで。いつものツールがそのまま使えます。

登録で 10M の無料トークン。カード登録は不要です。