Gewichtete Tokens, erklärt: den richtigen Tarif wählen und länger damit auskommen
Wie apmix die Nutzung aller Modelle mit einem Kontingent misst, wie du einen Tarif in echte Tokens auf jedem Modell umrechnest, und praktische Wege, dein Monatskontingent zu strecken.
Das apmix TeamVeröffentlicht 3 Min. Lesezeit
Auf dieser Seite
Jedes Modell hat einen anderen Preis. Ein Token eines schnellen Modells kostet einen Bruchteil eines Tokens eines Frontier-Modells, und Reasoning-Modi kosten noch mehr. Die meisten Gateways lösen das mit einer Preisliste pro Modell und einer Rechnung, die man erst am Monatsende versteht. apmix nutzt stattdessen eine Einheit für alles: den gewichteten Token.
Eine Einheit für alle Modelle
Dein Tarif ist ein monatliches Budget an gewichteten Tokens, geteilt von allen Modellen im Tarif und allen Schlüsseln deines Kontos. Jedes Modell hat einen Multiplikator: wie viele gewichtete Tokens ein echter Token auf diesem Modell kostet.
- Auf einem 1×-Modell kostet ein echter Token einen gewichteten Token.
- Auf einem 3×-Modell kostet derselbe Token drei.
- Eingabe- und Ausgabe-Tokens werden beide gezählt, Reasoning-Tokens eingeschlossen, und dann mit dem Faktor des Modells multipliziert.
Ein Austausch von 1.000 Tokens kostet also 1.000 gewichtete Tokens auf einem 1×-Modell und 3.000 auf einem 3×-Modell. Multiplikatoren werden pro Modell festgelegt; die Preisseite, die Seite jedes Modells und dein Dashboard zeigen immer den aktuellen Wert.
Einen Tarif in echte Tokens umrechnen
Die nützliche Frage ist nicht „Wie viele gewichtete Tokens bekomme ich?“, sondern „Wie viel kann ich an das Modell, das ich nutze, tatsächlich schicken?“. Die Antwort ist eine Division:
Echte Tokens pro Monat = Kontingent des Tarifs ÷ Multiplikator des Modells
So viel bringt das Monatskontingent jedes Tarifs bei einigen Multiplikatoren:
Zum Zeitpunkt dieses Artikels kosten manche schnellen Modelle sogar weniger als 1×: Bei 0,5× bringt das Starter-Kontingent von 60M 120M echte Tokens, bei 0,1× sind es 600M.

Die Preisseite rechnet das für jedes Modell im Katalog aus, sodass du die genaue Zahl für deine Modelle prüfen kannst, bevor du einen Tarif wählst.
Welcher Tarif passt zu dir?
- Starter (4,99 $/Monat, 60M) passt zu Nebenprojekten, Tests und gelegentlichen Agent-Sitzungen, vor allem auf schnellen Modellen.
- Pro (14,99 $/Monat, 200M) ist für tägliches Programmieren mit CLI-Agents wie Claude Code oder Codex gemacht und bringt mehr Modelle mit.
- Max (29,99 $/Monat, 500M) ist für schwere Agent-Workloads den ganzen Tag. Er deckt den gesamten Katalog ab, erlaubt unbegrenzt viele Schlüssel und bekommt Priority-Routing.
Die Tarife sind gestaffelt: Ein höherer Tarif enthält jedes Modell der Tarife darunter. Jährliche Abrechnung bietet dasselbe Monatskontingent für zwölf Monate zu einem niedrigeren Preis, in einer Zahlung.

Das Kontingent strecken
Ein paar Gewohnheiten machen einen echten Unterschied, besonders bei Agents, die lange Kontexte schicken:
- Wähle das Modell passend zur Aufgabe. Nimm für Routineänderungen, Tests und kleine Refactorings ein schnelles Modell mit niedrigem Multiplikator und wechsle für die schweren Teile zu einem Frontier-Modell. Dasselbe Kontingent reicht auf einem 1×-Modell drei- bis fünfmal weiter als auf einem 3×- oder 5×-Modell.
- Setz Reasoning-Modi bewusst ein. Sie zählen zu höheren Faktoren. Schalte sie für Architektur und knifflige Bugs ein, nicht zum Umbenennen von Variablen.
- Halte Agent-Sitzungen fokussiert. Jeder Schritt schickt die Unterhaltung erneut. Eine neue Sitzung für eine neue Aufgabe ist günstiger, als einen riesigen Kontext mitzuschleppen.
- Behalte die Live-Logs im Blick. Dashboard → Logs zeigt jede Anfrage mit Modell, Tokens und gewichteten Kosten, während sie passiert.
- Leg eigene Limits fest. Optionale Tages- und Wochenlimits in den Einstellungen stoppen eine außer Kontrolle geratene Schleife, und E-Mail-Hinweise bei 50, 70, 80 oder 90 % zeigen dir, wo du stehst.
Entwickler können den Zähler auch im Code auslesen. Jede Antwort enthält x-apmix-weighted-tokens mit den Kosten dieser Anfrage und x-apmix-remaining mit dem Rest des Monats.
Wenn ein Monat knapp wird
Wenn das Kontingent aufgebraucht ist, liefern Anfragen bis zum monatlichen Reset einen klaren allowance_exhausted-Fehler. Du hast zwei Wege, sofort weiterzumachen:
- Upgrade. Es greift sofort, und die Differenz wird anteilig berechnet.
- Eine Aufladung kaufen. Einmalige Pakete mit 10M, 30M, 60M oder 100M gewichteten Tokens, für 10M ab 1,49 $ bei Max, 1,79 $ bei Pro und 1,99 $ bei Starter. Aufladungen werden nach dem Monatskontingent verbraucht und verfallen nie, solange du einen Tarif hast.
Faire Abrechnung
Monatstarife werden vollständig erstattet, solange weniger als 5 % des Monatskontingents verbraucht sind, und ungenutzte Aufladungen sind 14 Tage lang erstattungsfähig. Jahrestarife werden nicht erstattet. Die Erstattungsrichtlinie enthält die genauen Zahlen für jeden Tarif.
Noch unentschlossen? Neue Konten bekommen kostenlose Tokens für die kostenlosen Modelle, ohne Karte. So siehst du deine eigene Nutzung in gewichteten Tokens, bevor du einen Tarif wählst. Erstell ein Konto und schau nach deiner ersten Sitzung auf den Zähler.



