Formel
Gesamt-Token = Anfragen × (Eingabe-Token + Ausgabe-Token)
Gesamtkosten = Eingabe-Token gesamt ÷ 1.000.000 × Eingabepreis + Ausgabe-Token gesamt ÷ 1.000.000 × Ausgabepreis
Was das Ergebnis bedeutet
Der Hauptwert zeigt dein gesamtes modelliertes Tokenvolumen. Die Kostenaufteilung macht sichtbar, ob vor allem Kontext oder generierte Antworten das Budget treiben.
Tokenizer und Abrechnung können modell- und produktabhängig sein. Verwende für die Budgetrechnung möglichst gemessene Tokenzahlen aus deinen eigenen Requests.