Formel
Eingabekosten = Anfragen × Eingabe-Token ÷ 1.000.000 × Eingabepreis
Ausgabekosten = Anfragen × Ausgabe-Token ÷ 1.000.000 × Ausgabepreis
Gesamtkosten = Eingabekosten + Ausgabekosten
Was das Ergebnis bedeutet
Der Hauptwert ist die geschätzte Monatsrechnung für die modellierte Inferenzlast. Die Nebenwerte zeigen, welcher Token-Typ die Kosten treibt und wie viel eine typische Anfrage kostet.
Caching, Batch-Rabatte, Sondertarife, zusätzliche Tools und andere abrechenbare Leistungen sind nur berücksichtigt, wenn du sie in den eingegebenen effektiven Tarifen abbildest.