Formel
Tägliche Tokenlast = Tickets × KI-Antworten je Ticket × Tokens je Antwort
GPU-Bedarf = Tägliche Tokenlast ÷ (Token/s je GPU × Auslastung × 3.600 × Stunden) × Spitzenlastfaktor
Was das Ergebnis bedeutet
Der durchschnittliche GPU-Bedarf deckt die Tagesmenge bei gleichmäßig verteilter Last. Der Spitzenwert skaliert diesen Bedarf mit dem erwarteten Burst-Faktor und wird für die Hauptkennzahl auf ganze GPUs aufgerundet.
Ein Tagesdurchschnitt ersetzt keine zeitliche Lastanalyse. Für strenge Antwortzeit-Ziele sollten stündliche oder minutenbasierte Spitzen zusätzlich geprüft werden.