Formel
Belegte Token = System-Prompt + Gesprächsrunden × Token je Runde + aktueller Prompt + reservierte Ausgabe
Belegung = belegte Token ÷ Kontextfenster × 100
Zusätzliche Runden = freier Puffer ÷ Token je Runde
Was das Ergebnis bedeutet
Der Hauptwert zeigt die geplante Kontextbelegung inklusive Antwortreserve. Eine hohe Belegung erhöht das Risiko, dass neue Nachrichten, Tools oder längere Antworten nicht mehr in das Fenster passen.
Der tatsächliche Tokenverbrauch kann je Nachricht schwanken. Plane deshalb einen Sicherheitsabstand statt das Kontextfenster bis zur letzten Token-Einheit auszureizen.