#923 · Rechner für KI & Technologie

KI-Sprachagent: Token-Budget-Rechner

Dieser Rechner plant das monatliche Token-Budget eines KI-Sprachagenten anhand von Gesprächsvolumen, durchschnittlicher Gesprächsdauer und gemessenem Tokenverbrauch pro Minute. Ein zusätzlicher Overhead deckt Systemprompts, Tool-Aufrufe, Zusammenfassungen oder Kontextwiederholungen ab. Du erhältst das Gesamtbudget pro Monat, Token pro Gespräch sowie getrennte Input- und Output-Mengen – hilfreich für Kapazitäts- und Kostenplanung, bevor konkrete Modellpreise angewendet werden.

Rechner

Eingaben
Min.
Token
Token
Tage
%

So verwendest du diesen Rechner

  1. Schätze das tägliche Gesprächsvolumen und die durchschnittliche Dauer.
  2. Miss Input- und Output-Token pro Gesprächsminute.
  3. Setze die Zahl der Betriebstage und einen realistischen Overhead.
  4. Nutze das Ergebnis als Tokenkapazität für Modell- und Kostenplanung.

Formel

Basistoken/Monat = Gespräche/Tag × Tage × Minuten/Gespräch × (Input-Token/Min. + Output-Token/Min.)
Token-Budget = Basistoken × (1 + Overhead/100)

Was das Ergebnis bedeutet

Das monatliche Token-Budget ist eine Mengenplanung und noch keine Kostenberechnung. Es zeigt, wie viele Token dein Sprachagent bei den eingegebenen Nutzungsannahmen voraussichtlich verarbeitet. Die getrennten Input- und Output-Werte lassen sich anschließend mit den jeweiligen Modellpreisen multiplizieren.

Tokenraten pro Gesprächsminute hängen stark von Prompting, Transkription, Modell, Tool-Nutzung und Kontextstrategie ab. Verwende möglichst Messwerte aus Produktions- oder Lasttests.

Beispielrechnung

500 Gespräche/Tag × 30 Tage × 4,5 Min. = 67.500 Gesprächsminuten
Input: 50,625 Mio.; Output: 18,900 Mio. Basistoken
Mit 15 % Overhead: 58,219 Mio. Input + 21,735 Mio. Output
Gesamtbudget = 79,954 Mio. Token pro Monat.

Tipps für bessere Ergebnisse

  • Ermittle Tokenraten aus realen Dialoglogs mit anonymisierten Inhalten.
  • Berücksichtige Tool-Aufrufe und Zusammenfassungen im Overhead.
  • Plane Spitzenlasten separat; das Monatsbudget sagt nichts über gleichzeitige Last aus.
  • Vergleiche kurze und lange Gesprächstypen getrennt, wenn die Verteilung stark streut.

Häufig gestellte Fragen

Wie viele Token benötigt ein KI-Sprachagent pro Gesprächsminute?

Das ist systemabhängig. Trage gemessene Input- und Output-Token pro Minute aus deinem eigenen Sprachagenten ein.

Wie plane ich Systemprompt- und Tool-Token im Voice-Agent-Budget ein?

Nutze den Overhead-Prozentsatz, wenn diese Zusatzmengen proportional zum Gesprächsvolumen anfallen.

Soll ich Transkriptions-Token zum Sprachagenten-Tokenbudget addieren?

Nur wenn sie tatsächlich als Modell-Input oder -Output abgerechnet beziehungsweise verarbeitet werden. Reine Audioabrechnung gehört in eine Kostenrechnung.

Wie rechne ich aus dem Token-Budget die Modellkosten aus?

Multipliziere die getrennten Input- und Output-Token mit den jeweiligen Preisen deines Modells pro Token-Einheit.

Warum sollte ich Input- und Output-Token beim Voice Agent getrennt planen?

Weil Modelle häufig unterschiedliche Preise oder Limits für Input und Output haben und beide Anteile unterschiedlich skalieren können.

Kennzahlen im Überblick

KennzahlBedeutung
MonatsbudgetGesamte Input- und Output-Token inklusive Overhead.
Token/GesprächDurchschnittliches Tokenvolumen eines Gesprächs.
Input-TokenMonatliches Eingabetokenvolumen inklusive Overhead.
Output-TokenMonatliches Ausgabetokenvolumen inklusive Overhead.

Rechner-Kategorien entdecken

22 Kategorien