#445 · Rechner für KI & Technologie

LLM-Prompt-Kostenrechner

Analysiere die Kosten einzelner LLM-Prompts auf Basis von Systemprompt, Nutzereingabe, zusätzlichem Kontext und erwarteter Antwortlänge. So erkennst du, welche Promptbestandteile die laufenden Modellkosten treiben und was eine Optimierung pro 1.000 Aufrufe bewirkt.

Rechner

Eingaben & Annahmen
Tokens
Tokens
Tokens
Tokens
€/1 Mio.
€/1 Mio.

So verwendest du diesen Rechner

  1. Trage dein erwartetes Nutzungs- oder Produktionsvolumen ein.
  2. Ergänze die für deinen Anbieter bzw. Workflow passenden Preis- und Mengenwerte.
  3. Klicke auf Berechnen.
  4. Nutze Haupt- und Nebenresultate für Budgetierung und Variantenvergleich.

Formel

Input-Tokens je Aufruf = System + Nutzer + Kontext; Kosten = Aufrufe × (Input-Tokens × Inputpreis + Output-Tokens × Outputpreis) ÷ 1.000.000

Was das Ergebnis bedeutet

Das Hauptergebnis zeigt die Gesamtkosten des Prompt-Designs. Die Inputkosten machen sichtbar, wie stark langer System- oder Kontexttext ins Gewicht fällt.

Tokenzahlen unterscheiden sich je Modell und Tokenizer. Verwende für genaue Planung Messwerte aus deinem tatsächlichen Modellstack.

Beispielrechnung

25.000 Aufrufe mit 2.000 Input-Tokens und 400 Output-Tokens kosten bei 2 € und 8 € je Million Tokens insgesamt 180,00 €.

Tipps für bessere Ergebnisse

  • Entferne redundante Anweisungen im Systemprompt.
  • Übermittle nur relevanten Kontext.
  • Nutze strukturierte, knappe Ausgaben.
  • Teste Promptqualität nach Kürzungen erneut.
  • Vergleiche Kosten je Aufruf vor und nach Änderungen.

Häufig gestellte Fragen

Wie viel kostet ein langer Systemprompt bei vielen LLM-Aufrufen?

Die Systemprompt-Tokens werden bei jedem Aufruf als Input berücksichtigt und skalieren daher direkt mit der Anzahl der Aufrufe.

Wie kann ich die Kosten eines RAG-Kontexts im Prompt abschätzen?

Trage die durchschnittlich zusätzlich eingeblendeten Kontext-Tokens in das Feld Kontext-Tokens ein.

Was bringt es, einen Prompt um 500 Tokens zu kürzen?

Die Ersparnis entspricht 500 Tokens × Aufrufe × Inputpreis ÷ 1.000.000.

Wie berücksichtige ich variable Nutzerfragen?

Verwende einen realistischen Durchschnitt der Nutzereingabe-Tokens aus Logs oder Stichproben.

Kann ich mit diesem Rechner verschiedene Promptversionen vergleichen?

Ja. Berechne jede Version mit ihren jeweiligen Tokenmengen und vergleiche Gesamtkosten sowie Kosten je Aufruf.

Kennzahlen im Überblick

KennzahlBedeutung
HauptergebnisGeschätzte Gesamtkosten für die eingegebenen Annahmen
NebenresultateTreiber, Stückkosten oder Teilkosten zur besseren Einordnung

Rechner-Kategorien entdecken

22 Kategorien