#784 · Rechner für KI & Technologie

RAG-Kosten-pro-Aufgabe-Rechner

Dieser Rechner zerlegt die Kosten einer RAG-Aufgabe in Modell-, Retrieval- und Infrastrukturanteile. Du gibst Tokenmengen und frei wählbare Preise ein, ergänzt Retrieval- und Laufzeitkosten und kannst eine Cache-Trefferquote berücksichtigen. So erhältst du Kosten pro Aufgabe und eine Hochrechnung für dein Monatsvolumen.

Rechner

Technische Annahmen
Token
Token
%

So verwendest du diesen Rechner

  1. Trage deine gemessenen oder geplanten Systemwerte ein.
  2. Verwende realistische Produktionswerte statt theoretischer Maximalwerte.
  3. Klicke auf „Berechnen“ und prüfe Haupt- sowie Nebenresultate.
  4. Vergleiche bei Unsicherheit mehrere Szenarien mit konservativeren Annahmen.

Formel

Modellkosten = (Eingabe-Token × Eingabepreis + Ausgabe-Token × Ausgabepreis) ÷ 1.000.000
Durchschnittskosten = Vollkosten × (1 − Cachequote) + Cache-Kosten × Cachequote

Was das Ergebnis bedeutet

Die Hauptzahl zeigt die durchschnittlichen variablen Kosten einer Aufgabe unter deinen Preis- und Cache-Annahmen. Die Monatskosten skalieren diesen Wert mit deinem Volumen.

Preise ändern sich je Anbieter, Modell und Region. Trage daher deine aktuellen vertraglichen Werte ein.

Beispielrechnung

Bei 1.800 Eingabe-Token zu 2,50 € je Million, 450 Ausgabe-Token zu 10 € je Million, 0,0015 € Retrieval und 0,002 € Infrastruktur kostet eine nicht gecachte Aufgabe 0,0125 €. Mit 20 % Cachequote sinkt der Durchschnitt auf rund 0,0104 €.

Tipps für bessere Ergebnisse

  • Nutze nach Möglichkeit Messwerte aus Lasttests oder Produktionsmetriken.
  • Plane Reserve für Lastspitzen, Retries und Komponenten-Overhead ein.
  • Teste Änderungen an Chunking, Caching, Parallelität oder Hardware getrennt, damit Effekte messbar bleiben.
  • Überprüfe Annahmen erneut, wenn Modell, Index, Datenvolumen oder Traffic-Mix geändert werden.

Häufig gestellte Fragen

Wie berechne ich RAG-Kosten pro Anfrage mit Ein- und Ausgabe-Token?

Bewerte beide Tokenarten mit ihren jeweiligen Preisen und addiere Retrieval- sowie Infrastrukturkosten pro Aufgabe.

Sollten Vektordatenbankkosten in die RAG-Kosten pro Aufgabe einfließen?

Ja, wenn du sie sinnvoll auf Anfragen umlegen kannst. Du kannst sie im Feld Retrieval-Kosten pro Aufgabe abbilden.

Wie wirkt sich Prompt-Caching auf die RAG-Kosten aus?

Bei echten Cache-Treffern können bestimmte Modell- und Retrievalkosten entfallen oder sinken. Der Rechner modelliert dafür einen vereinfachten Cache-Kostenpfad.

Wie rechne ich feste Serverkosten in Kosten pro Aufgabe um?

Teile die erwarteten monatlichen Fixkosten durch das Monatsvolumen und trage den Anteil als sonstige Infrastruktur pro Aufgabe ein.

Warum sollte ich aktuelle Modellpreise selbst eingeben?

Tokenpreise können sich ändern und hängen von Modell, Anbieter, Tarif und Region ab; feste Werte würden schnell veralten.

Kennzahlen im Überblick

KennzahlBedeutung
ModellkostenTokenbasierter Anteil je Aufgabe.
MonatskostenDurchschnittskosten multipliziert mit Monatsvolumen.
Cache-ErsparnisDifferenz zwischen Vollkosten und gemittelten Kosten.

Rechner-Kategorien entdecken

22 Kategorien