#803 · Rechner für KI & Technologie

GPU-Bedarfsrechner für synthetische Daten

Dimensioniere die GPU-Flotte für synthetische Datengenerierung anhand eines messbaren Tokenziels statt anhand grober Hardwareannahmen. Der Rechner kombiniert täglichen Tokenbedarf, nachhaltigen Token-Durchsatz je GPU, Zielauslastung, verfügbares Zeitfenster und Kapazitätsreserve. Das Ergebnis zeigt sowohl den rechnerischen Grundbedarf als auch die auf ganze GPUs aufgerundete Flottengröße.

Rechner

Tokenvolumen und GPU-Leistung
Token
Gesamter täglicher Tokenbedarf der Pipeline.
Token/s
Nachhaltiger Token-Durchsatz einer GPU für dein Modell.
%
Geplante nutzbare GPU-Auslastung.
h
Zeitfenster, in dem die Generierung laufen darf.
%
Zusätzliche Reserve für Spitzen, Ausfälle und Wartung.

So verwendest du diesen Rechner

  1. Bestimme das tägliche Tokenvolumen.
  2. Miss den nachhaltigen Durchsatz je GPU.
  3. Setze Zielauslastung und verfügbares Zeitfenster.
  4. Ergänze eine Reserve und berechne die ganze GPU-Zahl.

Formel

Token je GPU/Tag = Token/s je GPU × Auslastung × 3.600 × Stunden
GPU-Bedarf = Tokenziel ÷ Token je GPU/Tag × (1 + Reserve)

Was das Ergebnis bedeutet

Der Grundbedarf ist ein kontinuierlicher GPU-Wert. Für die reale Beschaffung oder Reservierung wird der Wert inklusive Reserve auf die nächste ganze GPU aufgerundet.

Der Durchsatz kann sich durch Modellgröße, Quantisierung, Batchgröße, Sequenzlänge, Framework und Speichergrenzen stark verändern. Nutze möglichst eigene Lasttests.

Beispielrechnung

Bei 1,2 Milliarden Token pro Tag, 180 Token/s je GPU, 70 % Zielauslastung und 20 Betriebsstunden verarbeitet eine GPU etwa 9.072.000 Token täglich. Der Grundbedarf liegt bei rund 132,28 GPUs; mit 20 % Reserve werden 159 GPUs benötigt.

Tipps für bessere Ergebnisse

  • Nutze nachhaltige statt maximale Benchmarkwerte.
  • Teste typische Prompt- und Ausgabelängen.
  • Plane Speicherbedarf und Batchgröße gemeinsam mit dem Durchsatz.
  • Berücksichtige Wartung, Fehlversuche und Lastspitzen.
  • Vergleiche Flottenvarianten zusätzlich über Kosten pro Million Token.

Häufig gestellte Fragen

Wie viele GPUs brauche ich für ein tägliches Tokenvolumen synthetischer Daten?

Teile das tägliche Tokenvolumen durch den gemessenen nutzbaren Token-Durchsatz einer GPU über das verfügbare Zeitfenster und ergänze anschließend die gewünschte Kapazitätsreserve.

Welchen Token-Durchsatz je GPU sollte ich für die Planung verwenden?

Verwende einen gemessenen nachhaltigen Wert mit deinem konkreten Modell, Präzisionsformat, Batch-Setup und typischen Sequenzlängen statt eines theoretischen Spitzenwerts.

Warum berücksichtigt der Rechner eine Zielauslastung unter 100 Prozent?

Damit die Planung Puffer für schwankende Sequenzlängen, Speichergrenzen, Synchronisation, Wartung und andere Engpässe enthält.

Wie plane ich GPU-Reserve für Ausfälle bei synthetischer Datengenerierung?

Trage eine zusätzliche Kapazitätsreserve ein. Der Rechner erhöht den rechnerischen Grundbedarf um diesen Prozentsatz und rundet auf ganze GPUs auf.

Kann ich unterschiedliche GPU-Typen mit diesem Rechner vergleichen?

Ja. Berechne jede GPU-Konfiguration separat mit ihrem tatsächlich gemessenen Token-Durchsatz und vergleiche anschließend GPU-Zahl, Laufzeit und Kosten.

GPU-Planungsmodule

KennzahlBedeutung
TokenzielTägliche zu verarbeitende Tokenmenge
GPU-DurchsatzGemessene Leistung je Beschleuniger
AuslastungNutzbarer Anteil der theoretischen Laufzeit
ReserveZusätzliche Kapazität für Unsicherheit

Rechner-Kategorien entdecken

22 Kategorien