Formel
GPU-Bedarf = (Workload-GPU-Stunden ÷ Deadline) ÷ Auslastung ÷ Parallelisierungseffizienz × (1 + Sicherheitsreserve)
Was das Ergebnis bedeutet
Das Ergebnis ist eine aufgerundete Kapazitätsschätzung. Sinkende Auslastung oder Parallelisierungseffizienz erhöht die Zahl benötigter GPUs; eine Sicherheitsreserve schafft zusätzlichen Puffer für Schwankungen.
Die Parallelisierungseffizienz ist besonders wichtig: Eine Workload mit starken seriellen Anteilen kann trotz vieler GPUs nicht proportional schneller werden.