Cómo usar esta calculadora
- Introduce la tasa máxima de evaluaciones.
- Añade el tiempo de GPU medido por evaluación.
- Define la utilización máxima permitida.
- Indica cuántas GPU quieres reservar por redundancia.
Calcula cuántas GPU necesita un servicio de detección de fraude para atender una tasa determinada de evaluaciones. La estimación combina la demanda por segundo, el tiempo de cómputo de cada evaluación, la utilización máxima deseada y un factor de redundancia. El resultado redondea hacia arriba para ofrecer un número entero de GPU y separa la capacidad operativa de la reserva adicional.
GPU operativas = redondeo superior de [evaluaciones/s ÷ ((1.000 ÷ ms por evaluación) × utilización)]
El resultado es una aproximación de unidades equivalentes de GPU. El rendimiento real depende del modelo, memoria, lote, precisión y arquitectura.
No sustituye una prueba de carga. Usa tiempos medidos en la misma clase de GPU y configuración que desplegarás.
Con 180 eval/s, 35 ms por evaluación y 75 % de utilización, cada GPU sostiene 21,43 eval/s. Se necesitan 9 GPU operativas; con una de reserva, el total es 10 GPU.
Solo si el tiempo por evaluación se ha medido en esa misma clase y configuración de GPU.
Porque una fracción de GPU no puede cubrir por sí sola la capacidad requerida en un despliegue dedicado.
Introduce el tiempo efectivo por evaluación después de dividir el tiempo del lote entre su tamaño.
Sí. Se suma al número operativo y puede absorber fallos o picos si está disponible.
No. Debes comprobar por separado que el modelo y el lote caben en la memoria disponible.
| Dato | Interpretación |
|---|---|
| Tiempo por evaluación | Medido en la GPU objetivo. |
| Utilización | Límite para conservar margen operativo. |
| Redundancia | Unidades adicionales fuera del mínimo calculado. |