#998 · Herramienta de IA y tecnología

Calculadora de capacidad por latencia para asistentes de reuniones con IA

Estima cuántas solicitudes por minuto puede atender una infraestructura de asistentes de reuniones con IA y comprueba si cumple una latencia objetivo. La calculadora utiliza la duración media, el factor de tiempo real, la concurrencia y la sobrecarga para mostrar capacidad, utilización y recursos mínimos.

Calculadora

Llegadas, proceso y objetivo
sol/min
min
RTF
unidades
min
%

Cómo usar esta calculadora

  1. Indica la tasa de llegada de solicitudes.
  2. Introduce la duración media y el factor de tiempo real.
  3. Define la concurrencia disponible.
  4. Añade la sobrecarga operativa y la latencia objetivo.
  5. Comprueba capacidad, utilización y recursos mínimos.

Fórmula

Tiempo de servicio = duración × RTF ÷ (1 − sobrecarga); capacidad = trabajadores ÷ tiempo de servicio

Qué significa el resultado

La capacidad indica cuántas solicitudes pueden finalizar por minuto. Una utilización igual o superior al 100 % implica acumulación sostenida de cola.

Es un modelo de capacidad media. Las ráfagas, colas, límites de API y variaciones de duración pueden elevar la latencia real.

Ejemplo de cálculo

Con 20 solicitudes por minuto, reuniones de 30 minutos, RTF 0,25, 8 trabajadores y 10 % de sobrecarga, la capacidad es de 0,96 solicitudes por minuto; se necesitarían 167 trabajadores para sostener la llegada.

Consejos para obtener mejores resultados

  • Dimensiona con percentiles, no solo promedios.
  • Mantén margen de capacidad para ráfagas.
  • Mide por separado carga y descarga de archivos.
  • Vigila límites de concurrencia externos.
  • Reduce el RTF con lotes o modelos optimizados.

Preguntas frecuentes

¿Qué significa un factor de tiempo real de 0,25?

Significa que procesar un minuto de audio requiere aproximadamente 0,25 minutos de cómputo en un trabajador.

¿Por qué una utilización del 100 % es problemática?

Porque no queda margen para variaciones; cualquier ráfaga o tarea larga puede generar una cola creciente.

¿La latencia objetivo incluye el tiempo en cola?

La comparación principal usa el tiempo de servicio. Para una previsión completa debes añadir el tiempo de cola y de transferencia.

¿Cómo incluyo la sobrecarga de red y almacenamiento?

Usa el porcentaje de sobrecarga o mide esos tiempos y conviértelos en un factor equivalente.

¿Puedo usar la calculadora para procesamiento por lotes?

Sí, pero interpreta la tasa de llegada como carga media del lote durante su ventana de ejecución.

Indicadores de capacidad

IndicadorInterpretación
RTFTiempo de proceso dividido por duración del audio
UtilizaciónDemanda dividida por capacidad
Tiempo de servicioProceso medio por solicitud

Explora las categorías de calculadoras

22 categorías