#472 · Herramienta de IA y tecnología

Calculadora de inferencia de OpenAI

Proyecta el coste de inferencia de una aplicación basada en OpenAI sin depender de una tarifa fija. Introduce solicitudes, tokens de entrada y salida, precios por millón de tokens y margen de seguridad para estimar el gasto mensual y el coste medio por solicitud.

Calculadora

Datos del escenario
solicitudes
tokens
tokens
USD
USD
%

Cómo usar esta calculadora

  1. Introduce el volumen y las características de uso.
  2. Añade las tarifas o límites aplicables a tu modelo.
  3. Revisa que todas las unidades sean coherentes.
  4. Pulsa «Calcular» y analiza el resultado principal y los indicadores secundarios.
  5. Prueba escenarios alternativos antes de tomar una decisión.

Fórmula

Coste = solicitudes × tokens de entrada ÷ 1.000.000 × tarifa de entrada + solicitudes × tokens de salida ÷ 1.000.000 × tarifa de salida

Qué significa el resultado

El total combina el consumo de entrada y salida y añade el margen seleccionado. El coste por solicitud ayuda a comparar diseños de prompt y límites de respuesta.

Las tarifas cambian según el modelo, el proveedor, el procesamiento por lotes y otros descuentos. Introduce siempre precios actuales.

Ejemplo de cálculo

Para 100.000 solicitudes de 800 tokens de entrada y 300 de salida, con tarifas de 2,50 y 10 USD por millón, el coste base es 500 USD. Con un 15 % de margen, el presupuesto es 575 USD.

Consejos para obtener mejores resultados

  • Usa percentiles reales de tokens, no solo el promedio.
  • Separa tráfico interactivo y por lotes.
  • Limita respuestas innecesariamente largas.
  • Incluye reintentos y llamadas fallidas.
  • Revisa periódicamente las tarifas.

Preguntas frecuentes

¿Por qué se separan los tokens de entrada y salida?

Porque normalmente tienen precios distintos y su proporción cambia según el caso de uso.

¿El margen de seguridad sustituye una previsión de crecimiento?

No. El margen cubre variación; el crecimiento previsto debe reflejarse en el número de solicitudes.

¿Cómo incluyo reintentos automáticos?

Aumenta las solicitudes mensuales según la tasa esperada de reintentos.

¿Puedo comparar dos modelos?

Sí. Mantén el mismo volumen y tokens y cambia las dos tarifas para cada modelo.

¿Esta calculadora consulta precios en tiempo real?

No. Las tarifas son entradas manuales para evitar utilizar datos que puedan quedar obsoletos.

Componentes del coste

ComponenteCálculo
EntradaTokens de prompt por su tarifa.
SalidaTokens generados por su tarifa.
MargenReserva sobre el coste base.

Explora las categorías de calculadoras

22 categorías