Cómo usar esta calculadora
- Introduce los valores de tu escenario.
- Revisa las unidades y el periodo de referencia.
- Pulsa «Calcular» para actualizar los resultados.
- Compara el resultado principal con los indicadores secundarios.
Calcula el presupuesto de tokens de un agente de voz a partir de duración, ritmo de habla, contexto y respuesta del modelo. Introduce los parámetros operativos de tu escenario y obtén una estimación inmediata con indicadores secundarios que facilitan la planificación. Los resultados son orientativos y dependen de la calidad de los datos introducidos.
El presupuesto total ayuda a prever límites de contexto y costes de inferencia por llamada.
La tokenización real varía según idioma, transcripción, herramientas y formato del prompt.
Una llamada de 8 minutos a 140 palabras por minuto, 1,35 tokens por palabra y 2.500 tokens de contexto requiere cerca de 4.012 tokens.
Utiliza promedios medidos en producción o en una prueba representativa del mismo modelo y hardware.
Solo mediante los márgenes o porcentajes introducidos; conviene probar escenarios de pico por separado.
Sí, siempre que mantengas unidades coherentes en todos los campos relacionados.
El rendimiento real varía por modelo, hardware, red, colas, longitud de entrada y concurrencia.
Ejecuta una prueba de carga, compara métricas observadas y ajusta los supuestos de la calculadora.
| Supuesto | Revisión |
|---|---|
| Carga media | Usar datos representativos |
| Margen | Probar picos y fallos |