Cuánto cuesta tu agente
1. Cómo es tu ejecución
Un paso = una llamada al modelo. Cada herramienta que lanza el agente y cada fichero que lee se quedan en el contexto y viajan otra vez en el paso siguiente.
Llamadas al modelo hasta que termina la tarea.
Instrucciones, CLAUDE.md y definiciones de herramientas. Un CLAUDE.md de 200 líneas ronda los 3.000; las herramientas de un agente tipo Claude Code, 10-12k.
Lo que devuelve la herramienta más lo que escribe el agente. Leer un fichero de 300 líneas son ~4.000 tokens; un grep, unos cientos.
Lo que el modelo escribe en cada vuelta.
25 pasos · 64.000 tokens de entrada en el último · 176 ejecuciones al mes
¿No sabes cuántos tokens es tu CLAUDE.md? Pégalo en el contador de tokens y vuelve con el número.
2. Con qué modelo
Los modelos con caché de prompt y al menos 200k de contexto, uno o dos por laboratorio. Precios de models.dev a fecha 2026-08-29.
3. Lo que te cuesta
Calculado con Claude Opus 5. Cámbialo arriba si tu agente usa otro.
Al mes con caché
184 $
≈ 158 €
176 ejecuciones. Es lo que pagas si tu agente cachea, como hacen Claude Code, Codex y Cursor.
Al mes sin caché
792 $
≈ 680 €
4,50 $ por ejecución de 25 pasos
Lo que te ahorra la caché
608 $
≈ 523 €
al mes, solo por reutilizar el contexto que ya mandaste
El paso 25 manda 64.000 tokens de entrada, así que cuesta 11× lo que el paso 1. Esa es la curva que no se ve hasta que llega la factura.
Ese número merece una captura
El enlace lleva tu configuración: quien lo abra ve tu mismo cálculo.
4. Paso a paso
La misma ejecución desglosada. Fíjate en cómo la columna de contexto arrastra a la del coste.
| Paso | Contexto de entrada | Coste sin caché | Coste con caché | Peso del paso |
|---|---|---|---|---|
| 1 | 4000 | 0,03 $ | 0,04 $ | 9,1% |
| 2 | 6500 | 0,04 $ | 0,03 $ | 12,9% |
| 3 | 9000 | 0,06 $ | 0,03 $ | 16,7% |
| 4 | 11.500 | 0,07 $ | 0,03 $ | 20,5% |
| 5 | 14.000 | 0,08 $ | 0,03 $ | 24,2% |
| 6 | 16.500 | 0,09 $ | 0,03 $ | 28% |
| 7 | 19.000 | 0,11 $ | 0,03 $ | 31,8% |
| 8 | 21.500 | 0,12 $ | 0,04 $ | 35,6% |
| 9 | 24.000 | 0,13 $ | 0,04 $ | 39,4% |
| 10 | 26.500 | 0,14 $ | 0,04 $ | 43,2% |
| 11 | 29.000 | 0,16 $ | 0,04 $ | 47% |
| 12 | 31.500 | 0,17 $ | 0,04 $ | 50,8% |
| 13 | 34.000 | 0,18 $ | 0,04 $ | 54,5% |
| 14 | 36.500 | 0,19 $ | 0,04 $ | 58,3% |
| 15 | 39.000 | 0,21 $ | 0,04 $ | 62,1% |
| 16 | 41.500 | 0,22 $ | 0,05 $ | 65,9% |
| 17 | 44.000 | 0,23 $ | 0,05 $ | 69,7% |
| 18 | 46.500 | 0,24 $ | 0,05 $ | 73,5% |
| 19 | 49.000 | 0,26 $ | 0,05 $ | 77,3% |
| 20 | 51.500 | 0,27 $ | 0,05 $ | 81,1% |
| 21 | 54.000 | 0,28 $ | 0,05 $ | 84,8% |
| 22 | 56.500 | 0,29 $ | 0,05 $ | 88,6% |
| 23 | 59.000 | 0,31 $ | 0,05 $ | 92,4% |
| 24 | 61.500 | 0,32 $ | 0,06 $ | 96,2% |
| 25 | 64.000 | 0,33 $ | 0,06 $ | 100% |
En el paso 1 la caché sale más cara: no es un fallo. Escribir en caché cuesta un 25 % más, y esa inversión se recupera desde el paso 2, cuando el mismo contexto se relee a una décima parte del precio.
El modelo de caché es el de Anthropic: el prefijo estable se escribe una vez y se relee en cada paso. OpenAI y Google la aplican solas, sin cobrar por escribirla.
Se asume que el contexto solo crece: un agente real compacta o tira historial cerca del límite, así que en ejecuciones largas esta cifra es el techo, no la factura. Tampoco cuenta tokens de razonamiento aparte ni reintentos — son estimaciones para decidir, no una factura.
Cifras en dólares, que es como facturan las APIs. Las subrayadas enseñan los euros al pasar el ratón. 1 $ = 0,8589 € (BCE, 2026-08-28).
12 recursos para developers cada domingo en tu bandeja de entrada
Además de una skill práctica bien explicada, trucos para mejorar tu futuro profesional y una pizquita de humor útil para el resto de la semana. Gratis.