Números reales, no páginas de precios: la codificación agéntica diaria en APIs cobradas por token cuesta alrededor de US$ 13 por desarrollador por día activo — US$ 150–250 al mes — según datos empresariales de la propia Anthropic. La automatización pesada (agentes en paralelo, loops largos) llega a US$ 500–2.000/mes a precio de lista. Las suscripciones comprimen esto: planes de US$ 20 con ventanas de uso (Claude Pro, ChatGPT Plus) para uso interactivo, planes de modelos abiertos de US$ 10–20 para volumen, o presupuestos fijos con enrutamiento de US$ 19–249. Una sola tarea agéntica consume normalmente entre 400 mil y 2 millones de tokens — por eso la diferencia entre el costo de un chat y el de un agente es de 10 a 100 veces.
| Perfil | Costo en API medida | Equivalente en suscripción |
|---|---|---|
| Casual (algunas sesiones/semana) | US$ 5–30/mes | US$ 0–20 — un plan de US$ 20 con ventanas suele alcanzar |
| Uso diario (agente casi todos los días) | US$ 150–250/mes | Plan de US$ 20 + excedentes, o planes fijos de US$ 39–100 |
| Pesado (loops largos, agentes en paralelo) | US$ 500–2.000/mes | Tiers máximos de US$ 100–200 o presupuestos fijos de US$ 89–249 |
| Equipo (por desarrollador) | US$ 150–250/dev/mes | Asientos de US$ 19–125/dev + presupuesto de cómputo compartido |
Cifras medidas: datos empresariales de Anthropic según análisis de 2026; la matemática de tokens está corroborada por facturas reportadas por usuarios.
Una pregunta de chat es una petición. Una tarea de agente es un loop: leer archivos, planificar, editar, ejecutar herramientas, verificar — decenas de llamadas, cada una cargando contexto. Sesiones instrumentadas muestran 40–80 mil tokens consumidos antes de escribir una línea de código, y una tarea completa consume 400 mil a 2 millones de tokens acumulados. El caso típico de sorpresa: una tarea sale US$ 12 porque el agente decidió leerse todo el repositorio.
El harness importa tanto como el modelo: una comparación famosa de 2026 mostró un agente enviando 33 mil tokens de preámbulo antes de leer el prompt, mientras otro enviaba 7 mil. Misma tarea, mismo modelo, ~5x la factura. Los harness eficientes en tokens — y los enrutadores que mantienen los pasos rutinarios fuera de los modelos de frontera — son características de costo, no comodidades.
El precio publicado de un plan no dice casi nada — la diferencia entre un plan de US$ 20 que te cubre y uno que revientas en cuatro días es tu consumo de tokens, que depende del harness, de la mezcla de modelos y de cuán agéntico es tu trabajo. Mide una semana real antes de contratar cualquier tier.
Standard Compute existe para las franjas media y pesada: planes fijos desde US$ 19/mes (Starter) hasta US$ 39/89/249, con tiers empresariales por encima — cada uno es un presupuesto mensual de cómputo con enrutamiento inteligente: modelos de frontera en las peticiones difíciles, modelos eficientes en las rutinarias. Endpoint compatible con OpenAI (api.stdcmpt.com/v1); funciona con OpenCode, Aider, Cline, Roo Code y Claude Code, y el panel muestra el presupuesto en vivo — 'cuánto cuesta mi agente' por fin tiene respuesta exacta.
Orden de magnitud: una tarea sustancial consume 400 mil a 2 millones de tokens acumulados; un día activo llega fácilmente a varios millones. A precios de lista de modelos de frontera son US$ 10–30/día — lo que coincide con el promedio empresarial de ~US$ 13/día activo de Anthropic.
Planes de modelos abiertos (US$ 10–20) si la calidad de los modelos de pesos abiertos cubre tu trabajo; un plan fijo con enrutamiento desde US$ 19/mes si necesitas calidad de frontera en la mezcla. La API de frontera medida es la opción diaria más cara por amplio margen.
Tarifa fija existe; cómputo infinito, no. Los planes fijos como los de Standard Compute cambian el medidor por un presupuesto mensual de cómputo — el precio no varía con el uso, pero el presupuesto es real. Los modelos nuevos (Kimi, GLM, Qwen, DeepSeek) están en el mismo catálogo enrutado, sin abrir cuentas en tres nubes distintas.