Tarifa plana · sin cobro por token
API de LLM con tarifa plana: precio fijo mensual para tus agentes
Todos los modelos frontier — GPT-5.6, Claude, Gemini, DeepSeek, Qwen, Kimi — por un único endpoint compatible con OpenAI, desde US$ 39/mes fijos. Sin medidor de tokens, sin ventanas de 5 horas, sin sustos en la factura.
Siendo honestos: “tarifa plana” significa que el precio no escala con el uso — cada plan incluye un presupuesto mensual de computación generoso, no computación infinita. Para quien corre agentes de código todo el día, esa es exactamente la diferencia que importa: el día más pesado de tu agente cuesta lo mismo que el más tranquilo.
Economy
US$ 39/mes
para un agente en uso diario moderado
Standard
US$ 89/mes
el plan más popular para uso intenso
Pro
US$ 249/mes
agentes siempre activos y trabajo pesado
Preguntas frecuentes
¿Existe una alternativa barata a la API de OpenAI para agentes?
Sí, dos caminos: APIs por token más baratas (DeepSeek, Qwen vía OpenRouter — buenas para uso ligero) o una tarifa plana mensual como Standard Compute (desde US$ 39/mes), donde el precio no escala con el uso. Para agentes de código que corren horas al día, la segunda opción es la estructural: los agentes reenvían el contexto creciente en cada paso, así que pagar por token se encarece exactamente cuando más usas la herramienta.
¿Qué significa 'tarifa plana' de verdad?
Que el precio no tiene medidor de tokens — no que la computación sea infinita. Cada plan incluye un presupuesto mensual de computación generoso; las peticiones corren con normalidad hasta agotarlo, sin ventanas de 5 horas ni límites semanales como los planes de Claude Pro/Max o Codex.
¿Funciona con tarjetas de Latinoamérica y España? ¿Hace falta tarjeta para probar?
El checkout es vía Stripe y acepta tarjetas internacionales, Google Pay y Apple Pay. Para probar no hace falta tarjeta: las cuentas nuevas reciben un crédito gratuito al activarse — conectas tu agente y ejecutas peticiones reales antes de decidir.
¿Cómo conecto mi agente de código?
Es un endpoint compatible con OpenAI: apunta la base URL a https://api.stdcmpt.com/v1, usa tu clave, y define el modelo como 'standardcompute'. El enrutamiento inteligente elige el mejor modelo por petición — modelos económicos para pasos triviales, modelos frontier (GPT-5.6, Claude, Gemini) para los difíciles. Funciona con OpenCode, Cline, Aider, Roo y Continue; Claude Code se conecta vía ANTHROPIC_BASE_URL.
In English: Unlimited LLM API → · Em português: API de LLM Ilimitada → · Guías por agente: OpenCode, Claude Code, Cline