Compare una suscripción de IA con la API de pago por uso según su nivel de uso. Las suscripciones se facturan por ventana de tiempo y no por token, así que no existe un punto de equilibrio exacto: los resultados se dan como rangos, junto con la sensibilidad a la caché y la fecha en que se verificó cada plan.
En chat es cerca de 1. Un agente planifica, busca, invoca herramientas y resume, así que un prompt suele desencadenar de 5 a 30 llamadas. Por eso un modelo con precio bajo por token puede resultar caro por tarea.
Precio de lista de primera parte, la alternativa comparable a una suscripción de primera parte.
≈ 4,800 llamadas al modelo / mes con este uso.
El cupo cuesta alrededor de un 100% menos que comprar el mismo volumen por API.
Basado en GPT-5.6 Terra y el perfil de la izquierda. No se incluye el cargo por escritura de caché, así que el coste real de API es algo mayor.
El cupo cuesta alrededor de un 99% menos que comprar el mismo volumen por API.
El cupo oficial incluye otros límites sin cifras publicadas, por lo que tanto esta capacidad como el descuento anterior están sobreestimados.
Basado en Claude Sonnet 5 y el perfil de la izquierda. No se incluye el cargo por escritura de caché, así que el coste real de API es algo mayor.
El cupo cuesta alrededor de un 99% menos que comprar el mismo volumen por API.
Basado en Claude Fable 5.1 y el perfil de la izquierda. No se incluye el cargo por escritura de caché, así que el coste real de API es algo mayor.
Los rangos de coste provienen de la incertidumbre de la caché (±15 pp). Los rangos de capacidad provienen de leer cada cupo de ventana de forma conservadora u optimista. El punto de equilibrio es una región, no un punto, porque los cupos de suscripción son ventanas de tiempo que no se reducen a un número fijo de tokens.
Las ventanas móviles de menos de un día se normalizan suponiendo 176 horas activas al mes (8 h × 22 días); los límites diarios, semanales y mensuales son ventanas de calendario y no se descuentan.
Estos no publican un cupo absoluto, o facturan en una unidad que no puede traducirse a llamadas al modelo. Se enumeran aquí en lugar de asignarles una cifra inventada.