Avalie uma assinatura de IA em relação à API por uso no seu nível de consumo. Assinaturas são cobradas por janela de tempo e não por token, portanto não existe um ponto de equilíbrio exato: os resultados vêm como faixas, com a sensibilidade ao cache e a data em que cada plano foi verificado.
Em chat é cerca de 1. Um agente planeja, busca, chama ferramentas e resume, então um prompt costuma disparar de 5 a 30 chamadas. É assim que um modelo com preço baixo por token pode sair caro por tarefa.
Preço de tabela do fornecedor original, a alternativa comparável a uma assinatura do próprio fornecedor.
≈ 4,800 chamadas ao modelo / mês com este uso.
A cota custa cerca de 100% menos do que comprar o mesmo volume pela API.
Baseado em GPT-5.6 Terra e no perfil à esquerda. A gravação de cache não é contada, então o custo real de API é um pouco maior.
A cota custa cerca de 99% menos do que comprar o mesmo volume pela API.
A cota oficial inclui outros limites sem números publicados, portanto tanto esta capacidade quanto o desconto acima estão superestimados.
Baseado em Claude Sonnet 5 e no perfil à esquerda. A gravação de cache não é contada, então o custo real de API é um pouco maior.
A cota custa cerca de 99% menos do que comprar o mesmo volume pela API.
Baseado em Claude Fable 5.1 e no perfil à esquerda. A gravação de cache não é contada, então o custo real de API é um pouco maior.
As faixas de custo vêm da incerteza do cache (±15 pp). As faixas de capacidade vêm de ler cada cota de janela de forma conservadora ou otimista. O ponto de equilíbrio é uma região, não um ponto, porque cotas de assinatura são janelas de tempo que não se reduzem a um número fixo de tokens.
Janelas móveis menores que um dia são normalizadas assumindo 176 horas ativas por mês (8 h × 22 dias); limites diários, semanais e mensais são janelas de calendário e não sofrem desconto.
Estes não publicam cota absoluta, ou cobram em uma unidade que não pode ser traduzida em chamadas ao modelo. Ficam listados aqui em vez de receber um número inventado.