Planos e tiers — Max, Pro, API, Enterprise

TL;DR

Providers oferecem múltiplos modelos de cobrança: pay-per-token (API), assinatura flat-rate (Pro/Max), e enterprise. Para dev solo usando agentes 4h+/dia, planos flat-rate (Claude Max $100/mês) geralmente são mais baratos que API pura — especialmente com Opus. Para times e automação, API com routing é mais flexível e mais barato. Enterprise faz sentido acima de 10 devs com necessidade de SLA, suporte, e controles de compliance. A decisão certa depende de volume, previsibilidade, controle necessário, e se você aceita ficar preso a um provider.

O problema: custo imprevisível vs custo subótimo

Há dois modos de errar na escolha de plano:

  • API sem controle: custo variável que surpreende na fatura — um agente em loop ou uma semana intensiva de debugging pode multiplicar o custo esperado.
  • Plano flat-rate errado: pagar $100/mês e usar 20% da capacidade (waste); ou ter o plano Pro atingido toda semana por quem deveria estar no Max.

A árvore de decisão não é complicada — o problema é que a maioria das pessoas não faz o cálculo antes de decidir.

flowchart TD
    A["Qual é o perfil de uso?"] --> B{"Uso intensivo\n(4h+/dia agente)?"}
    B -->|"Sim"| C{"Produto em produção\nou uso pessoal?"}
    C -->|"Uso pessoal"| D["Max $100-200/mês\n(flat-rate, Opus incluído)"]
    C -->|"Produto em produção"| E["API com routing\n(controle granular, Batch API)"]
    B -->|"Não"| F{"Uso regular\n(1-4h/dia)?"}
    F -->|"Sim"| G["Pro $20/mês\n(boa relação custo-benefício)"]
    F -->|"Não"| H{"Uso ocasional\n(<1h/dia)?"}
    H -->|"Sim"| I["API ou Free\n(pagar pelo que usa)"]
    H -->|"Não — time grande"| J["Enterprise\n(contrato, SLA, compliance)"]

    style D fill:#d4edda,stroke:#155724
    style E fill:#d4edda,stroke:#155724
    style G fill:#fff3cd,stroke:#856404
    style J fill:#cce5ff,stroke:#004085

Comparativo de modelos de cobrança

ModeloComo cobraPrevisibilidadeMelhor para
API pay-per-token$/MTok por chamadaVariável — requer monitoramentoAutomação, CI/CD, produto, volume variável
Pro ($20/mês)Flat rate, uso moderadoAltaDev casual, orçamento apertado
Max ($100-200/mês)Flat rate, uso alto (5x ou 20x Pro)AltaDev power user, agentes intensivos
EnterpriseContrato anual + SLAMuito altaTimes >10 devs, compliance, SOC2

Claude (Anthropic) — junho 2026

Validade: junho 2026

Preços e tiers mudam com frequência — a Anthropic já revisou os limites do Max mais de uma vez desde o lançamento. Confira a página oficial de pricing antes de decidir; os valores abaixo são um retrato do momento, não uma garantia.

PlanoPreçoCapacidadeModelos disponíveisNotas
Free$0Muito limitadoHaiku, Sonnet (limitado)Bom para experimentar
Pro$20/mêsUso moderadoSonnet, Opus (limitado)Atinge limites em uso intensivo
Max 5x$100/mês5x uso do ProSonnet + Opus (amplo)Melhor custo/benefício para power users
Max 20x$200/mês20x uso do ProSonnet + Opus (extensivo)Para uso muito intensivo ou par programação com agente
APIPay-per-tokenSem limite (billing cap)TodosFlexibilidade máxima, requer controles
EnterpriseContrato anualCustomizadoTodos + recursos enterpriseSOC2, SSO, suporte dedicado

Recursos exclusivos do Max vs Pro:

  • Uso de Opus sem bloqueio frequente
  • Maior janela de contexto em projetos de longa duração
  • Prioridade de acesso em horários de pico
  • Acesso antecipado a novos modelos e features

OpenAI — junho 2026

Validade: junho 2026

A OpenAI reorganiza tiers com regularidade (Plus, Pro, Go, Business já mudaram de composição mais de uma vez). Confira a página oficial de pricing antes de decidir.

PlanoPreçoModelosDiferencial
Free$0GPT-4o-miniMuito limitado
Plus$20/mêsGPT-4o, o4-miniLimite de uso razoável para dev casual
Pro$200/mêsGPT-4o, o3, o4, o1Reasoning ilimitado, acesso prioritário
APIPay-per-tokenTodosSem limite, pay what you use
EnterpriseContratoTodosCompliance, data retention controls

Google (Gemini) — junho 2026

Validade: junho 2026

O Gemini API tem free tier generoso que muda de limites conforme a capacidade de inferência do Google evolui. Confira a página oficial de pricing antes de decidir.

PlanoPreçoModelosDiferencial
Free$0Gemini Flash (limitado)Experimentos básicos
Advanced$20/mêsGemini Pro, UltraIntegrado ao workspace Google
API (AI Studio)Pay-per-tokenFlash, Pro, UltraFree tier generoso; Ultra pago
Vertex AIPay-per-token + infraTodosEnterprise GCP, fine-tuning

Quando cada plano faz sentido: árvore de decisão detalhada

A árvore acima é o resumo. Aqui está a lógica completa com os critérios que fazem a diferença:

Dev solo

PerfilPlano recomendadoRaciocínio
Experimental (<30 min/dia)Free ou APICusto mínimo, sem comprometimento
Casual (1-2h/dia, Sonnet)Pro $20/mêsFlat-rate cobre o uso sem surpresas
Regular (2-4h/dia, mix)Pro ou Max 5xDepende de quanto Opus você usa
Intensivo (4-8h/dia, agente)Max 5x $100/mêsOpus incluído, sem limite frequente
Muito intensivo (8h+, pair com agente)Max 20x $200/mêsCapacidade máxima sem restrições
Automação e scripts pessoaisAPIControle por chamada, sem flat-rate

Times

TamanhoSituaçãoPlano recomendado
2-3 devsUso homogêneoPlanos individuais (Pro ou Max)
3-5 devsUso variávelAPI centralizada com por-dev limits
5-10 devsProduto + internal toolsAPI + Team plan combinados
10+ devsCompliance, SLA, suporteEnterprise
Produto B2C (qualquer tamanho)Uso por usuário rastreávelAPI obrigatório

Cálculo: API vs Max para dev solo

Desenvolvedor usando Claude Sonnet 4.6 intensivamente, 6h/dia, 22 dias/mês. Perfil típico de dev com agente ativo.

Input estimado:   ~50K tokens/hora × 6h × 22 dias = 6.6M tokens/mês
Output estimado:  ~10K tokens/hora × 6h × 22 dias = 1.32M tokens/mês

Custo API:
  Input:  6.6M × $3/MTok  = $19.80
  Output: 1.32M × $15/MTok = $19.80
  Total API: ~$39.60/mês

Custo Max 5x: $100/mês

→ API é MAIS BARATA para Sonnet puro.

Mas o cálculo muda quando Opus entra:

Input estimado Opus: ~2M tokens/mês (20% do uso total)
Output estimado Opus: ~400K tokens/mês

Custo API com Opus:
  Sonnet input:  5.28M × $3/MTok = $15.84
  Sonnet output: 1.06M × $15/MTok = $15.90
  Opus input:    2M × $15/MTok   = $30.00
  Opus output:   400K × $75/MTok  = $30.00
  Total: ~$91.74/mês

Custo Max 5x: $100/mês

→ Max e API ficam próximos quando o uso de Opus é significativo.

Conclusão: para dev solo com uso intensivo de Sonnet e pouco Opus, API é mais barata. Para dev que usa Opus regularmente (debugging complexo, arquitetura), Max 5x (80/mês de uso de API com Opus.

API com routing vs plano flat-rate para times

Para times, o modelo de API com routing é geralmente mais vantajoso:

CritérioPlano flat-rateAPI com routing
Previsibilidade de custoAlta (custo fixo)Média (varia com volume)
Otimização possívelBaixa (tudo incluso)Alta (pagar só o necessário)
EscalabilidadeLimitada por planoIlimitada (com billing cap)
Controle por usuário/featureNãoSim (via API keys)
Flexibilidade de providerBaixaAlta (multi-provider)
Compliance e auditoriaLimitadaAlta (logs granulares)

Regra prática: time de até 3 devs com uso homogêneo → planos individuais. Time de 4+ devs com uso variável → API com routing.

Recursos enterprise que você talvez não sabia que precisa

Enterprise não é só “mais do mesmo” — tem recursos que mudam o que você pode construir:

RecursoPor que importaPresente em consumer plans?
Data residencyDados processados apenas na região configurada (GDPR, LGPD, HIPAA)Não
Audit logs completosLog de cada chamada com user, payload, resposta — para complianceNão (parcial)
SSO / SAMLIntegração com IdP corporativo (Okta, Azure AD)Não
BAA (Business Associate Agreement)Requisito legal para dados de saúde (HIPAA)Não
SLA de uptime (99.9%+)Garantia com créditos se houver downtimeNão
Suporte dedicado com SLAResposta em horas, não diasNão
Fine-tuning de modelosAdaptar o modelo ao domínio específicoNão (geralmente)
Rate limits maioresSem throttling em picos de usoThrottling mais rígido

Para produtos em domínios regulados (saúde, finanças, jurídico), Enterprise não é opcional — é requisito legal.

Vendor lock-in: risco real de planos flat-rate

Planos flat-rate criam lock-in implícito — mudar de provider exige mudar de plano, reconfigurar workflows, e possivelmente perder features específicas (ex: Projects do Claude, Memory do ChatGPT).

Com API, a camada de abstração (LiteLLM, Portkey, LangChain) permite trocar de provider com uma mudança de variável de ambiente.

# Com API + abstração: trocar de provider = mudar 1 linha
import litellm
 
# Anthropic
response = litellm.completion(
    model="claude-sonnet-4-6",
    messages=[{"role": "user", "content": "Hello"}]
)
 
# OpenAI (mesma interface)
response = litellm.completion(
    model="gpt-4o",
    messages=[{"role": "user", "content": "Hello"}]
)
 
# Google Gemini (mesma interface)
response = litellm.completion(
    model="gemini/gemini-2.5-pro",
    messages=[{"role": "user", "content": "Hello"}]
)

Armadilhas comuns

Pro para uso heavy

O plano Pro atinge limites com uso intensivo de agentes — especialmente com Opus. Quando o limite é atingido, o modelo degrada para Haiku ou bloqueia temporariamente. Para quem usa agentes diariamente por 4h+, o Max 5x ($100) é o ponto de equilíbrio real.

Max para uso leve

Pagar 3/MTok seria 80/mês.

API sem monitoramento e hard limits

Pay-per-token sem controle = fatura surpresa. Um agente em loop ou uma semana de debugging intensivo pode multiplicar o custo esperado. Nunca usar API sem configurar spending limits no console do provider e kill switches no código.

Comparar planos sem incluir custo de ferramentas

Claude Max 100/mês em tokens não inclui interface. Compare o total, não só os tokens.

Calculando o breakeven: planilha mental

O ponto de decisão entre API e plano flat-rate depende do seu mix de modelos. Aqui está o cálculo genérico:

def calculate_breakeven(
    sonnet_tokens_per_month_m: float,  # em MTok
    opus_tokens_per_month_m: float,    # em MTok
    plan_cost_usd: float = 100.0,      # Max 5x
) -> dict:
    """
    Compara custo de API vs plano flat-rate.
    Preços de junho 2026:
      Sonnet: $3/MTok input, $15/MTok output (estimativa 80/20 split)
      Opus:   $15/MTok input, $75/MTok output (estimativa 80/20 split)
    """
    # Estimativa 80% input, 20% output
    sonnet_api_cost = (
        sonnet_tokens_per_month_m * 0.8 * 3 +
        sonnet_tokens_per_month_m * 0.2 * 15
    )
    opus_api_cost = (
        opus_tokens_per_month_m * 0.8 * 15 +
        opus_tokens_per_month_m * 0.2 * 75
    )
    total_api = sonnet_api_cost + opus_api_cost
    
    savings = total_api - plan_cost_usd
    
    return {
        "api_cost": total_api,
        "plan_cost": plan_cost_usd,
        "savings_with_plan": savings,
        "recommendation": "Plano" if savings > 0 else "API",
        "breakeven_opus_m_tokens": (
            (plan_cost_usd - sonnet_api_cost) / (0.8 * 15 + 0.2 * 75)
            if total_api < plan_cost_usd else None
        )
    }
 
# Dev com uso intensivo:
result = calculate_breakeven(
    sonnet_tokens_per_month_m=10,   # 10M tokens Sonnet
    opus_tokens_per_month_m=2,      # 2M tokens Opus
    plan_cost_usd=100
)
# → API custa ~$90 (Sonnet $30 + Opus $60), plano custa $100
# → API ainda é mais barata, mas muito próximo
# → Qualquer uso adicional de Opus inverte a equação
 
result2 = calculate_breakeven(
    sonnet_tokens_per_month_m=10,
    opus_tokens_per_month_m=4,      # mais uso de Opus
    plan_cost_usd=100
)
# → API: ~$90 + $120 = $210, plano: $100
# → Plano economiza $110/mês com 4M tokens Opus

Conclusão: o parâmetro determinante é o volume de Opus. Para Sonnet puro, API quase sempre vence. Para Opus intensivo, plano Max vence com folga.

Estado da arte — junho 2026

Deflação de planos: Em 2025-2026, o custo dos planos flat-rate caiu em termos reais — o mesmo $20/mês do Plus em 2023 compra acesso a modelos significativamente mais capazes em 2026. O que era exclusivo do tier Enterprise tornou-se padrão no tier Pro.

Multi-modal e ferramentas incluídas: Planos de 2026 incluem capacidades que eram extras ou limitadas: visão computacional, geração de imagens, code execution, web search, file processing — tudo incluso nos planos Pro e Max. O custo real por tarefa caiu mais do que o preço do plano sugere.

Enterprise expandindo para times menores: Planos Enterprise, antes restritos a contratos de $50k+/ano, estão disponíveis em 2026 para times de 10+ devs com contratos mais acessíveis. Anthropic Team e OpenAI Team (acima dos planos Pro individuais) cobrem a faixa entre plano individual e Enterprise.

Casos práticos

Caso 1 — Dev solo migrando de Max para API: Dev com Max 45/mês. Migrou para API com spending limit de 55/mês sem degradação de qualidade.

Caso 2 — Time de 5 devs com planos individuais vs API centralizada: Time com 5 planos Pro (100/mês) sofria de uso desigual — 2 devs usavam 80% da capacidade, 3 usavam 20%. Migraram para API centralizada com API key por dev e spending limit individual de 80-120/mês (variável), com controle granular e sem limites de capacidade para os heavy users.

Caso 3 — Produto B2C: por que API é obrigatório: Startup com 1.000 usuários não poderia usar plano flat-rate — o custo por usuário precisava ser rastreado, o routing por tipo de task era essencial (Haiku para triagem, Sonnet para análise), e o custo precisava escalar com o receita. API com routing resultou em $0.08/usuário/mês vs. impraticável com plano flat.

Caso 4 — Enterprise para compliance: Empresa de healthtech com requisitos HIPAA precisava de: data residency (dados não saem da região), audit logs completos, SLA de 99.9%, e controle de quais modelos são usados. Nenhum plano de consumidor atendia — Enterprise foi o único caminho, com custo 3x maior que API mas com compliance e suporte garantidos.

Caso 5 — Time de 8 devs decidindo entre 8 planos Max e API centralizada:

Por que esse caso é diferente dos anteriores? Porque em times pequenos-médios (6-10 devs) a decisão não é óbvia como em times de 3 (planos individuais) ou 15+ (Enterprise) — é a faixa cinzenta onde o cálculo por pessoa importa.

Um time de 8 devs mediu o uso real (via ccusage) ao longo de um mês e encontrou o seguinte mix, aplicando as mesmas taxas de referência já usadas nos cálculos acima (Sonnet 15 por MTok input/output; Opus 75 por MTok):

Perfil do time (8 devs, uso medido):
  3 devs "heavy" (uso tipo Max 5x): ~10M tokens Sonnet + 3M tokens Opus/mês cada
  3 devs "regular" (uso tipo Pro):   ~2M tokens Sonnet + 0.3M tokens Opus/mês cada
  2 devs "leve" (uso ocasional):     ~0.5M tokens Sonnet/mês cada, sem Opus

Opção A — 8 planos individuais:
  3 × Max 5x ($100)  = $300
  3 × Pro ($20)      = $60
  2 × Pro ($20)      = $40   (mesmo com uso leve, não há tier menor com Opus ocasional)
  Total: $400/mês

Opção B — API centralizada com spending limit por dev:
  3 heavy:   (10M × 0.8×3 + 10M × 0.2×15) + (3M × 0.8×15 + 3M × 0.2×75) ≈ $54 + $81 = $135/dev × 3 = $405
  3 regular: (2M × 0.8×3 + 2M × 0.2×15) + (0.3M × 0.8×15 + 0.3M × 0.2×75) ≈ $10.8 + $8.1 = $18.9/dev × 3 ≈ $57
  2 leve:    (0.5M × 0.8×3 + 0.5M × 0.2×15) ≈ $2.7/dev × 2 ≈ $5.4
  Total API: ~$467/mês

O resultado surpreende quem assume que “API sempre sai mais barato para times”: aqui os planos individuais (467), porque os 3 devs heavy usam Opus pesado o bastante para o Max 5x compensar — e os 2 devs leves não geram economia suficiente na API pra compensar o overhead dos heavy.

O que isso ensina

Não existe resposta universal por tamanho de time — o mix de modelos (quanto de Opus vs. Sonnet) pesa mais que o número de pessoas. Um time de 8 devs majoritariamente Sonnet inverteria essa conta facilmente a favor da API. Sempre recalcule com dados reais do seu time, não com a heurística de “times grandes = API”.

Checklist de decisão

  • Calcular uso médio mensal atual (tokens por tipo: input, output, thinking) com dados reais
  • Comparar custo API vs plano flat-rate com os números reais (não estimativas genéricas)
  • Verificar se Opus é usado regularmente (>15% do uso) — este é o maior fator a favor do Max
  • Avaliar necessidade de controle granular por usuário/feature (API obrigatório para produtos)
  • Verificar requisitos de compliance antes de assumir que plano consumer serve
  • Configurar spending limits e alertas INDEPENDENTEMENTE do plano escolhido
  • Revisar decisão de plano semestralmente (deflação de tokens e mudança de uso podem inverter a decisão)
  • Calcular breakeven com dados reais de uso (não estimativas genéricas)
  • Verificar mix Sonnet/Opus — este é o fator determinante da decisão plano vs API
  • Documentar razão da decisão de plano para referência futura

O que vem a seguir

Com o plano escolhido e otimizações implementadas, a última perspectiva é a trajetória do custo — os tokens ficam mais baratos a cada ciclo, o que significa que o retorno sobre o esforço de otimização muda com o tempo. 20 - O futuro — tokens cada vez mais baratos cobre a curva de deflação e o que isso significa para as decisões de hoje.

Como explicar em inglês

Subscription plan, pay-per-token, e enterprise são os termos padrão. O vocabulário de pricing de SaaS e de LLMs se sobrepõe bastante.

PortuguêsInglêsContexto de uso
Plano de assinaturaSubscription plan / Flat-rate planPlano com custo fixo mensal
Pagamento por tokenPay-per-token / Usage-based pricingCobrança proporcional ao uso
Tier de planoPlan tierNível do plano (Free, Pro, Enterprise)
Usuário intensivoPower user / Heavy userUsuário que usa o serviço extensivamente
Taxa de usoUsage rate / Usage capLimite de uso em planos flat-rate
Empresa de grande porteEnterpriseTier para grandes empresas com contrato
Lock-in de vendorVendor lock-inDependência de um único provider
SLASLA (Service Level Agreement)Garantia de uptime e suporte
Capacidade de usoUsage capacityVolume de tokens disponível no plano
Taxa mensal fixaMonthly flat feeCusto fixo independente do uso

Veja: Claude Max vs API — Which Is Cheaper For Developers?

Canal: AI Jason / Developer Tooling | Duração: ~12min | Idioma: EN

Comparação prática com cálculos reais — custo de API vs planos Max para diferentes perfis de uso, com spreadsheet de cálculo disponível. Cobre o breakeven point por modelo e padrão de uso, e quando cada opção faz sentido.

🎬 Assistir no YouTube

Veja também

Fontes

  • AnthropicPricing Page (anthropic.com/pricing, 2026). Tabela oficial de preços de planos e API da Anthropic — inclui comparativo de features por tier.
  • OpenAIPricing Page (openai.com/pricing, 2026). Tabela oficial de planos e API da OpenAI.
  • GoogleGemini API Pricing (ai.google.dev/pricing, 2026). Pricing do Gemini API e comparativo de planos Workspace/Advanced.
  • LiteLLMProvider Comparison (docs.litellm.ai, 2026). Interface unificada para múltiplos providers — facilita comparação de custo e migração entre providers.