Preço por milhão de tokens
| Modelo | Entrada /1M | Cache /1M | Saída /1M | Contexto |
|---|---|---|---|---|
| Claude Fable 5.1 | US$ 10,00 | US$ 0,25 | US$ 50,00 | 1.000.000 |
| Claude Opus 5.5 | US$ 4,00 | US$ 0,20 | US$ 20,00 | 1.000.000 |
| Claude Sonnet 5.5 | US$ 2,00 | US$ 0,20 | US$ 10,00 | 1.000.000 |
| Claude Haiku 4.5 | US$ 1,00 | US$ 0,10 | US$ 5,00 | 200.000 |
| GPT-5.6 Sol | US$ 5,00 | US$ 0,50 | US$ 30,00 | 1.050.000 |
| GPT-5.6 Terra | US$ 2,00 | US$ 0,20 | US$ 12,00 | 1.050.000 |
| GPT-5.6 Luna | US$ 0,20 | US$ 0,0200 | US$ 1,20 | 1.050.000 |
Como escolher
O preço por token não conta a história toda: um modelo mais caro pode resolver em uma chamada o que um barato faz em três, e alguns tokenizadores geram mais tokens para o mesmo texto. Os modelos Claude a partir da versão 4.7 usam um tokenizador que produz cerca de 30% mais tokens que o anterior; a calculadora de tokens mostra a diferença.
- Volume alto e tarefa simples (classificar, extrair, resumir curto): GPT-5.6 Luna e Claude Haiku 4.5.
- Uso geral em produto (chat, atendimento, RAG): Claude Sonnet 5.5 e GPT-5.6 Terra.
- Código, agentes e raciocínio longo: Claude Opus 5.5, Claude Fable 5.1 e GPT-5.6 Sol.
Contexto longo
Os modelos Claude 4.6 em diante têm 1 milhão de tokens de contexto ao preço normal. No GPT-5.6, requisições com mais de 272 mil tokens de entrada pagam 2× a entrada e 1,5× a saída da requisição inteira.