calc.dev.brcalculadoras de IA para devs

Calculadora de economia com cache de prompt

Se toda chamada começa com as mesmas instruções ou o mesmo documento, o cache cobra só uma fração por essa parte. Informe o tamanho da parte fixa, o volume e a taxa de acerto.

Preços atualizados em outubro de 2026
prompt-cache.tsCache de prompt
tokens
tokens
tokens
%
Duração do cache (Claude)
R$
Cotação de referência; nas calculadoras ela é atualizada com o dólar do dia.

Como funciona

Claude: você marca onde termina a parte fixa do prompt. Na primeira chamada ela é gravada no cache (1,25× o preço de entrada, ou 2× para duração de 1 hora); nas seguintes é lida por uma fração do preço: 2,5% a 10% da entrada, conforme o modelo. O cache expira após 5 minutos sem uso (ou 1 hora).

OpenAI: o cache é automático para prefixos repetidos e cobra 10% da entrada nos tokens em cache, sem custo de gravação.

Quando compensa

Compensa quando a parte fixa é grande e as chamadas são frequentes o bastante para o cache não expirar. Com taxa de acerto baixa, no Claude, cada gravação custa mais que a leitura economiza.

Coloque no começo do prompt o que nunca muda (instruções, ferramentas, documentos) e deixe para o fim o que muda a cada chamada.

Perguntas frequentes

Quanto o cache economiza?

Com uma parte fixa grande e 90% de acerto, a economia na entrada passa de 80%.

O cache muda a resposta?

Não. O modelo recebe exatamente o mesmo prompt; só a cobrança muda.

Estimativa com os preços públicos de outubro de 2026. Tokens variam conforme o texto e o modelo; confirme os valores na página oficial de preços antes de decidir.