calc.dev.brcalculadoras de IA para devs

Calculadora de ahorro con caché de prompts

Si cada llamada empieza con las mismas instrucciones o el mismo documento, la caché cobra solo una fracción por esa parte. Indique el tamaño de la parte fija, el volumen y la tasa de aciertos.

Precios actualizados en octubre de 2026
prompt-cache.tsCaché de prompts
tokens
tokens
tokens
%
Duración de la caché (Claude)

Cómo funciona

Claude: usted marca dónde termina la parte fija del prompt. En la primera llamada se escribe en la caché (1.25× el precio de entrada, o 2× para una duración de 1 hora); en las siguientes se lee por una fracción del precio: del 2.5% al 10% de la entrada, según el modelo. La caché vence tras 5 minutos sin uso (o 1 hora).

OpenAI: la caché es automática para prefijos repetidos y cobra el 10% de la entrada en los tokens en caché, sin costo de escritura.

Cuándo conviene

Conviene cuando la parte fija es grande y las llamadas son lo bastante frecuentes para que la caché no venza. Con una tasa de aciertos baja, en Claude, cada escritura cuesta más de lo que ahorra la lectura.

Ponga al principio del prompt lo que nunca cambia (instrucciones, herramientas, documentos) y al final lo que cambia en cada llamada.

Preguntas frecuentes

¿Cuánto ahorra la caché?

Con una parte fija grande y 90% de aciertos, el ahorro en la entrada pasa del 80%.

¿La caché cambia la respuesta?

No. El modelo recibe exactamente el mismo prompt; solo cambia el cobro.

Estimación con los precios públicos de octubre de 2026. Los tokens varían según el texto y el modelo; confirme los valores en la página oficial de precios antes de decidir.