Qué es la ventana de contexto
Es el máximo de tokens que el modelo ve en una solicitud: instrucciones, historial, documentos y la propia respuesta. Claude Opus 5.5, Sonnet 5.5 y Fable 5.1 tienen 1 millón de tokens; Haiku 4.5 tiene 200 mil. GPT-5.6 acepta 1.05 millones, con hasta 922 mil de entrada.
Un contexto grande cuesta caro
Llenar 1 millón de tokens de entrada en Claude Opus 5.5 cuesta US$4 por solicitud. Si el mismo documento va en cada llamada, use caché de prompts. En GPT-5.6, por encima de 272 mil tokens de entrada toda la solicitud pasa a costar 2× en entrada y 1.5× en salida.
Salida máxima
La salida tiene un límite propio, mucho menor que el contexto: 128 mil tokens en los modelos Claude 5.x y en GPT-5.6, y 64 mil en Haiku 4.5.