¿Qué es el contexto de la IA? — La realidad de "lee, pero no lee" en la era del 1M de tokens
En 2026, Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro y DeepSeek V4-Pro han declarado todos una ventana de contexto de "1 millón (1M) de tokens". Pero los benchmarks independientes (multi-needle NIAH) muestran que solo Gemini 3 Deep Think mantiene la precisión a lo largo del 1M completo; los demás empiezan a perder precisión entre los 200K y los 400K. "Soportar" y "leer realmente hasta el final" son cosas distintas. Este artículo recorre cómo funcionan las ventanas de contexto, el catálogo de modelos de mayo de 2026, qué son realmente Lost in the Middle y Context Rot, la trampa del coste con el recargo de OpenAI por contexto largo y cinco tácticas prácticas de ahorro — "corta la sesión", "envía extractos", "reitera al final", "cachea", "direcciones explícitas" — respaldadas por cifras reales de benchmarks.