O que é o contexto da IA? — A realidade do "lê, mas não lê" na era de 1M de tokens
Em 2026, Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro e DeepSeek V4-Pro declararam todos uma janela de contexto de "1 milhão (1M) de tokens". Mas benchmarks independentes (multi-needle NIAH) mostram que apenas o Gemini 3 Deep Think mantém a precisão por todo o 1M; os outros começam a perder precisão entre 200K e 400K. "Suporta" e "realmente lê até o fim" são coisas diferentes. Este artigo percorre como funcionam as janelas de contexto, o lineup de modelos de maio de 2026, o que são realmente Lost in the Middle e Context Rot, a armadilha de custo da sobretaxa de contexto longo da OpenAI e cinco táticas práticas de economia — "encerrar a sessão", "enviar trechos", "reafirmar no fim", "cachear", "endereços explícitos" — embasadas em números reais de benchmarks.