AI context क्या है? — 1M-token युग की "पढ़ता है लेकिन पढ़ता नहीं" वाली हक़ीक़त
2026 में, Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro, और DeepSeek V4-Pro सभी ने "1 मिलियन (1M) token" का context window घोषित किया। लेकिन स्वतंत्र benchmark (multi-needle NIAH) दिखाते हैं कि केवल Gemini 3 Deep Think पूरे 1M में सटीकता बनाए रखता है; बाकी 200K–400K पर सटीकता खोने लगते हैं। "समर्थन करता है" और "वास्तव में अंत तक पढ़ता है" अलग चीज़ें हैं। यह लेख बताता है कि context window कैसे काम करते हैं, मई 2026 की model लाइनअप, Lost in the Middle और Context Rot वास्तव में क्या हैं, OpenAI के long-context अधिभार का लागत जाल, और पाँच व्यावहारिक बचत रणनीतियाँ — "session काटें," "अंश भेजें," "अंत में दोहराएँ," "cache," "स्पष्ट पते" — वास्तविक benchmark आँकड़ों पर आधारित।