Was ist KI-Kontext? — Die „liest, aber liest nicht“-Realität der 1M-Token-Ära
2026 haben Claude Opus 4.7, GPT-5.5, Gemini 3.1 Pro und DeepSeek V4-Pro alle „1 Million (1M) Tokens“ Kontextfenster ausgerufen. Doch unabhängige Benchmarks (Multi-Needle NIAH) zeigen, dass nur Gemini 3 Deep Think die Genauigkeit über die vollen 1M hält; die anderen verlieren ab 200K–400K an Präzision. „Unterstützt“ und „liest auch wirklich bis zum Ende“ sind zwei verschiedene Dinge. Dieser Artikel erklärt, wie Kontextfenster funktionieren, das Modell-Lineup im Mai 2026, was Lost in the Middle und Context Rot wirklich sind, die Kostenfalle des Long-Context-Aufschlags von OpenAI sowie fünf praktische Spartaktiken — „Sitzung abschneiden“, „Auszüge senden“, „am Ende wiederholen“, „cachen“, „explizite Adressen“ — gestützt auf reale Benchmark-Zahlen.