Kontextové okno je maximum textu, které model udrží najednou — zadání, přiložené dokumenty i celou dosavadní konverzaci dohromady. Měří se v tokenech a co se do něj nevejde, model neví.
Velké okno neznamená, že si model všechno pamatuje napříč konverzacemi. Po zavření chatu je pryč všechno, co si nástroj neuloží zvlášť do paměti nebo do projektu.
Dlouhá konverzace se navíc chová jinak než krátká: model má víc materiálu, ve kterém může minout to podstatné. Když se odpovědi začnou zhoršovat, bývá levnější založit nový chat a vložit do něj jen to důležité, než přesvědčovat ten starý.
Příklad
Okno 200 000 tokenů uveze zhruba 250 normostran — celou diplomku i s poznámkami. Přesto se vyplatí vložit jen tři kapitoly, kterých se otázka týká.
Kde na to narazíte
Claude — Nejlepší pro kódování, dlouhé texty a bezpečné agenty
Gemini 3 — 1M tokenů, Google Workspace, multimodální reasoning
NotebookLM — Nejlepší AI nástroj pro analýzu dokumentů — zdarma
Souvisí s tím
Token — Token je kousek textu, na které si model text dělí — zhruba čtyři znaky, tedy asi tři čtvrtiny běžného anglického slova.
RAG (odpovídání nad dokumenty) — RAG je postup, kdy se k dotazu nejdřív vyhledají odpovídající úryvky z vašich dokumentů a teprve ty se pošlou modelu jako podklad.
Halucinace — Halucinace je odpověď, která zní naprosto samozřejmě, ale není pravdivá — vymyšlená citace, neexistující paragraf, smyšlené číslo.