ГлавнаяГлоссарийКонтекстное окно

Контекстное окно

сколько текста модель держит в голове за один раз

Предельный объём текста в токенах, который модель может удержать за один запрос.

В контекстное окно помещается всё сразу: служебная инструкция, история переписки, приложенные документы и сам вопрос. Когда объём превышает лимит, начало разговора отбрасывается — модель перестаёт помнить, о чём вы договорились в первых сообщениях.

Размер окна у современных моделей доходит до миллиона токенов, но большое окно оплачивается: вся история уходит в счёт как входные токены при каждом запросе. Длинный диалог дорожает сам по себе, даже если вы пишете короткие реплики.

Что входит
Всё сообщение целиком

Инструкция, история, файлы и текущий вопрос считаются вместе.

Что будет при переполнении
Обрыв начала

Ранние сообщения выпадают, и модель их больше не видит.

Контекст тарифицируется при каждом запросе, поэтому длинная история удорожает разговор.
Пример

Диалог на 200 000 токенов истории при каждом новом вопросе списывает эти 200 000 заново — плюс токены самого вопроса и ответа.