Что такое контекстное окно и зачем миллион токенов

Контекстное окно — это объём текста, который модель «видит» одновременно: ваш запрос, загруженные документы и вся история диалога. Окно в 1 миллион токенов вмещает, грубо, полторы-две тысячи страниц текста — целую книгу, большой договор с приложениями или заметную часть кодовой базы, и модель отвечает с учётом всего этого сразу, а не по кусочкам.

Пока текст помещается в окно, модели не нужно ничего «вспоминать» — она просто читает всё целиком. Как только документ больше окна, начинаются компромиссы: резать на части, пересказывать, терять связи между разделами. Подробнее термин разобран в глоссарии — что такое контекстное окно.

У каких моделей окно 1M токенов

Миллионное окно перестало быть экзотикой — оно есть у флагманов сразу нескольких провайдеров, и все они доступны в одном чате на ГПТ Россия без VPN:

МодельКонтекстное окно
GPT-5.41,05M токенов
GPT-5.51M
Claude Opus 5, Claude Sonnet 51M
Gemini 3.1 Pro и линейка Flash~1M
DeepSeek V4 Pro, DeepSeek V4 Flash1M
Kimi K3, GLM 5.21M
GPT-5.2400K
Claude Haiku 4.5200K
Grok 4131K
GPT-4o128K

Текстовые модели оплачиваются за фактическое использование: чем больше текста вы загружаете, тем дороже запрос — это главный аргумент не брать миллион «на всякий случай».

Сценарий 1: договоры и большие документы

Юрист или бухгалтер загружает договор на 200 страниц с приложениями и просит найти противоречия между разделами, сверить сроки и штрафы. В маленьком окне документ пришлось бы резать, и модель не увидела бы, что пункт 3.2 противоречит приложению 7. GPT-5.4 с окном 1,05M — самое большое окно в каталоге — держит и сам документ, и длинную серию уточняющих вопросов по нему в одном диалоге.

Сценарий 2: кодовые базы

Разработчику миллион токенов позволяет положить в контекст десятки файлов проекта разом: модель видит, как модуль A вызывает модуль B, и не предлагает правки, ломающие соседний код. Claude Opus 5 с окном 1M — типичный выбор для таких задач: рефакторинг, поиск бага, распутывание legacy, где ответ зависит от связей между файлами, а не от одного фрагмента.

Сценарий 3: книги, расшифровки, база знаний

Редактор загружает рукопись целиком и просит проверить сквозные линии персонажей. Маркетолог складывает в один диалог расшифровки десяти интервью и просит общие темы. Аналитик — годовую переписку с клиентом перед переговорами. Общее у сценариев одно: ценность ответа рождается из объёма, который человек сам целиком в голове не удержит.

Когда миллион не нужен

Честный ответ: в большинстве повседневных задач — переписка, посты, переводы, короткие документы — хватает окна 128-400K, и модели с меньшим окном обходятся дешевле за счёт оплаты по фактическим токенам. Правило простое: если ваши материалы — до 100-200 страниц за раз, миллионное окно ничего не добавит. Начните с малого: welcome-бонус 50 ₽ на ГПТ Россия позволяет сравнить модели с разными окнами на собственных документах — все модели живут в одном чате, переключение в один клик, оплата в рублях.

Частые вопросы

Сколько это — 1 миллион токенов в страницах?

Токен — это примерно 2-4 символа русского текста. Миллион токенов — порядка полутора-двух тысяч страниц: целая книга или крупный пакет документов. Точное число зависит от языка и характера текста.

У какой модели самое большое контекстное окно?

В каталоге ГПТ Россия — у GPT-5.4: 1,05M токенов. Ровно миллион — у GPT-5.5, Claude Opus 5, Claude Sonnet 5, DeepSeek V4, Kimi K3, GLM 5.2 и линейки Gemini.

Дороже ли запросы с длинным контекстом?

Да: текст оплачивается по фактически обработанным токенам, поэтому запрос с книгой в контексте стоит дороже, чем короткий вопрос. Загружайте столько, сколько нужно для задачи.

Помнит ли модель контекст между разными чатами?

Нет, контекстное окно действует внутри одного диалога. Новый чат — чистый контекст; нужные документы придётся приложить заново.