Введение
OpenAI расширила доступ к окну контекста в миллион токенов для GPT-5.6 Sol в Codex, предоставив разработчикам возможность получать более широкий контекст при входе через аккаунт ChatGPT, а не только при аутентификации с помощью API-ключа.
Это обновление было освещено инженером OpenAI Tibo, отвечающим за Codex и ChatGPT. Согласно объявлению, опубликованному в оригинальном отчёте AIBase, режим контекста в 1 миллион токенов для GPT-5.6 Sol ранее был доступен только пользователям API-ключей, но теперь этот переключатель также включён для использования с аккаунтами ChatGPT.

В текущей документации по моделям OpenAI указан GPT-5.6 Sol с окном контекста в 1 050 000 токенов и максимальным выходом в 128 000 токенов. Это предоставляет Codex больше пространства для хранения исходного кода, результатов инструментов, инструкций и истории диалога до необходимости управления контекстом или его сжатия.
Эта опция полезна для разработчиков, работающих с крупными кодовыми базами, длительными сеансами отладки, миграциями или многошаговыми рефакторингами. Однако OpenAI также предупреждает пользователей не предполагать, что максимально возможное окно контекста всегда является наилучшим выбором по умолчанию.
Подписчики ChatGPT могут использовать окно в миллион токенов в Codex
Фактическое изменение заключается в том, что функция длинного контекста больше не ограничена разработчиками, аутентифицирующими Codex через API-ключ.
Согласно объявлению, эта функция теперь также доступна через аккаунт ChatGPT. Текущая документация по ценам Codex от OpenAI подтверждает, что планы Plus, Pro, Business, Enterprise и другие поддерживаемые тарифы ChatGPT включают доступ к Codex, а серия моделей GPT-5.6 доступна в соответствующих платных тарифах.
Официальное окно контекста GPT-5.6 Sol:
| Спецификация | GPT-5.6 Sol |
|---|---|
| Окно контекста | 1 050 000 токенов |
| Максимальный выход | 128 000 токенов |
| ID модели | gpt-5.6-sol |
| Псевдоним | gpt-5.6 |
Большее окно позволяет сеансу Codex единовременно сохранять больше рабочей информации.
Это может включать:
- Несколько частей крупной кодовой базы
- Длинную историю диалога
- Выводы инструментов и оболочки
- Результаты сборки и тестирования
- Документацию по дизайну или архитектуре
- Контекст многофайлового рефакторинга
- Более ранние шаги и решения по отладке
Для небольших задач дополнительное пространство может не иметь существенного практического значения. Однако для крупных производственных репозиториев сохранение большего состояния проекта может снизить частоту, с которой старые материалы суммируются или отбрасываются из активного контекста.
Codex раскрывает конфигурацию окна контекста
Официальная справочная документация по конфигурации Codex от OpenAI документирует эту настройку:
model_context_window
Она указывает количество токенов окна контекста, доступного для текущей модели.
Примеры конфигурации OpenAI также показывают, что когда это значение не задано, Codex обычно использует значение по умолчанию модели или предустановки. Другими словами, пользователям не нужно вручную принудительно устанавливать максимальный размер контекста при обычном использовании.
В оригинальном объявлении особо подчёркивается, что опция в миллион токенов доступна пользователям по их выбору, когда это необходимо.
Это различие важно, поскольку большее окно контекста — это возможность, а не обязательно наилучшая настройка по умолчанию для каждого сеанса.
Почему OpenAI не устанавливает контекст в 1 миллион по умолчанию
Tibo также напомнил, что текущая длина контекста по умолчанию в Codex установлена намеренно.
Согласно объявлению, OpenAI скорректировала стандартные настройки, найдя баланс между производительностью и стоимостью. Пользователи могут свободно выбирать больший контекст, но настройка по умолчанию предназначена для эффективной работы типичных сеансов кодирования.
Это согласуется с официальными рекомендациями по ценообразованию Codex от OpenAI.
OpenAI отмечает, что внешне похожие задачи могут существенно различаться по потреблению квоты пользователя, поскольку использование зависит от следующих факторов:
- Выбор модели
- Размер контекста
- Рассуждение
- Использование инструментов
- Поиск
- Кэширование подсказок
Это означает, что окно в миллион токенов не следует понимать как «бесплатную дополнительную память».
Чем больше контекста активно обрабатывает сеанс, тем больше токенов может потребоваться для чтения, кэширования, управления или сжатия. Таким образом, для пользователей, работающих в рамках тарифных ограничений Codex, больший контекст будет быстрее расходовать доступную квоту.
Таблица ставок на основе токенов OpenAI также рассматривает сверхдлинный контекст как отдельную рабочую нагрузку. В поддерживаемых средах Work и Codex входные данные, превышающие порог длинного контекста, могут облагаться более высокими ставками на токены в соответствии с применимым ценообразованием на основе токенов.
Настройки по умолчанию достаточны для многих повседневных задач
Codex уже включает механизмы управления контекстом, предназначенные для поддержания работоспособности длинных сеансов.
Для обычного исправления ошибок, целенаправленной разработки функций, проверки кода или небольших изменений в репозитории стандартной конфигурации контекста может быть достаточно.
Разработчики, которые постоянно держат весь репозиторий и все предыдущие результаты инструментов в активном окне, не обязательно получат какую-либо выгоду.
Более полезно сопоставлять размер контекста с задачей.
Контекст в миллион токенов наиболее привлекателен, когда работа действительно зависит от большого количества одновременно релевантной информации, например:
- Рефакторинг крупномасштабного репозитория
- Длительная отладка в нескольких файлах
- Миграция архитектуры
- Анализ зависимостей между модулями
- Сложные агентные рабочие процессы с обширной историей инструментов
- Задачи, где агрессивное сжатие потеряет полезные детали реализации
Для узких задач, затрагивающих лишь несколько файлов, контекст по умолчанию может быть более эффективным.
Больший контекст означает больше пространства до сжатия
Одним из основных преимуществ расширенного окна является то, что Codex может сохранять больше истории до необходимости сжатия более старой информации.
Сжатие контекста полезно, поскольку ни один агент не может бесконечно нести неограниченную историю. Но сжатие неизбежно заменяет подробный предыдущий материал более короткими представлениями.
Большее окно откладывает этот компромисс.
Например, длинный сеанс кодирования может накопить:
- Инструкции по репозиторию
- Исходные файлы
- Результаты поиска
- Команды оболочки
- Выводы тестов
- Неудачные подходы
- Различия в коде
- Исправления пользователя
- Архитектурные решения
- Дополнительные вызовы инструментов
Когда активный контекст становится переполненным, Codex может потребовать сжатия или иного управления более ранней историей.
Создайте сайт-витрину и привлекайте лиды за минуты
Опишите идею одной фразой, и We0 AI создаст сайт-витрину, страницы и CMS, а после запуска поможет привлечь клиентов и трафик.
Одна полная генерация проекта для бесплатной регистрации
Лучше всего попробовать один полный поток генерации и быстро увидеть первый черновик проекта.
С помощью полного окна в 1,05 млн токенов GPT-5.6 Sol больше информации может оставаться напрямую доступной в течение более длительного времени.
Это особенно полезно, когда более ранние детали остаются важными для решений, принимаемых на более поздних этапах задачи.
Однако это преимущество зависит от рабочей нагрузки. Сохранение информации доступной полезно только в том случае, если эта информация остаётся релевантной.
Длинный контекст быстрее расходует использование
Основное предупреждение в оригинальной статье AIBase касалось ограничений использования.
Некоторые разработчики сообщают, что включение полного контекста в миллион токенов может привести к более быстрому снижению доступной квоты Codex в интенсивных сеансах.
С точки зрения учёта токенов такое поведение неудивительно.
Собственная документация Codex от OpenAI объясняет, что только длина подсказки не определяет использование. Контекст, рассуждение, инструменты, поиск и кэширование — всё это влияет на объём квоты, потребляемой задачей.
Таким образом, когда сеанс действительно разрастается до этого пространства, больший контекст создаёт возможность более тяжёлых раундов.
Это не означает, что каждый запрос немедленно потребляет миллион токенов только потому, что включено максимальное окно. Это означает, что сеанс может вырасти до больших размеров, и достаточно большие запросы могут быть дороже с точки зрения токенов или планового использования, чем аналогичные запросы с меньшим рабочим контекстом.
Поэтому более безопасная стратегия по умолчанию — включать максимальное окно только при решении реальных проблем.
Когда следует использовать контекст в 1 млн для GPT-5.6 Sol?
Новая опция наиболее полезна, когда стоимость потери контекста превышает стоимость его переноса.
Хорошие кандидаты для полного окна контекста
Рассмотрите возможность использования большего окна в следующих случаях:
Codex должен понимать очень большую кодовую базу.
- Рефакторинг затрагивает несколько пакетов или модулей.
- Сессия имеет длинную цепочку зависимостей, где ранние решения всё ещё актуальны.
- Отладка требует сравнения логов, исходных файлов, тестов и ранних предположений.
- Вы выполняете миграцию, затрагивающую большую часть кодовой базы.
- Автоматическое сжатие происходит до того, как вы хотели бы, чтобы ранние детали были обобщены.
Ситуации, когда конфигурация по умолчанию может быть лучше
Сохраняйте обычную конфигурацию контекста в следующих случаях:
- Задача ограничена одним или несколькими файлами.
- Вы можете разделить проект на чёткие, независимые сессии.
- Большинство ранних выводов инструментов больше не полезны.
- Вы выполняете быструю проверку или изолированное исправление.
- Сохранение еженедельного или планового использования Codex важнее, чем сохранение максимальной истории.
Ключевое изменение заключается в том, что у разработчиков теперь есть выбор.
Ранее полные контекстные возможности, описанные в исходном отчёте, были ограничены использованием API-ключей. Пользователи учётных записей ChatGPT теперь могут выбирать более крупное окно, когда это требуется рабочей нагрузкой.
Часто задаваемые вопросы
Насколько велико контекстное окно GPT-5.6 Sol?
Официальная документация по моделям OpenAI указывает, что GPT-5.6 Sol имеет контекстное окно в 1 050 000 токенов. Модель также поддерживает до 128 000 выходных токенов.
Могу ли я использовать контекстное окно в 1M в Codex с учётной записью ChatGPT?
Да. Обновление, о котором сообщил AIBase и которое объявил инженер OpenAI Тибо, показывает, что поддержка миллиона токенов контекста для GPT-5.6 Sol включена для аутентифицированных сессий Codex.
Использование через учётную запись ChatGPT, а не только через API-ключ.
Нужен ли API-ключ OpenAI для использования большего контекста Codex?
Нет, для пути через учётную запись ChatGPT, описанного в этом обновлении. Аутентификация через API-ключ по-прежнему поддерживается, но это изменение специально расширяет эту возможность на сценарии использования учётной записи ChatGPT.
Контекстное окно в 1 миллион токенов включено по умолчанию?
Нет. В объявлении указано, что обычные настройки контекста Codex были намеренно оптимизированы для баланса производительности и стоимости. Большее окно — это опция для пользователей с особыми потребностями, которым требуется дополнительный контекст.
Почему больший контекст быстрее расходует мою квоту Codex?
Контекст влияет на объём информации, которую обрабатывает модель. В документации по ценообразованию Codex от OpenAI указано, что выбор модели, контекст, рассуждения, использование инструментов, поиск и кэширование влияют на потребление, поэтому длинные и контекстно-зависимые сессии расходуют больше квоты.
Означает ли включение контекста в 1 миллион, что каждое сообщение будет использовать миллион токенов?
Нет. Контекстное окно — это максимальная ёмкость, а не фиксированная плата за токены для каждого раунда диалога. Фактическое использование зависит от объёма содержимого в сессии и объёма данных, обрабатываемых моделью.
Какие задачи кодирования больше всего выигрывают от контекста в миллион токенов?
Рефакторинг больших кодовых баз, длительные сессии отладки, миграция архитектуры, межмодульный анализ и расширенные агентные рабочие процессы — всё это подходящие сценарии. Небольшие исправления и чётко ограниченные задачи обычно не требуют максимального окна.
Где документирована настройка контекстного окна Codex?
OpenAI документирует model_context_window в официальном справочнике конфигурации Codex и в руководстве по расширенной конфигурации. В примерах конфигурации указано, что если это значение не задано, Codex использует значения по умолчанию для модели или предустановленные значения.
Связанные инструменты
- OpenAI Codex: кодирующий агент OpenAI для локальной разработки, рабочих процессов IDE, облачных задач и долгосрочной разработки ПО.
- GPT-5.6 Sol: флагманская модель GPT-5.6 от OpenAI с контекстным окном в 1,05 миллиона токенов.
- Настольная версия ChatGPT: настольное рабочее пространство OpenAI для проектов, файлов и долгосрочной работы ChatGPT и Codex.
Связанные ссылки
- Документация модели GPT-5.6 Sol: официальные спецификации контекстного окна в 1,05 миллиона, ограничений вывода, идентификатора модели и поддерживаемых возможностей.
- Анонс OpenAI GPT-5.6: официальный обзор GPT-5.6 Sol, Terra и Luna от OpenAI и их доступности в Codex.
- Расширенная конфигурация Codex: официальная документация, охватывающая
model_context_windowи другие настройки ограничений модели. - Справочник конфигурации Codex: полный справочник ключей конфигурации Codex, включая контекстное окно и управление автоматическим сжатием.
- Пример конфигурации Codex: пример
config.tomlот OpenAI, включая опциональную ручную настройку контекстного окна. - [Ценообразование и лимиты использования Codex](https://developers.
openai.com/codex/pricing): официальная информация о доступности планов, руководства по использованию и сведения о том, как контекст и другие факторы влияют на потребление.
- Каталог моделей OpenAI: официальное сравнение моделей GPT-5.6, включая контекстные окна, ограничения вывода и цены API.
Резюме
Полный миллион токенов контекста GPT-5.6 Sol больше не ограничен сессиями Codex, аутентифицированными через API-ключ. Пользователи учётных записей ChatGPT теперь также могут получить доступ к более крупному варианту контекста, что даёт больше места для хранения содержимого репозитория, выводов инструментов и истории диалога в длительных кодирующих сессиях.
Максимальное окно не предназначено для замены обычных настроек Codex по умолчанию для каждой задачи. OpenAI тщательно настроил параметры по умолчанию для баланса производительности и стоимости, а опция в 1,05 миллиона токенов наиболее полезна для действительно больших репозиториев и долгосрочной инженерной работы.
Для повседневных исправлений контекст по умолчанию может оставаться более эффективным. Для сложных проектов, где потеря ранних деталей становится реальным узким местом, новая опция предоставляет разработчикам значительно больший запас.
Ключевое обновление заключается не в том, что каждая сессия Codex должна использовать миллион токенов, а в том, что пользователи ChatGPT теперь могут выбирать полный контекст GPT-5.6 Sol, когда проект действительно в этом нуждается.



