От GPT-4o к GPT-5: эволюция архитектуры
OpenAI выпустила не одну модель, а целую линейку GPT-5, которая включает как базовую версию для ChatGPT, так и специализированные варианты для разработчиков. Главное отличие от предыдущих поколений — отказ от простого увеличения параметров в пользу унифицированной системы с роутером. Этот роутер автоматически определяет, какой режим генерации подходит для конкретного запроса: быстрый ответ без глубоких рассуждений или, наоборот, многошаговое «мышление» для сложных задач.
Внутри ChatGPT это работает незаметно для пользователя: вы задаёте вопрос, а система сама решает, нужно ли активировать режим GPT-5 Thinking. В API же разработчики могут явно выбирать нужный вариант и управлять глубиной рассуждений через параметр reasoning_effort.
Позднее, в 2026 году, вышла версия GPT-5.5 (кодовое имя «Spud»), которая стала первой с нуля переобученной базовой языковой моделью со времён GPT-4.5. Её архитектура изначально заточена на омнимодальность — обработку текста, аудио, фото и видео в едином потоке, без отдельных модулей. Это позволило добиться качественно нового уровня понимания контекста и выполнения сложных, многоэтапных инструкций.
Контекстное окно: от 400 тысяч до 1 миллиона токенов
Одно из самых заметных улучшений — радикальное расширение контекстного окна. В GPT-5 через API доступно до 400 тысяч токенов суммарно (примерно 272 тысячи на вход и 128 тысяч на выход). Этого достаточно, чтобы загрузить в один диалог объёмный репозиторий кода, длинное юридическое заключение или несколько глав книги.
GPT-5.5 пошла ещё дальше, предложив контекстное окно в 1 миллион токенов — около 1500 страниц плотного текста. На внутренних тестах OpenAI MRCR v2 модель показала точность извлечения фактов 81,5% на объёме 256–512 тысяч токенов, тогда как предыдущая версия (GPT-5.4) на том же объёме выдавала лишь 57,5%. На экстремальном объёме 512 тысяч — 1 миллион токенов точность GPT-5.5 составила 74%, что почти вдвое выше, чем у GPT-5.4 (36,6%).
Для обычного пользователя это означает, что можно забыть о проблеме «забывчивости» нейросети в середине длинного диалога. Вы можете загрузить в один чат все банковские выписки за год, многотомный договор или полный брендбук компании — модель не потеряет нить рассуждения и не перепутает факты.
Омнимодальность: текст, аудио, фото и видео в едином потоке
GPT-5.5 стала первой по-настоящему омнимодальной моделью OpenAI. В отличие от предыдущих версий, где текстовый, визуальный и голосовой движки работали как отдельные модули, новая архитектура воспринимает все типы данных комплексно.
На практике это выглядит так: вы можете сфотографировать содержимое холодильника, надиктовать голосом пожелания по рецепту и получить на выходе готовый пошаговый план приготовления блюда. Или загрузить видео с демонстрацией ошибки в интерфейсе, тут же получить анализ проблемы и готовый код для её исправления.
Голосовой режим стал значительно естественнее: модель улавливает интонации, понимает сарказм, делает паузы для «вдоха» и подстраивается под темп речи собеседника. Это открывает новые возможности для языковой практики, мозговых штурмов в дороге или помощи с уроками, где нужно объяснить сложную тему простыми словами.
Автономные агенты: Codex и выполнение задач без контроля человека
Ключевой прорыв GPT-5.5 — встроенный автономный агент Codex. Это не просто генератор кода, а полноценная среда разработки, способная самостоятельно писать, тестировать, отлаживать и внедрять программный код без участия человека.
Пример из практики OpenAI: Codex использовали для настройки собственных серверов компании. Агент проанализировал трафик, написал скрипт балансировки нагрузки на GPU и добился повышения скорости работы инфраструктуры на 20%.
Для обычных пользователей, не знакомых с программированием, это тоже полезно. Вы можете попросить на русском языке: «Сделай красивый таймер на 25 минут, чтобы он открывался прямо в браузере». Агент самостоятельно напишет HTML, CSS и JavaScript, запустит код в изолированной среде, проверит работоспособность кнопок, исправит ошибки и выдаст готовый файл.
В тесте Terminal-Bench 2.0 (работа с командной строкой) GPT-5.5 набрала 82,7%, оставив позади Claude Opus 4.7 (69,4%). В закрытом тесте Expert-SWE базовая модель достигла 73,1%, что говорит о готовности к Enterprise-разработке.
Сравнение с конкурентами: бенчмарки и реальные сценарии
Чтобы оценить реальную силу GPT-5.5, стоит взглянуть на свежие результаты тестов в сравнении с главными конкурентами — Claude Opus 4.7 от Anthropic и Gemini 3.1 Pro от Google.
Математика и логика В сложнейшем тесте FrontierMath Tier 4 версия GPT-5.5 Pro достигла 39,6%, тогда как Claude Opus 4.7 набрал лишь 22,9%, а Gemini 3.1 Pro — 16,7%. Это говорит о значительном прогрессе в способности решать многоступенчатые логические задачи.
Безопасность В симуляциях кибератак (CyberGym) GPT-5.5 показала 81,8%, опережая Claude Opus 4.7 (73,1%). Однако из-за глубоких знаний уязвимостей OpenAI присвоила модели статус «Высокий риск» в категориях кибербезопасности и биохимии, что привело к усилению модерации.
Браузерная навигация В тесте BrowseComp GPT-5.5 Pro набрала 90,1%, обогнав Gemini 3.1 Pro (85,9%) и базовую GPT-5.5 (84,4%).
Работа с инструментами В тесте Toolathlon (использование сложных инструментов) OpenAI обходит Google: 55,6% против 48,8%.
Важно понимать, что эти цифры отражают потенциал модели в контролируемых условиях. В реальной работе результат может варьироваться в зависимости от качества промпта и специфики задачи.
Цены API и тарифы для разработчиков
Для разработчиков OpenAI предлагает три размера модели в API: gpt-5, gpt-5-mini и gpt-5-nano. Цены различаются в зависимости от объёма и сложности:
- GPT-5: вход $1,25 за 1 млн токенов (cached — $0,125), выход $10 за 1 млн токенов.
- GPT-5-mini: вход $0,25 (cached — $0,025), выход $2.
- GPT-5-nano: вход $0,05 (cached — $0,005), выход $0,40.
Дополнительно доступен Batch API со скидкой 50% и приоритетная обработка для срочных задач. Актуальные цены всегда лучше сверять на официальной странице Pricing.
Для пользователей ChatGPT модель GPT-5 стала стандартной для всех залогиненных пользователей. В платных тарифах (Plus, Pro, Team) доступны переключатели на GPT-5 Thinking и GPT-5 Pro, а также появились персональности (Cynic, Robot, Listener, Nerd) и режим Study mode для интерактивного обучения.
Безопасность: от жёстких отказов к safe-completions
OpenAI изменила подход к безопасности в GPT-5. Вместо того чтобы просто отказывать в выполнении запроса, модель теперь старается дать максимально полезный, но безопасный ответ в рамках «зелёной зоны». Это особенно важно для двояких тем — биологии, кибербезопасности, где можно и помочь, и навредить.
В системной карте GPT-5 зафиксировано снижение «угождательства» (sycophancy) и улучшение честности: модель чаще явно говорит «я не могу это сделать здесь», вместо того чтобы имитировать выполнение задачи. Доля обманчивых ответов в задачах с отсутствующими файлами или поломанными инструментами упала с ~4,8% у o3 до ~2,1% у GPT-5 Thinking.
Однако для GPT-5.5 из-за высокого риска в категориях кибербезопасности и биохимии введены усиленные ограничения. Обычные пользователи будут чаще сталкиваться с системными отказами, если их промпт косвенно затрагивает тему безопасности сетей или программного обеспечения. Для профессионалов запущена программа Trusted Access for Cyber: подтвердив свою личность, белые хакеры могут работать с моделью без жёстких цензурных рамок.
Практические советы: как выжать максимум из GPT-5.5
Чтобы получить наилучший результат от работы с GPT-5.5, стоит скорректировать свой подход:
- Грузите мега-контекст. Забудьте про лимиты. Закидывайте в один диалог брендбуки, старые статьи, логи серверов или регламенты. Модель не запутается благодаря улучшенному механизму извлечения фактов.
- Используйте модульность. Не требуйте финальный результат одним промптом. Попросите модель собрать структуру, утвердите её, а затем поручите детализацию каждого блока отдельно. Этот метод (Modular Essay Framework) особенно эффективен для написания больших текстов.
- Общайтесь свободно. Откажитесь от роботизированных конструкций. Описывайте задачу максимально подробно, будто объясняете её стажёру в офисе. Модель отлично понимает естественную речь.
- Используйте голосовое управление. Для быстрых задач — мозгового штурма, языковой практики, заметок на ходу — голосовой режим значительно удобнее текстового ввода.
- Делегируйте рутину. Если вам нужен простой таймер, макрос для Excel или анализ таблицы на сотни тысяч строк — не пишите код сами, поручите это агенту Codex.
Как использовать ChatGPT в России: обход блокировок и агрегаторы
В 2025–2026 годах официальные сервисы OpenAI в России остаются недоступны: блокировки по IP и невозможность оплаты российскими картами делают прямую регистрацию крайне сложной. Постоянный поиск рабочих VPN и покупка виртуальных номеров отнимают время, которое можно потратить на работу.
Оптимальное решение для российских пользователей — платформы-агрегаторы нейросетей. Они объединяют API передовых ИИ-систем в едином интерфейсе, предоставляют доступ к актуальным моделям на русском языке, не требуют постоянного включения средств обхода блокировок, а оплата проходит с рублёвых банковских карт.
Например, платформа Study AI (study24.ai) предлагает доступ к ChatGPT 5.5, Claude Opus и генераторам изображений в одном окне, без VPN и с простой оплатой. Это особенно удобно для фрилансеров, редакций и компаний, которым нужны закрывающие документы.
Вопросы и ответы
Чем отличается GPT-5 от GPT-5.5?
GPT-5 — это унифицированная система с роутером, который автоматически переключает режимы быстрого и глубокого ответа. Она доступна в ChatGPT как модель по умолчанию и в API с контекстом до 400K токенов. GPT-5.5 (кодовое имя «Spud») — это фундаментально переобученная модель с нуля, которая стала первой омнимодальной моделью OpenAI. Её главные отличия: контекстное окно в 1 млн токенов, нативная обработка текста, аудио, фото и видео в едином потоке, а также встроенный автономный агент Codex для самостоятельного написания и отладки кода.
Сколько стоит использование GPT-5 в API?
Цены зависят от размера модели. GPT-5: вход $1,25 за 1 млн токенов (cached — $0,125), выход $10 за 1 млн токенов. GPT-5-mini: вход $0,25 (cached — $0,025), выход $2. GPT-5-nano: вход $0,05 (cached — $0,005), выход $0,40. Дополнительно доступен Batch API со скидкой 50%. Для пользователей ChatGPT модель GPT-5 доступна бесплатно для залогиненных пользователей, а расширенные режимы — в платных тарифах Plus, Pro и Team.
Можно ли использовать ChatGPT 5.5 в России?
Прямой доступ к официальным сервисам OpenAI из России затруднён из-за блокировок по IP и невозможности оплаты российскими картами. Однако существуют платформы-агрегаторы (например, Study AI), которые предоставляют доступ к ChatGPT 5.5 и другим моделям через единый интерфейс, не требуют VPN и принимают оплату рублёвыми картами. Это наиболее удобный способ для профессиональной работы.
Что такое автономный агент Codex и зачем он нужен?
Codex — это встроенный в GPT-5.5 ИИ-агент, способный самостоятельно писать, тестировать, отлаживать и внедрять программный код без участия человека. Он работает в изолированной среде, может исправлять собственные ошибки и выдавать готовый продукт. Это полезно как для профессиональных разработчиков (автоматизация рутины, написание скриптов), так и для обычных пользователей (создание таймеров, макросов для Excel, простых веб-страниц по текстовому описанию).
Насколько безопасна GPT-5.5 и какие есть ограничения?
OpenAI присвоила GPT-5.5 статус «Высокий риск» в категориях кибербезопасности и биохимии из-за её глубоких знаний уязвимостей. Для обычных пользователей это означает усиленную модерацию: модель будет чаще отказывать в выполнении запросов, косвенно связанных с безопасностью сетей или ПО. Для профессионалов запущена программа Trusted Access for Cyber, позволяющая работать без жёстких цензурных рамок после подтверждения личности. В целом, модель стала честнее и реже выдаёт обманчивые ответы, но ответственность за использование всё равно лежит на пользователе.
Какой контекст поддерживает GPT-5.5 и почему это важно?
GPT-5.5 поддерживает контекстное окно до 1 миллиона токенов (примерно 1500 страниц текста). Это важно, потому что позволяет загружать в один диалог огромные объёмы информации — годовые отчёты, полные брендбуки, многотомные договоры или репозитории кода — без потери фокуса и забывания деталей. На внутренних тестах модель показала точность извлечения фактов 74% на объёме 512K–1M токенов, что почти вдвое выше, чем у предыдущей версии.
Какие бенчмарки лучше всего показывают превосходство GPT-5.5 над конкурентами?
Наиболее показательные результаты: Terminal-Bench 2.0 (работа с командной строкой) — 82,7% против 69,4% у Claude Opus 4.7; FrontierMath Tier 4 (сложная математика) — 39,6% у GPT-5.5 Pro против 22,9% у Claude; BrowseComp (браузерная навигация) — 90,1% у GPT-5.5 Pro против 85,9% у Gemini 3.1 Pro; CyberGym (кибербезопасность) — 81,8% против 73,1% у Claude. Эти цифры показывают, что новая модель лидирует в автономном программировании, математике и работе с инструментами.