Новый класс интеллектуальных агентов
OpenAI представила GPT-5.5 как модель нового поколения, ориентированную на работу в качестве автономного агента. В отличие от предыдущих версий, эта модель изначально создавалась для того, чтобы самостоятельно планировать действия, использовать различные инструменты и проверять правильность собственных результатов.
Главное практическое преимущество заключается в возможности делегирования задач. Если раньше для выполнения сложных процессов требовалось многократное повторение запросов и постоянная корректировка действий со стороны человека, то GPT-5.5 способна справляться с ними более самостоятельно.
Технические особенности и архитектура
GPT-5.5 стала первой базовой моделью, прошедшей переобучение с момента выхода GPT-4.5. При разработке архитектуры использовались системы NVIDIA GB200 и GB300 NVL72. При этом OpenAI удалось сохранить скорость работы на уровне GPT-5.4, несмотря на значительный рост интеллектуальных возможностей модели.
Для пользователей с подписками Plus, Pro, Business и Enterprise доступ к модели открыт в ChatGPT и Codex. API для разработчиков стало доступно на следующий день после релиза.
Результаты тестирования и бенчмарки
В тестах на выполнение рабочих процессов через командную строку (Terminal-Bench 2.0) модель показала результат 82,7%, опередив GPT-5.4 (75,1%) и Claude Opus 4.7 (69,4%). В задачах по исправлению ошибок в коде на платформе GitHub (SWE-Bench Pro) GPT-5.5 достигла показателя 58,6%, решая больше проблем за один проход.
В тестах на работу с длинным контекстом (MRCR v2 при объеме в один миллион токенов) модель показала результат 74,0%, что значительно выше предыдущего показателя GPT-5.4 (36,6%). Однако в тесте на использование инструментов MCP Atlas модель пока не имеет зафиксированных результатов, уступая Claude Opus 4.7.
Стоимость и эффективность использования
Стоимость использования API для GPT-5.5 выросла вдвое: 5 долларов за миллион входных токенов и 30 долларов за миллион выходных. Однако OpenAI утверждает, что модель более эффективна: она тратит меньше токенов на выполнение тех же задач в Codex, что делает итоговую стоимость работы примерно на 20% выше, чем у GPT-5.4.
Для профессиональных пользователей доступна версия GPT-5.5 Pro. Она использует дополнительные вычислительные мощности для решения сложных задач и лидирует в бенчмарке по веб-серфингу BrowseComp с результатом 90,1%.
Что это значит
Выход GPT-5.5 знаменует переход к более автономным ИИ-системам, способным выполнять сложные цепочки действий без постоянного контроля человека. Эффективность модели в реальных рабочих задачах будет зависеть от того, насколько её способность решать задачи за меньшее количество итераций перекроет возросшую стоимость токенов.
