Запуск GPT-5.5: новая эра агентного ИИ

OpenAI представила GPT-5.5 23 апреля, позиционируя модель как «новый класс интеллекта для реальной работы и управления агентами». Компания подчёркивает, что это Сэмая продвинутая агентная ИИ-модель на сегодняшний день, спроектированная с нуля для планирования, использования инструментов, Сэмопроверки результатов и выполнения задач без постоянного контроля человека.

GPT-5.5 стала первой переобученной базовой моделью после GPT-4.5 и была совместно разработана с системами NVIDIA GB200 и GB300 NVL72 масштаба стойки. Практическое отличие от предшественника — задачи, ранее требовавшие множества промптов и ручной коррекции, теперь можно делегировать модели значительно полнее. Модель доступна пользователям ChatGPT и Codex на тарифах Plus, Pro, Business и Enterprise; доступ к API открыт с 24 апреля.

Бенчмарки: где GPT-5.5 лидирует, а где отстаёт

Сэмый сильный результат GPT-5.5 продемонстрировала на Terminal-Bench 2.0 — бенчмарке, тестирующем командные строковые сценарии, требующие планирования и координации инструментов в песочнице. Модель набрала 82,7% против 75,1% у GPT-5.4 и 69,4% у Claude Opus 4.7. На SWE-Bench Pro, оценивающем решение задач на GitHub, GPT-5.5 достигла 58,6%, решая больше задач за один проход, чем предыдущие версии.

OpenAI также представила внутренний бенчмарк Expert-SWE, где задачи имеют медианное время ручного выполнения в 20 часов. GPT-5.5 показала 73,1% против 68,5% у GPT-5.4. В тесте на длинный контекст MRCR v2 с одним миллионом токенов — задаче поиска конкретного ответа в большом документе — модель набрала 74,0% против 36,6% у GPT-5.4. Однако на MCP Atlas — бенчмарке Scale AI для использования инструментов — GPT-5.5 не получила оценку, тогда как Claude Opus 4.7 лидирует с 79,1%. OpenAI включила это отсутствие в собственную таблицу результатов, что свидетельствует о уверенности в общей картине.

Ценообразование: рост стоимости API и реальная экономика

Доступ к API GPT-5.5 стоит $5 за миллион входных токенов и $30 за миллион выходных — ровно вдвое дороже, чем GPT-5.4. OpenAI оправдывает это тем, что GPT-5.5 выполняет те же задачи в Codex с меньшим числом токенов, и с учётом эффективности реальная стоимость выше примерно на 20%. Это утверждение подтвердил независимый аналитический центр Artificial Analysis.

Версия GPT-5.5 Pro, доступная пользователям Pro, Business и Enterprise, стоит $30 за миллион входных и $180 за миллион выходных токенов. Она применяет дополнительные параллельные вычисления при тестировании для сложных задач и возглавляет рейтинг публично доступных моделей на BrowseComp — бенчмарке агентного веб-сёрфинга OpenAI — с результатом 90,1%. При объёме в 10 миллионов выходных токенов в месяц стандартный GPT-5.5 обходится в $300 против $250 у Claude Opus 4.7 — на 20% дороже, и эта разница окупается только если превосходство модели в агентных задачах сокращает число итераций и повторных попыток.

Внедрение в бизнес и экспертные оценки

По данным OpenAI, более 85% сотрудников компании теперь еженедельно используют Codex в своих подразделениях, включая инженерные и маркетинговые команды. В одном из примеров коммуникационный отдел применил GPT-5.5 для обработки шести месяцев данных запросов на выступления: модель построила систему оценки и анализа рисков для автоматизации одобрения задач с низким уровнем угрозы.

Президент OpenAI Грег Брокман назвал релиз «реальным шагом вперёд к вычислениям, которых мы ожидаем в будущем», а главный учёный компании Якуб Пахоцкий отметил, что за последние два года прогресс в развитии моделей ощущался «удивительно медленно». OpenAI также подчёркивает, что GPT-5.5 сохраняет ту же задержку на токен в продакшн-сервисе, что и GPT-5.4, несмотря на более высокий уровень интеллекта — компромисс между мощностью и скоростью, характерный для крупных моделей, в данном случае был устранён. Вопрос о том, приведут ли лидерство в бенчмарках к реальным улучшениям в работе агентных пайплайнов команд, потребует нескольких недель практического тестирования.