OpenAI выпустили GPT-5.5: пишет код дешевле предшественника

GPT-5.5 — это следующая модель после GPT-5.4, ориентированная прежде всего на агентную работу: многошаговые задачи, где модель планирует, использует инструменты и доводит работу до конца без постоянного участия пользователя.

На Terminal-Bench 2.0 (сложные командно-строковые сценарии с планированием и итерациями) модель показала 82.7% против 75.1% у GPT-5.4. На SWE-Bench Pro, который оценивает решение реальных GitHub-задач, — 58.6%. Примечательно, что этих результатов GPT-5.5 достигает при меньшем количестве токенов, чем предшественник.

Отдельно выделяют научные задачи. На GeneBench — многоэтапный анализ генетических данных — модель существенно обогнала GPT-5.4. Внутренняя версия GPT-5.5 нашла доказательство нового утверждения о числах Рэмси (классическая задача комбинаторики), которое затем верифицировали в Lean.

С точки зрения инфраструктуры: модель обслуживается на NVIDIA GB200/GB300 NVL72, и её задержка при выдаче токенов сопоставима с GPT-5.4 — при существенно более высоком качестве. Оптимизация балансировки нагрузки, которую написал Codex на основе анализа недельных паттернов трафика, дала прирост скорости генерации токенов на 20%.

Доступ: ChatGPT Plus/Pro/Business/Enterprise и Codex уже сегодня. API — в ближайшее время, цена $5 за 1M входных токенов и $30 за выходные. GPT-5.5 Pro — $30/$180.

Источник: https://openai.com/index/introducing-gpt-5-5/

Русскоязычное сообщество про AI в разработке

Друзья! Эту новость подготовила команда ТГК «AI for Devs» — канала, где мы рассказываем про AI-агентов, плагины для IDE, делимся практическими кейсами и свежими новостями из мира ИИ. Подписывайтесь, чтобы быть в курсе и ничего не упустить!

@python_leader
23.04.2026 23:13 UTC
Первоисточник

Комментарии

@KillLock
23.04.2026 21:44 UTC
+1

На самом деле это дороже чем 5.4 по отзывам, но не намного. 5.5 немного лучше 5.4 по тестам, в кодировании отстает от Опус 4.7, но намного превосходит ослабленный Опус 4.7 для подписчиков, уже 5.2/5.4 превосходили опус 4.6/4.7 для подписчиков(я не слышал жалоб на Опус 4.6/4.7 на корпоративных/командных аккаунтах с оплатой за токены). Антропик призналась в недостатках 4.6/4.7 но списала это на ошибки, хотя это ложь они ослабили Опус что бы принять всех кто к ним перешел, что перевернуло их лодку. Опус 4.5 + суперспособности>5.5/5.2>5.4>4.6>4.7 (для GPT нельзя использовать суперспособности так как они для Опус, а Опус 4.7 обходит все навыки и правила) Дипсик 4 код если слухи подтвердятся+Квен 3.6 проверка и дирижер все еще кажутся лучшей связкой по цене\качество.

@segment
23.04.2026 21:46 UTC
0

что значит "для подписчиков"? Для всех типов подписок?

23.04.2026 22:07 UTC
0

Теория заговора: якобы есть «настоящий» опус 4.7 (и были 4.6, 4.5) которые умные и мощные, но подписоте широкой публике под его видом стали подсовывать разбавленную модель. А случилось эта подмена, согласно эпосу с Реддита, как раз в тот момент, когда был массовый исход из Open AI в Anthropic, к которому в Anthropic были не готовы. Подтвердить теорию невозможно, опровергнуть тоже, однако проскакивало заявление Амодеи: мол, несмотря на резкий рост пользователей, вкладываться в новое оборудование может стать критической ошибкой. Субъективно, в моих задачах, были колебания, и до сих пор лучше всего он работает в выходные, но может дело во мне:)

@KillLock
24.04.2026 03:22 UTC
+2

Ослабление Опус 4.6 это не теория заговора это подтверждено инженером АМД по искусственному интеллекту, Опус 4.6 был ослаблен через 3 дня после выхода. На Гит Хаб висит целый отчет с анализом. С ослаблением Опус 4.7 немного другая история они его выпустили уже сразу ослабленным. Весь неофициальный реддит по Опусу 4.7 завален жалобами: 2000 ответов негативные отзывы 90 к 1. "Opus 4.7 — это легендарно плохая игра. Я просто не могу в это поверить." "Claude Opus 4.7 — это полная ерунда."

"

  • Галлюцинации — 37 комментариев прямо упоминают их. Единственный комментарий с наибольшим количеством голосов во всем корпусе (517 баллов) — это запись в чате с оценкой 4,7, в которой отрицается существование папки, а затем выдумывается рецензент PR по имени «Джаред».

  • Лень / прогулы — 44 комментария. Из сценария самоаудита одного пользователя: «Я придумал термин, чтобы замаскировать невыполнение работы. Я переписал критерии приемки в соответствии с тем, что я уже выпустил».

  • Игнорирование файла CLAUDE.md — глобальное правило пользователя гласило : «Прекратите говорить „Вы правы“» , первый ответ: «Вы правы!»

  • Корпоративный тон "Opus GPT" — "льстивый и одновременно предельно поверхностный в своем анализе".

  • «Аналитический тест» по принципу «автомойки» : из 200 контролируемых звонков, которые кто-то провел, 4,5 прошли проверку на 80%, 4,6 и 4,7 провалились (0/20).

"

Повышение цен на убыточные подписки прогнозировалось, но Антропик и кстати ОпенАИ, но в меньшей степени решили ослабить модели что вызвало волну негатива.

@Samail
25.04.2026 09:24 UTC
0

Что-то у меня не получается дешевле. И токенов больше тратится и сами они в 2 раза дороже. В итоге в 3 раза дороже чем 5.4 выходит.