Текущая2026-07-09

От OpenAI
GPT-5.6 Sol — флагман OpenAI для сложного программирования, исследований и многошаговых агентных задач. Модель принимает текст и изображения, работает с контекстом 1,05 млн токенов и выдаёт до 128 тыс. токенов. В API доступна как gpt-5.6-sol и через алиас gpt-5.6.
GPT-5.6 Sol сильнее всего выглядит в категориях «рассуждения и математика». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
высокая
Покрытие
10 тестов · 9 направлений
Происхождение
livebench + artificialAnalysis + lmarenaVision
1 тест · уверенность: низкая
1 тест · уверенность: низкая
2 теста · уверенность: средняя
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: низкая
1 тест · уверенность: средняя
1 тест · уверенность: низкая
1 тест · уверенность: низкая
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 94.6% | н/д | Источник не указан |
| SWE Bench Pro | 64.6% | н/д | Источник не указан |
| Terminal-Bench 2.1 | 88.8% | н/д | Источник не указан |
| BrowseComp (Веб-поиск) | 90.4% | н/д | Источник не указан |
| OSWorld 2.0 (Компьютер) | 62.6% | н/д | Источник не указан |
| MMMU Pro (Мультимодальность) | 83% | н/д | Источник не указан |
GPT-5.6 Sol — старшая модель семейства, которое OpenAI выпустила в общий доступ 9 июля 2026 года. Это не отдельная «версия ChatGPT», а модель для API, Codex и режимов углублённого рассуждения в ChatGPT. В API её вызывают идентификатором gpt-5.6-sol; короткий алиас gpt-5.6 указывает на ту же ступень семейства.
Sol рассчитана на задачи, где ошибка или недоделанная цепочка действий обходится дороже дополнительных токенов: сложная разработка, анализ больших массивов документов, исследования с веб-поиском, работа в интерфейсах и длительные агентные процессы. Для короткого ответа на типовой вопрос Sol часто избыточна — у OpenAI для этого есть Terra и Luna.
| Параметр | Значение |
|---|---|
| API ID | gpt-5.6-sol |
| Контекст | 1 050 000 токенов |
| Максимальный ответ | 128 000 токенов |
| Срез знаний | 16 февраля 2026 года |
| Вход | текст и изображения |
| Выход | текст |
| Цена входа | $5 за 1 млн токенов |
| Цена выхода | $30 за 1 млн токенов |
| Уровни рассуждения | none, low, medium, high, xhigh, max |
Для кэшированных чтений действует скидка 90%. Запись нового кэша для GPT-5.6 тарифицируется по коэффициенту 1,25 к обычной цене входа. Поэтому кэш полезен при повторном использовании большого системного промпта, документации или общей базы инструкций, но первый запрос с новым префиксом будет дороже обычного входа.
OpenAI опубликовала результаты сразу по профессиональным, кодовым, мультимодальным и агентным тестам. Это полезнее старых сводок MMLU и HumanEval: они хуже отражают работу модели с репозиторием, браузером и компьютерным интерфейсом.
| Тест | GPT-5.6 Sol | GPT-5.5 | Что проверяет |
|---|---|---|---|
| SWE-Bench Pro | 64,6% | 59,4% | Исправление реальных задач в репозиториях |
| Terminal-Bench 2.1 | 88,8% | 85,6% | Работа в терминале |
| GPQA Diamond | 94,6% | 93,6% | Сложные научные вопросы |
| BrowseComp | 90,4% | 84,4% | Агентный поиск в интернете |
| OSWorld 2.0 | 62,6% | 47,5% | Работа с графическим интерфейсом |
| MMMU Pro без инструментов | 83,0% | 81,2% | Понимание текста и изображений |
| SEC-Bench Pro | 71,2% | 45,8% | Многошаговые задачи кибербезопасности |
| OpenAI MRCR 256K–512K | 91,5% | 81,5% | Поиск нескольких фактов в длинном контексте |
Сильнейший прирост виден не в академических вопросах, а в действиях: OSWorld, BrowseComp и SEC-Bench. Это важный ориентир для выбора. Если продукт только классифицирует обращения или пишет короткие ответы, переплата за Sol может не дать заметного эффекта. Если модель должна открыть приложение, найти данные, изменить код и проверить результат, разрыв становится практическим.
Режим Ultra в таблицах OpenAI нельзя считать отдельной моделью. Это более дорогой режим выполнения с параллельными агентами. Например, BrowseComp повышается с 90,4% до 92,2%, а Terminal-Bench 2.1 — с 88,8% до 91,9%. Сравнивать обычный Sol и Sol Ultra без учёта числа агентов и вычислительного бюджета некорректно.
Sol подходит для четырёх типов работы:
Для продакшена полезна маршрутизация. Сначала дешёвая модель определяет тип и риск запроса. Sol получает только задачи с высокой неопределённостью, длинным контекстом или дорогой ошибкой. Такой подход снижает среднюю стоимость без искусственного ограничения качества на сложных кейсах.
В обычных чатах ChatGPT модель Sol используется в режимах Medium, High и Extra High на подходящих платных планах. Terra и Luna в стандартном чате не выбираются: они доступны в ChatGPT Work, Codex и API. Это различие важно, потому что название семейства не означает одинаковый список моделей во всех продуктах.
Для программирования смотрите обзор OpenAI Codex. Для обычного диалога на сайте есть русскоязычный чат; он использует стороннюю модель сопоставимого класса, а не API GPT-5.6. Соседние варианты семейства: GPT-5.6 Terra и GPT-5.6 Luna.
Данные сверены с карточками моделей OpenAI и официальным релизом GPT-5.6.
Свежие независимые замеры, практические видео и первые отзывы собраны в новости «GPT-5.6 вышла в трёх версиях: тесты Sol, Terra и Luna».
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей OpenAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.