Текущая2025-11-13

От OpenAI
GPT-5.1-Codex — это специализированная версия GPT-5.1, оптимизированная для рабочих процессов разработки программного обеспечения и кодирования. Он предназначен как для интерактивных сеансов разработки, так и для длительного самостоятельного выполнения сложных инженерных задач....
Для GPT-5.1-Codex пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
низкая
Покрытие
0 тестов · 0 направлений
Происхождение
нет данных лидербордов
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 64% | н/д | Источник не указан |
| MATH (Математика) | 88.1% | н/д | Источник не указан |
| MMLU (Общие знания) | 87.6% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1431 | н/д | Источник не указан |
| HumanEval (Кодинг) | 91.1% | н/д | Источник не указан |
| SWE-bench (Разработка) | 55.7% | н/д | Источник не указан |
GPT-5.1 Codex — это высокоспециализированная языковая модель от OpenAI, созданная на базе флагманского интеллекта серии 5.1 и оптимизированная специально для программной инженерии и управления агентными ворклоу. Представленная в ноябре 2025 года, она предлагает разработчикам мощный инструмент, способный как к интерактивной поддержке в чате, так и к длительному автономному выполнению сложных инженерных заданий.
Версия 5.1 Codex является прямым ответом на запрос рынка в надежных инструментах для автоматизации полного цикла разработки ПО.
GPT-5.1 Codex занимает лидирующие позиции в инженерных рейтингах, показывая результаты на уровне лучших профессиональных стандартов индустрии.
| Бенчмарк | Результат | Описание |
|---|---|---|
| HumanEval | 91.1% | Топовый уровень генерации программного кода |
| Arena Elo | 1431 | Высокий профессиональный уровень |
| MMLU | 87.6% | Общие знания и эрудиция |
| MATH | 88.1% | Математические способности и логика |
| SWE_bench | 55.7% | Автономное решение инженерных задач |
| GPQA | 64.0% | Научные тесты университетского уровня |
Модель доступна через API по цене $1.25 за 1M входных токенов и $10.00 за 1M выходных токенов. Это премиальное решение для команд разработки и компаний, стремящихся максимально автоматизировать процессы написания и аудита кода с использованием передовых достижений OpenAI.
Плюсы:
Минусы:
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей OpenAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.