Текущая2025-04-16

От OpenAI
o3 — это всесторонняя и мощная модель для разных областей. Он устанавливает новый стандарт для задач по математике, естественным наукам, программированию и визуальному мышлению. Он также преуспевает в написании технических заданий и выполнении инструкций....
o3 сильнее всего выглядит в категории «общее качество». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
средняя
Покрытие
1 тест · 1 направление
Происхождение
artificialAnalysis
1 тест · уверенность: средняя
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 71.5% | н/д | Источник не указан |
| MATH (Математика) | 89.9% | н/д | Источник не указан |
| MMLU (Общие знания) | 89.8% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1458 | н/д | Источник не указан |
| HumanEval (Кодинг) | 88.9% | н/д | Источник не указан |
| SWE-bench (Разработка) | 56.7% | н/д | Источник не указан |
OpenAI o3, представленная в апреле 2025 года, стала полноценным преемником революционной модели o1. Это «умная» модель, разработанная специально для задач, где требуется не просто генерация текста, а глубокое, пошаговое планирование и сложнейшая логика.
В отличие от стандартных LLM, o3 использует значительно больше вычислительных мощностей во время вывода (inference-time compute). Перед тем как дать окончательный ответ, модель «думает», выстраивая внутреннюю цепочку рассуждений, проверяя гипотезы и исправляя свои ошибки.
o3 была создана для преодоления «плато» в математике и программировании. Она показывает результаты, сопоставимые с олимпиадным уровнем, решая задачи, которые ставят в тупик даже самые продвинутые модели общего назначения.
Модель o3 стала фундаментом для нового поколения автономных разработчиков. Её способность понимать архитектурные концепции и следовать многоэтапным инструкциям делает её незаменимой для создания сложных программных продуктов.
| Бенчмарк | Результат OpenAI o3 | Описание |
|---|---|---|
| Arena Elo | 1494 | Один из самых высоких рейтингов в мире |
| MMLU | 91.5% | Глубокие экспертные знания |
| HumanEval | 97.1% | Практически безошибочный кодинг |
| MATH | 98.2% | Уровень золотой медали олимпиад |
| GPQA | 78.5% | Научный анализ уровня эксперта |
За исключительный интеллект приходится платить: $2.00 за 1M входных токенов и $8.00 за 1M выходных токенов. Однако для задач высокой сложности o3 экономит огромные средства за счет отсутствия ошибок и необходимости переделок.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей OpenAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.