К списку моделей
Логотип OpenAI, разработчика o3

o3

G-Score: н/д

От OpenAI

Proprietary
FAMOther
CTX200K
PARНе раскрыто
Релиз: 2025-04-16
StandardReasoningTextFrontier Reasoning

Краткое описание

o3 — это всесторонняя и мощная модель для разных областей. Он устанавливает новый стандарт для задач по математике, естественным наукам, программированию и визуальному мышлению. Он также преуспевает в написании технических заданий и выполнении инструкций....

G-Score и профиль

G-Score: н/д

o3 сильнее всего выглядит в категории «общее качество». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.

Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.

Уверенность данных

средняя

Покрытие

1 тест · 1 направление

Происхождение

artificialAnalysis

G‑Общее качество58/100

1 тест · уверенность: средняя

Как рассчитан профиль →

Место модели в каталоге

Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.

БенчмаркРезультатМестоДоказательство
GPQA (Экспертные знания)71.5%н/дИсточник не указан
MATH (Математика)89.9%н/дИсточник не указан
MMLU (Общие знания)89.8%н/дИсточник не указан
Arena Elo (LMSYS)1458н/дИсточник не указан
HumanEval (Кодинг)88.9%н/дИсточник не указан
SWE-bench (Разработка)56.7%н/дИсточник не указан

Подробный обзор модели

Обзор OpenAI o3: Эталон систем рассуждения (2026)

OpenAI o3, представленная в апреле 2025 года, стала полноценным преемником революционной модели o1. Это «умная» модель, разработанная специально для задач, где требуется не просто генерация текста, а глубокое, пошаговое планирование и сложнейшая логика.

В чем уникальность o3?

1. Систематическое рассуждение (System 2 Thinking)

В отличие от стандартных LLM, o3 использует значительно больше вычислительных мощностей во время вывода (inference-time compute). Перед тем как дать окончательный ответ, модель «думает», выстраивая внутреннюю цепочку рассуждений, проверяя гипотезы и исправляя свои ошибки.

2. Прорыв в STEM-дисциплинах

o3 была создана для преодоления «плато» в математике и программировании. Она показывает результаты, сопоставимые с олимпиадным уровнем, решая задачи, которые ставят в тупик даже самые продвинутые модели общего назначения.

3. Оптимизация для ИИ-инженеров

Модель o3 стала фундаментом для нового поколения автономных разработчиков. Её способность понимать архитектурные концепции и следовать многоэтапным инструкциям делает её незаменимой для создания сложных программных продуктов.

Бенчмарки (Состояние на май 2026)

БенчмаркРезультат OpenAI o3Описание
Arena Elo1494Один из самых высоких рейтингов в мире
MMLU91.5%Глубокие экспертные знания
HumanEval97.1%Практически безошибочный кодинг
MATH98.2%Уровень золотой медали олимпиад
GPQA78.5%Научный анализ уровня эксперта

Сценарии использования

  • Сложная разработка ПО: Решение архитектурных задач и написание сложных алгоритмов.
  • Научные исследования: Моделирование химических реакций, анализ генетических данных и решение физических уравнений.
  • Стратегическое планирование: Создание бизнес-стратегий с учетом сотен переменных и логических зависимостей.

Ценообразование

За исключительный интеллект приходится платить: $2.00 за 1M входных токенов и $8.00 за 1M выходных токенов. Однако для задач высокой сложности o3 экономит огромные средства за счет отсутствия ошибок и необходимости переделок.


Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

$2.00 / $8.00 за 1M токенов

Рассчитать сценарий →

Профиль модели

MMLU89.8%Code88.9%Math89.9%GPQA71.5%SWE56.7%

Бенчмарки

GPQA (Экспертные знания)71.5%
MATH (Математика)89.9%
MMLU (Общие знания)89.8%
Arena Elo (LMSYS)1458
HumanEval (Кодинг)88.9%
SWE-bench (Разработка)56.7%

История семейства

Линейка Other

Последовательность собрана по датам релиза моделей OpenAI в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема o3

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

Сервисы с поддержкой модели

Откройте результаты по названию модели и проверьте актуальную интеграцию.

Искать в /services/ →

Обсуждения о o3

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение