
От OpenAI
o3-deep-research — это усовершенствованная модель OpenAI для глубоких исследований, предназначенная для решения сложных многоэтапных исследовательских задач. Примечание. В этой модели всегда используется инструмент «web_search», который требует дополнительных затрат.
o3 Deep Research сильнее всего выглядит в категории «рассуждения». Индекс 63/100 рассчитан по процентильным позициям в 3 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
3 сопоставимых теста · уверенность: средняя
2 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1446 | 120 из 384 | Источник не указан |
| MMLU (Общие знания) | 88.8% | 111 из 391 | Источник не указан |
| HumanEval (Кодинг) | 85.3% | 223 из 391 | Источник не указан |
| MATH (Математика) | 89% | 126 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 66.1% | 198 из 390 | Источник не указан |
| SWE-bench (Разработка) | 59.9% | 102 из 381 | Источник не указан |
o3 Deep Research — это специализированная флагманская модель от OpenAI, представленная в октябре 2025 года. Она была создана для решения одной конкретной, но крайне сложной задачи: проведения глубоких, многочасовых исследований по любым темам с использованием всего доступного массива данных из сети.
В отличие от обычных чат-ботов, o3 Deep Research не просто ищет информацию — она её проверяет. Модель способна переходить по десяткам ссылок, сопоставлять данные из разных источников и выявлять противоречия, формируя максимально достоверный отчет.
При получении сложного запроса (например, «проанализируй влияние микропластика на популяцию пчел в Европе за последние 10 лет»), модель сначала строит детальный план исследования, а затем методично выполняет каждый его пункт, возвращаясь к уточнению данных при необходимости.
Итогом работы модели является не просто набор цитат, а глубоко проработанный документ с графиками, ссылками на первоисточники и логически обоснованными выводами.
| Бенчмарк | Результат o3 Deep Research | Категория |
|---|---|---|
| Arena Elo | 1446 | Лидер в области исследований |
| MMLU | 88.8% | Академический охват |
| MATH | 89.0% | Математическая строгость |
| GPQA | 66.1% | Научные вопросы уровня PhD |
| SWE_bench | 59.9% | Решение инженерных задач |
Это самый дорогой инструмент в линейке OpenAI: $10.00 за 1M входных токенов и $40.00 за 1M выходных токенов, что оправдано колоссальным объемом выполняемой работы.
Статья подготовлена для Gruzdevv.ru. Все данные актуальны на май 2026 года.
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$10.00 / $40.00 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.