
От OpenAI
OpenAI o4-mini-deep-research — агентская модель для глубокой аналитики. При окне вывода 100K и точности AIME 92.7% она способна автономно проводить исследования и генерировать отчеты экспертного уровня.
o4 Mini Deep Research сильнее всего выглядит в категории «код». Индекс 42/100 рассчитан по процентильным позициям в 2 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
2 сопоставимых теста · уверенность: средняя
3 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1346 | 370 из 384 | Источник не указан |
| MMLU (Общие знания) | 80.5% | 374 из 391 | Источник не указан |
| HumanEval (Кодинг) | 84.5% | 244 из 391 | Источник не указан |
| MATH (Математика) | 85.2% | 188 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 59.2% | 370 из 390 | Источник не указан |
| SWE-bench (Разработка) | 53.2% | 206 из 381 | Источник не указан |
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$2.00 / $8.00 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.