
От OpenAI
Новейшее и мощное семейство моделей OpenAI, o1, предназначено для того, чтобы тратить больше времени на размышления, прежде чем ответить. Модель серии o1 обучена с помощью масштабного обучения с подкреплением, позволяющего рассуждать...
o1 сильнее всего выглядит в категории «код». Индекс 70/100 рассчитан по процентильным позициям в 2 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
2 сопоставимых теста · уверенность: средняя
3 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1401 | 238 из 384 | Источник не указан |
| MMLU (Общие знания) | 85.1% | 238 из 391 | Источник не указан |
| HumanEval (Кодинг) | 92% | 92 из 391 | Источник не указан |
| MATH (Математика) | 70.3% | 382 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 60.6% | 346 из 390 | Источник не указан |
| SWE-bench (Разработка) | 56.8% | 141 из 381 | Источник не указан |
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$15.00 / $60.00 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.