Текущая2025-08-26

От Nous
Гермес 4 — это крупномасштабная модель рассуждения, созданная на основе Мета-Лламы-3.1-405B и выпущенная Nous Research. Он вводит гибридный режим рассуждения, в котором модель может самостоятельно размышлять с помощью...
Hermes 4 405B сильнее всего выглядит в категории «общее качество». Профиль рассчитан по процентилям LiveBench, Artificial Analysis и LMArena; пропуски не считаются нулём.
Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.
Уверенность данных
средняя
Покрытие
1 тест · 1 направление
Происхождение
artificialAnalysis
1 тест · уверенность: средняя
Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| GPQA (Экспертные знания) | 62.6% | н/д | Источник не указан |
| MATH (Математика) | 80% | н/д | Источник не указан |
| MMLU (Общие знания) | 85.1% | н/д | Источник не указан |
| Arena Elo (LMSYS) | 1401 | н/д | Источник не указан |
| HumanEval (Кодинг) | 77.5% | н/д | Источник не указан |
| SWE-bench (Разработка) | 41.8% | н/д | Источник не указан |
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
История семейства
Последовательность собрана по датам релиза моделей Nous в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.
Текущая2025-08-26

2025-08-26
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.