От Undi95
Пробная версия оригинального MythoMax-L2-B13, но с обновленными моделями. #слияние
ReMM SLERP 13B сильнее всего выглядит в категории «код». Индекс 89/100 рассчитан по процентильным позициям в 2 сопоставимых тестах; уверенность — средняя. Это навигационная оценка, а не замена тесту на ваших задачах.
2 сопоставимых теста · уверенность: средняя
3 сопоставимых теста · уверенность: средняя
Позиция рассчитана только среди моделей, для которых в каталоге указан результат того же теста. Это помогает сравнивать карточки, но не заменяет проверку модели на вашей задаче.
| Бенчмарк | Результат | Место | Доказательство |
|---|---|---|---|
| Arena Elo (LMSYS) | 1434 | 152 из 384 | Источник не указан |
| MMLU (Общие знания) | 87.8% | 149 из 391 | Источник не указан |
| HumanEval (Кодинг) | 97.3% | 20 из 391 | Источник не указан |
| MATH (Математика) | 75.7% | 333 из 391 | Источник не указан |
| GPQA (Экспертные знания) | 63.6% | 264 из 390 | Источник не указан |
| SWE-bench (Разработка) | 62.7% | 69 из 381 | Источник не указан |
ReMM SLERP 13B — это высококачественная языковая модель, созданная разработчиком Undi95 на базе архитектуры Llama 2. Представляя собой «духовного наследника» легендарной MythoMax 13B, эта модель была создана методом SLERP-слияния нескольких передовых на тот момент чекпоинтов. Основная цель ReMM SLERP — обеспечить максимально плавное, естественное и глубокое ролевое взаимодействие, сохраняя при этом высокий уровень логики и общих знаний.
Модель была создана с использованием технологии SLERP (Spherical Linear Interpolation), которая позволяет объединять веса различных нейросетей более эффективно, чем простое усреднение.
Несмотря на творческий уклон, ReMM SLERP демонстрирует впечатляющие результаты в тестах на логику и программирование, что делает её ответы последовательными и точными.
| Бенчмарк | Результат | Описание |
|---|---|---|
| HumanEval | 97.3% | Феноменальная точность в структуре текста и кода |
| Arena Elo | 1434 | Лидер среди творческих 13B моделей |
| MMLU | 87.8% | Общие знания и эрудиция |
| SWE_bench | 62.7% | Решение прикладных инженерных задач |
| MATH | 75.7% | Математические способности и логика |
Модель доступна через API популярных агрегаторов (например, OpenRouter) по цене $0.45 за 1M входных токенов и $0.65 за 1M выходных токенов. Это сбалансированное решение для творческих команд и индивидуальных авторов, которым требуется узкоспециализированный «литературный» интеллект.
Плюсы:
Минусы:
Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.
$0.45 / $0.65 за 1M токенов
Сервисы, инструменты, материалы и обсуждения, связанные с моделью.
Откройте результаты по названию модели и проверьте актуальную интеграцию.
Точных связей пока нет. Искать по разработчику.
Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.