
Gemma 3n 2B (free)
от Google
Other
Proprietary
CTX8K
PAR2B
StandardGeneralText
HumanEval 92.2%SWE-bench 55.4%GPQA 67.2%MMLU 86.5%
Для программирования сравнивайте не один общий рейтинг, а профиль модели: HumanEval и MBPP показывают решение коротких задач, SWE-bench — работу с реальными репозиториями, TerminalBench — действия в терминале. Для продакшена дополнительно учитывайте цену, контекст и поддержку инструментов. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Значение показывается только там, где для модели есть результат конкретного теста · Методология и источники
Подборка моделей для генерации кода, работы с репозиториями, терминалом и автономной разработки.





















