
AI-модели для программирования
Для программирования сравнивайте не один общий рейтинг, а профиль модели: HumanEval и MBPP показывают решение коротких задач, SWE-bench — работу с реальными репозиториями, TerminalBench — действия в терминале. Для продакшена дополнительно учитывайте цену, контекст и поддержку инструментов. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Значение показывается только там, где для модели есть результат конкретного теста · Методология и источники
Подборка моделей для генерации кода, работы с репозиториями, терминалом и автономной разработки.
Модели: Для программирования
Найдено: 173 моделейСтраница 2 из 8






SWE-1.7
от Cognition
SWE
Proprietary
CTX500K (xAI API); 256K (Cursor)
PARНе раскрыто
CodingReasoningAgentic

GigaChat 3.5 Ultra
от Sber
GigaChat
Open Source
CTX128K
PAR432B (28B активных)
FlagshipRussianMoE
HumanEval 80.49%SWE-bench 42.6%GPQA 30.81%MMLU 85.28%

Claude Sonnet 5
от Anthropic
Claude
Proprietary
CTX1M
PARНе раскрыто
TextAgenticCoding
HumanEval 94.8%SWE-bench 63.2%GPQA 76%MMLU 94.2%

GLM-5.2
от Z.ai
GLM
Open Weight
CTX1M
PARНе раскрыто
TextCodingAgentic
HumanEval 93.5%SWE-bench 62.1%GPQA 74%MMLU 93.8%

Kimi K 2.7 Code
от Moonshot AI
Other
Open Source
CTX128K
PARНе раскрыто
CodingGeneralText
HumanEval 94%SWE-bench 65%GPQA 72%MMLU 92.5%

Claude Fable 5
от Anthropic
Claude
Proprietary
CTX1M
PARНе раскрыто
TextAgenticReasoning
HumanEval 97.2%SWE-bench 80.3%GPQA 82%MMLU 96.1%



MiniMax M3
от MiniMax
MiniMax
Proprietary
CTX1M
PARНе раскрыто
TextGeneralPro
HumanEval 92.1%SWE-bench 63.5%GPQA 75%MMLU 93.5%

Granite 4.1 8B
от IBM
IBM Granite
Proprietary
CTX131K
PAR8B
StandardGeneralText
HumanEval 95.6%SWE-bench 61.1%GPQA 70.7%MMLU 89.8%

Grok 4.3
от xAI
Grok
Proprietary
CTX1M
PARНе раскрыто
StandardGeneralMultimodal
HumanEval 90.3%SWE-bench 54.1%GPQA 79.5%MMLU 94.5%

Laguna M.1 (free)
от Poolside
Other
Proprietary
CTX131K
PARНе раскрыто
StandardGeneralText
HumanEval 93.2%SWE-bench 66.1%GPQA 69.9%MMLU 87.1%

Owl Alpha
от OpenRouter
Other
Proprietary
CTX1M
PARНе раскрыто
StandardGeneralText
HumanEval 95.2%SWE-bench 60%GPQA 70.9%MMLU 88.5%

Anthropic Claude Haiku Latest
от Anthropic
Claude
Proprietary
CTX200K
PARНе раскрыто
FastGeneralMultimodal
HumanEval 90.1%SWE-bench 59.3%GPQA 57.5%MMLU 81.1%

Anthropic Claude Sonnet Latest
от Anthropic
Claude
Proprietary
CTX1M
PARНе раскрыто
StandardGeneralMultimodal
HumanEval 95.1%SWE-bench 64%GPQA 64.9%MMLU 85.4%

Google Gemini Flash Latest
от Google
Gemini
Proprietary
CTX1M
PARНе раскрыто
FastGeneralText
HumanEval 91.9%SWE-bench 66.2%GPQA 68.4%MMLU 83.9%

Google Gemini Pro Latest
от Google
Gemini
Proprietary
CTX1M
PARНе раскрыто
ProGeneralText
HumanEval 97.7%SWE-bench 59.6%GPQA 71.1%MMLU 91.3%

Qwen3.6 27B
от Qwen
Qwen
Open Source
CTX256K
PAR27B
StandardGeneralText
HumanEval 95.7%SWE-bench 67.9%GPQA 71.2%MMLU 87.1%

Qwen3.6 Max Preview
от Qwen
Qwen
Open Source
CTX262K
PARНе раскрыто
StandardGeneralText
HumanEval 93.4%SWE-bench 57.2%GPQA 69.9%MMLU 85.2%