Мультимодальные Vision-модели
Для анализа изображений смотрите MMMU Pro, MathVision и документные тесты. Отдельно проверяйте точность OCR, пространственное понимание и способность модели ссылаться на конкретные элементы изображения. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Обновлено 22 июля 2026 · Методология и источники
Модели, принимающие изображения, схемы, графики, скриншоты и документы на вход.
Модели: Понимание изображений

Kimi K2.5

Alice AI LLM

GPT-5.2-Codex

GPT-5.1-Codex-Max

Ministral 3 3B 2512

Ministral 3 14B 2512

Ministral 3 8B 2512

Mistral Large 3 2512

GPT-5.1-Codex

GPT-5.1-Codex-Mini

Nova Premier 1.0

Sonar Pro Search

Qwen3 VL 32B Instruct

Claude Haiku 4.5

Qwen3 VL 8B Thinking

Qwen3 VL 8B Instruct

Qwen3 VL 30B A3B Thinking

Qwen3 VL 30B A3B Instruct

GPT-5 Codex

Qwen3 VL 235B A22B Instruct

Qwen3 VL 235B A22B Thinking

Mistral Medium 3.1

ERNIE 4.5 VL 28B A3B
