Мультимодальные Vision-модели
Для анализа изображений смотрите MMMU Pro, MathVision и документные тесты. Отдельно проверяйте точность OCR, пространственное понимание и способность модели ссылаться на конкретные элементы изображения. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Обновлено 22 июля 2026 · Методология и источники
Модели, принимающие изображения, схемы, графики, скриншоты и документы на вход.
Модели: Понимание изображений

Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

Kimi K3

GPT-5.6 Sol

GPT-5.6 Terra

GPT-5.6 Luna

Baidu Unlimited-OCR

Qwen3.7-Plus

Claude Opus 4.8

Gemini 3.5 Flash

Grok 4.3

Anthropic Claude Sonnet Latest

MoonshotAI Kimi Latest

Anthropic Claude Haiku Latest

Claude Opus Latest

Qianfan-OCR-Fast (free)

Kimi K2.6

Claude Opus 4.7

Claude Opus 4.6 (Fast)

MiniMax Hailuo 2.3 / 2.3 Fast

Mistral Small 4

Claude Sonnet 4.6

Claude Opus 4.6
