Мультимодальные Vision-модели
Для анализа изображений смотрите MMMU Pro, MathVision и документные тесты. Отдельно проверяйте точность OCR, пространственное понимание и способность модели ссылаться на конкретные элементы изображения. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Обновлено 22 июля 2026 · Методология и источники
Модели, принимающие изображения, схемы, графики, скриншоты и документы на вход.
Модели: Понимание изображений

Nova Pro 1.0

Nova Lite 1.0

Pixtral Large 2411

Claude 3.5 Haiku

Llama 3.2 11B Vision Instruct

GPT-4 Turbo
