
Мультимодальные Vision-модели
Для анализа изображений смотрите MMMU Pro, MathVision и документные тесты. Отдельно проверяйте точность OCR, пространственное понимание и способность модели ссылаться на конкретные элементы изображения. Телеграм-бот fLLMs мониторит бесплатные API-ключи в роутерах.
Значение показывается только там, где для модели есть результат конкретного теста · Методология и источники
Модели, принимающие изображения, схемы, графики, скриншоты и документы на вход.
Модели: Понимание изображений




Muse Spark 1.3






Qwen3.8-Flash

Qwen3.8-Flash-Next

DeepSeek V4 Flash Vision Exp




Meta Muse Glimmer 30B

Muse Spark 1.2






