К списку моделей
Логотип Z.ai, разработчика GLM 4.7 Flash

GLM 4.7 Flash

G-Score: н/д

От Z.ai

Proprietary
FAMOther
CTX203K
PARНе раскрыто
Релиз: 2026-01-19
FastGeneralText

Краткое описание

Модель GLM-4.7-Flash, являющаяся моделью SOTA класса 30B, предлагает новую опцию, которая сочетает в себе производительность и эффективность. Он дополнительно оптимизирован для сценариев использования агентного кодирования, расширения возможностей кодирования, долгосрочного планирования задач...

G-Score и профиль

G-Score: н/д

Для GLM 4.7 Flash пока нет совпавших результатов в подключённых публичных лидербордах. Исходные значения карточки не используются для G‑Score.

Показатели G‑Код, G‑Рассуждения, G‑Агенты и G‑Зрение рассчитаны по массовым таблицам LiveBench, Artificial Analysis и LMArena. Наведите или нажмите на значок рядом с оценкой, чтобы увидеть исходный лидерборд, вариант модели, значение и размер выборки.

Уверенность данных

низкая

Покрытие

0 тестов · 0 направлений

Происхождение

нет данных лидербордов

Как рассчитан профиль →

Место модели в каталоге

Место исходного бенчмарка показывается только при закреплённом source record и среди других карточек с источником. Эти старые значения не участвуют в G-Score лидербордов.

БенчмаркРезультатМестоДоказательство
GPQA (Экспертные знания)66.8%н/дИсточник не указан
MATH (Математика)83.4%н/дИсточник не указан
MMLU (Общие знания)85.7%н/дИсточник не указан
Arena Elo (LMSYS)1408н/дИсточник не указан
HumanEval (Кодинг)83.3%н/дИсточник не указан
SWE-bench (Разработка)48.7%н/дИсточник не указан

Подробный обзор модели

GLM 4.7 Flash — это высокоскоростная и экономичная языковая модель от компании Z.ai, представленная в январе 2026 года. С 30 миллиардами параметров, эта модель устанавливает новый стандарт для своего весового класса (SOTA в категории 30B), предлагая идеальный баланс между рекордной скоростью генерации и глубиной рассуждений. GLM 4.7 Flash специально оптимизирована для задач «агентного кодинга» и сложного планирования в реальном времени.

Особенности и программный интеллект

Модель была разработана как эффективное решение для высоконагруженных систем, требующих флагманского интеллекта при минимальных задержках.

  • Мастерство кодинга и планирования: В отличие от обычных Flash-моделей, версия 4.7 была усилена в области программной инженерии. Она демонстрирует высокую стабильность при решении многоэтапных задач, умеет точно планировать ворклоу и исправлять сложные логические баги в коде.
  • Ультра-быстрый инференс: Благодаря облегченной, но плотной архитектуре, модель обеспечивает практически мгновенный отклик, что критично для интерактивных систем автозаполнения и виртуальных ассистентов.
  • Широкий контекст 203K: Поддержка контекстного окна до 203 000+ токенов позволяет GLM 4.7 Flash эффективно работать с объемными базами данных и технической документацией без потери связности рассуждений.

Производительность и бенчмарки

GLM 4.7 Flash является лидером в сегменте 30B моделей, показывая результаты на уровне гораздо более тяжелых систем в задачах на логику и программирование.

БенчмаркРезультатОписание
MATH83.4%Высокие математические способности для Flash-модели
Arena Elo1408Топ-уровень скоростных моделей 2026 года
MMLU85.7%Глубокие общие знания и эрудиция
HumanEval83.3%Хорошее качество генерации программного кода
GPQA66.8%Научные тесты PhD-уровня
SWE_bench48.7%Решение прикладных инженерных задач

Ценообразование и доступность

Модель доступна через API по крайне агрессивной цене: всего $0.06 за 1M входных токенов и $0.40 за 1M выходных токенов. Это делает GLM 4.7 Flash одним из самых выгодных решений на рынке для систем, требующих сочетания высокой точности и минимальной стоимости инференса.

Идеальные сценарии применения (Use Cases)

  • Масштабируемые кодинг-агенты: Создание систем, способных быстро и точно обрабатывать тикеты и генерировать тесты.
  • Интеллектуальный поиск и суммаризация: Быстрая обработка огромных массивов текстовой информации с извлечением ключевых смыслов.
  • Корпоративные чат-боты: Реализация отзывчивых помощников для сотрудников с глубоким знанием внутренних процессов компании.

Плюсы и минусы

Плюсы:

  • Лучшая в своем классе (30B) производительность.
  • Ультра-низкая задержка и выгодная стоимость API.
  • Широкое контекстное окно (203K).
  • Специализация на инженерных и агентных задачах.

Минусы:

  • В сверхсложных философских рассуждениях может уступать старшей версии 4.7.
  • Проприетарная модель (доступ только через API).

Где запустить модель

Цены приведены за 1 млн токенов и могут меняться. Доступность российских провайдеров проверяется на их стороне.

Обновляем провайдеров и цены…

Стоимость API

$0.06 / $0.40 за 1M токенов

Рассчитать сценарий →

Профиль модели

MMLU85.7%Code83.3%Math83.4%GPQA66.8%SWE48.7%

Бенчмарки

GPQA (Экспертные знания)66.8%
MATH (Математика)83.4%
MMLU (Общие знания)85.7%
Arena Elo (LMSYS)1408
HumanEval (Кодинг)83.3%
SWE-bench (Разработка)48.7%

История семейства

Линейка Other

Последовательность собрана по датам релиза моделей Z.ai в каталоге. Она показывает соседние поколения, но не приписывает им совместимость или наследование архитектуры без отдельного источника.

Экосистема GLM 4.7 Flash

Сервисы, инструменты, материалы и обсуждения, связанные с моделью.

Сервисы с поддержкой модели

Откройте результаты по названию модели и проверьте актуальную интеграцию.

Искать в /services/ →

MCP и инструменты

Весь каталог

Точных связей пока нет. Искать по разработчику.

Обсуждения о GLM 4.7 Flash

Задайте вопрос сообществу — карточка модели будет прикреплена автоматически.

Создать обсуждение