LLM (Large Language Model)

LLM (Large Language Model) — большая языковая модель: нейросеть, которая обучается на больших массивах текста и учится предсказывать продолжение последовательности токенов. Благодаря этому модель может отвечать на вопросы, писать и редактировать тексты, переводить, извлекать информацию, классифицировать документы и помогать с программированием.

Как работает LLM

Текст сначала разбивается на токены — слова, части слов и знаки. Модель преобразует их в числовые представления и с помощью механизма внимания учитывает связи между элементами контекста. Во время ответа она последовательно выбирает вероятное продолжение. Модель не хранит готовую базу ответов и не рассуждает так же, как человек: результат зависит от обучающих данных, запроса, контекстного окна и настроек генерации.

Где применяются большие языковые модели

  • чат-боты и помощники службы поддержки;
  • поиск и суммаризация документов;
  • генерация и анализ программного кода;
  • подготовка маркетинговых и редакционных материалов;
  • извлечение структурированных данных из текста.

Ограничения

LLM может уверенно сформулировать фактически неверный ответ, воспроизвести ошибки обучающих данных или неправильно понять неполный запрос. Поэтому важные ответы проверяют по первичным источникам, а для работы с корпоративными знаниями используют поиск по документам, RAG, инструменты и контроль доступа.

Вопросы и ответы

LLM расшифровывается как Large Language Model — большая языковая модель.

Нет. Модель генерирует вероятное продолжение текста и может допускать фактические ошибки, поэтому важные ответы необходимо проверять.