LLM: что такое большая языковая модель
LLM (large language model, большая языковая модель) — программа, обученная предсказывать, какое слово идёт следующим. Всё, что она умеет, вырастает из этой одной способности, и всё, чего она не умеет, объясняется ею же.
- Расшифровка
- large language model
- По-русски
- большая языковая модель
- Что делает
- предсказывает продолжение текста
- Чем не является
- базой знаний с точными фактами
листайте схему вбок
Что означает каждое слово в названии
Термин описывает устройство буквально, и разбор по словам объясняет почти всё поведение таких моделей.
Языковая
Модель работает с текстом и обучена на текстах. У неё нет отдельного хранилища фактов: знания растворены в статистике языка. Отсюда способность рассуждать связно и склонность уверенно выдумывать детали.
Большая
Речь о количестве настраиваемых параметров — от миллиардов до сотен миллиардов. Размер влияет на способность улавливать сложные зависимости, но не гарантирует точности: крупная модель ошибается реже, а не никогда.
Модель
Не программа с правилами, а обученная статистическая система. Никто не прописывал ей, что столица Франции — Париж: это следствие того, что в текстах эти слова стоят рядом.
Почему предсказание текста даёт так много
Главный контринтуитивный момент: чтобы хорошо предсказывать продолжение, приходится улавливать смысл, а не только частоту слов.
Продолжить фразу «итог сложения 47 и 58 равен» правдоподобно нельзя, не научившись складывать. Способности к рассуждению, переводу и написанию кода появились как побочный результат этой задачи, а не были заложены отдельно.
Чем LLM не является
Три смешения приводят к неверным ожиданиям чаще остальных.
Не поисковая система
Поиск возвращает документы, которые существуют. Модель формулирует ответ, который выглядит правильным. Чтобы получить проверяемость, к ней подключают поиск по документам.
Не искусственный интеллект вообще
LLM — один класс систем. Распознавание изображений, синтез речи и рекомендательные алгоритмы устроены иначе, хотя все попадают под общее слово «ИИ».
Не обучается в разговоре
Модель не меняется от того, что вы ей написали. Ощущение памяти создаёт контекстное окно, а изменение самой модели называется файнтюном.
Частые вопросы
Как расшифровывается LLM
Чем LLM отличается от нейросети
Понимает ли LLM то, что пишет
Почему LLM ошибается в простой арифметике
Можно ли запустить LLM на своём компьютере
Связанные страницы
Последняя проверка фактов: 13.08.2026. Нашли неточность — напишите редакции.