Большая языковая модель

Большая языковая модель (БЯМ, англ. LLM) — это нейросеть с миллиардами параметров, обучаемая на гигантских массивах текста (петабайты, триллионы токенов) методом самообучения, а затем донастраиваемая с помощью обратной связи от людей (RLHF) для соответствия человеческим предпочтениям. Эти модели стали популярны после 2017 года, ознаменовав сдвиг от специализированных алгоритмов к универсальным генеративным системам, способным писать код, переводить, анализировать тональность и даже работать с изображениями и видео (мультимодальные MLLM). Ключевые примеры — семейство GPT, которые предсказывают синтаксические и семантические структуры, но при этом наследуют предвзятости из данных и остаются лишь вероятностными предсказателями, а не полноценным ИИ (AGI). История развития включает статистические модели IBM 1990-х, n-граммы 2001 года, а в 2012 году нейросети начали доминировать, что привело к переводу Google на нейронный машинный перевод в 2016 году. Сегодня БЯМ применяются в суммаризации, ответах на вопросы, генерации контента и распознавании объектов, оставаясь самым мощным, но узкоспециализированным инструментом в арсенале искусственного интеллекта.