Великі мовні моделі (Large Language Models або LLM) – це тип моделей штучного інтелекту, які навчені розуміти, генерувати та аналізувати людську мову на основі великих обсягів текстових даних.
Великі мовні моделі являють собою нейронні мережі, навчені на величезних масивах текстових даних. Ці моделі вивчають структуру і нюанси людської мови, аналізуючи закономірності і взаємозв'язки між словами і фразами. Механізми уваги відіграють у цьому процесі життєво важливу роль, дозволяючи моделям вибірково фокусуватися на різних частинах вхідних даних.