Os grandes modelos linguísticos (Large Language Models ou LLM) são um tipo de modelo de inteligência artificial treinado para compreender, gerar e analisar a linguagem humana com base em grandes volumes de dados textuais.
Os grandes modelos linguísticos são redes neurais treinadas com enormes conjuntos de dados textuais. Esses modelos estudam a estrutura e as nuances da linguagem humana, analisando padrões e inter-relações entre palavras e frases. Os mecanismos de atenção desempenham um papel vital nesse processo, permitindo que os modelos se concentrem seletivamente em diferentes partes dos dados de entrada.