O que é um LLM (modelo de linguagem), explicado com exemplos
LLM significa Large Language Model, ou modelo de linguagem de grande escala. É o tipo de sistema por trás de praticamente todo chatbot de IA que você já usou. Na prática, é um programa treinado para prever qual é a próxima palavra mais provável em um texto, dado tudo que veio antes.
Um exemplo simples
Se você escreve "o céu está", um LLM calcula que "azul" é uma continuação estatisticamente provável, com base em bilhões de frases parecidas que ele processou durante o treinamento. Ele repete esse cálculo palavra por palavra até formar uma resposta inteira.
Context window: a "memória" da conversa
Um LLM não tem memória permanente entre conversas. O que ele "lembra" é limitado ao que está escrito na conversa atual, algo chamado de janela de contexto. Quando essa janela enche, informações do início da conversa podem começar a ser esquecidas.
Por que isso importa para você
Saber que o modelo prevê palavras, e não busca fatos em um banco de dados, explica por que ele pode soar confiante e ainda assim errar. Veja mais sobre isso no artigo sobre por que a IA alucina.
Gostou? Vai mais fundo.
Continue aprendendo com o curso gratuito da SAPYENS.