LLM (Modelo de Linguagem de Grande Escala)
Modelo de IA treinado em enormes volumes de texto, capaz de entender e gerar linguagem natural. É a tecnologia por trás de assistentes como ChatGPT, Claude e Gemini.
Um LLM (Large Language Model, ou modelo de linguagem de grande escala) é um modelo de inteligência artificial treinado com quantidades enormes de texto para prever a próxima palavra de uma sequência. Desse mecanismo aparentemente simples emergem capacidades como responder perguntas, resumir documentos, traduzir, escrever código e manter conversas coerentes.
O LLM trabalha com tokens (pedaços de palavras) e responde a prompts (as instruções que o usuário envia). Ele não "consulta a internet" por padrão: responde com base no que aprendeu no treinamento, o que explica limitações como o corte de conhecimento e as alucinações (respostas plausíveis, porém incorretas). Técnicas como RAG e fine-tuning existem justamente para mitigar isso.
Na prática, LLMs são consumidos de duas formas: pelo chat (ChatGPT, Gemini, Claude) ou por APIs, que permitem embutir o modelo em produtos próprios. Exemplo concreto: um time de suporte usa um LLM para resumir automaticamente cada conversa encerrada e classificar o motivo do contato, alimentando relatórios sem trabalho manual.