← ← Voltar ao glossário
Termo do Glossário

API de LLM

Serviço que dá acesso programático a modelos de linguagem: seu sistema envia um prompt via HTTP e recebe a resposta do modelo, pagando geralmente por token processado.

Uma API de LLM é a porta de entrada para usar modelos de linguagem dentro dos seus próprios sistemas. Em vez de conversar num chat, seu código faz uma requisição HTTP com o prompt (e parâmetros como modelo, temperatura e limite de tokens) e recebe de volta o texto gerado. Provedores como OpenAI, Anthropic, Google e Mistral expõem seus modelos assim, e a cobrança costuma ser por token de entrada e saída.

É o que permite construir produtos com IA sem treinar modelo nenhum: chatbots de atendimento, resumo automático de documentos, classificação de mensagens, geração de conteúdo. Também existem agregadores/roteadores (como OpenRouter e LiteLLM), que unificam vários provedores atrás de uma única interface, útil para comparar custo e qualidade ou ter redundância.

Quando usar: sempre que a IA precisa rodar dentro de um fluxo automatizado, e não numa janela de chat. Exemplo concreto: um SaaS de e-mail chama uma API de LLM para cada mensagem recebida, pedindo um resumo de uma linha e uma sugestão de resposta: o usuário só revisa e envia.

Ferramentas relacionadas

Categorias

Veja também