← ← Volver al glosario
Término del Glosario

API de LLM

Servicio que da acceso programático a modelos de lenguaje: tu sistema envía un prompt vía HTTP y recibe la respuesta del modelo, pagando generalmente por token procesado.

Una API de LLM es la puerta de entrada para usar modelos de lenguaje dentro de tus propios sistemas. En lugar de conversar en un chat, tu código hace una petición HTTP con el prompt (y parámetros como modelo, temperatura y límite de tokens) y recibe el texto generado. Proveedores como OpenAI, Anthropic, Google y Mistral exponen sus modelos así, y el cobro suele ser por token de entrada y salida.

Es lo que permite construir productos con IA sin entrenar ningún modelo: chatbots de atención, resumen automático de documentos, clasificación de mensajes, generación de contenido. También existen agregadores/enrutadores (como OpenRouter y LiteLLM) que unifican varios proveedores tras una única interfaz, útil para comparar costo y calidad o tener redundancia.

Cuándo usarla: siempre que la IA deba ejecutarse dentro de un flujo automatizado y no en una ventana de chat. Ejemplo concreto: un SaaS de correo llama a una API de LLM por cada mensaje recibido, pidiendo un resumen de una línea y una respuesta sugerida: el usuario solo revisa y envía.

Herramientas relacionadas

Categorías

Ver también