← Volver al glosario

API de LLM

Servicio que da acceso programático a modelos de lenguaje: tu sistema envía un prompt vía HTTP y recibe la respuesta del modelo, pagando generalmente por token procesado.

Una API de LLM es la puerta de entrada para usar modelos de lenguaje dentro de tus propios sistemas. En lugar de conversar en un chat, tu código hace una petición HTTP con el prompt (y parámetros como modelo, temperatura y límite de tokens) y recibe el texto generado. Proveedores como OpenAI, Anthropic, Google y Mistral exponen sus modelos así, y el cobro suele ser por token de entrada y salida.

Es lo que permite construir productos con IA sin entrenar ningún modelo: chatbots de atención, resumen automático de documentos, clasificación de mensajes, generación de contenido. También existen agregadores/enrutadores (como OpenRouter y LiteLLM) que unifican varios proveedores tras una única interfaz, útil para comparar costo y calidad o tener redundancia.

Cuándo usarla: siempre que la IA deba ejecutarse dentro de un flujo automatizado y no en una ventana de chat. Ejemplo concreto: un SaaS de correo llama a una API de LLM por cada mensaje recibido, pidiendo un resumen de una línea y una respuesta sugerida: el usuario solo revisa y envía.

Logotipo de OpenAI API

API y Tokens de IA

OpenAI API

API de GPT-4o, o1 y DALL-E 3 con function calling, output estructurado y descuentos por batch.

Desde 0,15 US$/por token
VERIFICADO
GPT-4o & o1Function calling
Logotipo de liteLLM

Programación con IA

liteLLM

Gateway de IA open source que pone toda tu stack detrás de una clave compatible con OpenAI: control de gasto, enrutamiento de modelos y self-hosting, con 140+ proveedores.

No disponible
Logotipo de Groq

API y Tokens de IA

Groq

Inferencia de LLM ultrarrápida (Llama 3.3, DeepSeek-R1) alcanzando 500+ tokens/segundo mediante chips LPU.

Gratis
Plan Gratuito
/por token
VERIFICADO
Qwen 3.6 27BLlama 3.3 70B y Whisper Large V3

Categorías

Ver también