IA generativa
Categoría de inteligencia artificial que crea contenido nuevo (texto, imagen, audio, video y código) a partir de instrucciones en lenguaje natural, aprendiendo patrones de grandes volúmenes de datos.
IA generativa es el paraguas que cubre los sistemas de IA capaces de *crear* contenido, en lugar de solo clasificar o predecir. Estos modelos se entrenan con volúmenes enormes de ejemplos (textos, imágenes, audios) y aprenden los patrones estadísticos que les permiten generar algo nuevo y coherente a partir de una instrucción: el *prompt*.
Los frentes principales:
- Texto: LLMs como los que hay detrás de ChatGPT, Claude y Gemini escriben, resumen, traducen y programan.
- Imagen: modelos de difusión como Midjourney y Stable Diffusion crean ilustraciones y fotos a partir de descripciones.
- Audio: síntesis de voz (text-to-speech), clonación de voz y generación de música.
- Video: generación y edición de escenas a partir de texto o imágenes, un área en evolución acelerada.
- Código: asistentes que completan y generan programas.
El punto en común: la interfaz es el lenguaje natural. Describir lo que quieres sustituye a dominar la herramienta, lo que explica la adopción explosiva desde 2022, cuando ChatGPT llevó la tecnología al gran público. Las limitaciones también son compartidas: los modelos pueden "alucinar" (generar contenido falso con seguridad), reproducen sesgos de sus datos de entrenamiento y plantean dudas de derechos de autor sobre el material generado.
Ejemplo concreto: una pequeña marca lanza un producto y usa IA generativa en toda la campaña: el texto del anuncio sale de un LLM, las imágenes de Midjourney y la narración del video de una herramienta de text-to-speech.