Pay-as-you-go
Gratis
- • Qwen 3.6 27B
- • Llama 3.3 70B y Whisper Large V3
- • API compatible con OpenAI
Inferencia de LLM ultrarrápida (Llama 3.3, DeepSeek-R1) alcanzando 500+ tokens/segundo mediante chips LPU.
Esta herramienta no tiene cupones activos por ahora.
API de inferencia de modelos de lenguaje con velocidad líder del mercado. Los chips LPU personalizados entregan generación de tokens hasta 10x más rápida que las GPUs, con un generoso free tier para pruebas e integración instantánea vía API REST compatible con OpenAI.