API de inferência de modelos de linguagem com velocidade líder de mercado. Chips LPU customizados entregam geração de tokens até 10x mais rápida que GPUs, com free tier generoso para testes e integração instantânea via API REST compatível com OpenAI.