Language model inference API with market-leading speed. Custom LPU chips deliver token generation up to 10x faster than GPUs, with a generous free tier for testing and instant integration via an OpenAI-compatible REST API.