Last released Jul 11, 2026
A layered local-LLM inference engine: from thin wrapper to your own serving service, under one abstraction.
Supported by