Last released Aug 18, 2026
A local inference server that keeps several models resident side by side under a fixed memory quota.