Last released Aug 31, 2026
Reliability-aware LLM router: run requests on your local model and automatically fall back to a remote model when local inference stalls or crashes.