Last released Aug 2, 2026
An intelligent LLM caching library that combines semantic similarity, configurable judgment, and persistent vector storage to safely reuse responses across equivalent queries.
Supported by