Last released Jul 24, 2026
A KVCache-centric Disaggregated Architecture for large-scale LLM inference and training. (Ascend NPU version)
Supported by