Last released Aug 26, 2026
A KVCache-centric Disaggregated Architecture for large-scale LLM inference and training. (AMD ROCm version)