Loading...
Loading...
DI Series: Scaling GLM-5.1-FP8 to 64 MI300X GPUs — ROCm Blogs.
Scale GLM-5.1-FP8 long-context serving beyond a single node on AMD Instinct MI300X with WideEP prefill-decode disaggregation and MoRI.
Source:https://rocm.blogs.amd.com/software-tools-optimization/di-glm-wideep/README.html
Impact Score