feat(glm): add GLM-5.3 cuDNN training support (#3747)
* feat(glm): add GLM-5.3 cuDNN training recipe Signed-off-by: HuiyingLi <willwin.lee@gmail.com> * fix(glm): dequantize GLM-5.3 blockwise FP8 weights Signed-off-by: HuiyingLi <willwin.lee@gmail.com> * fix(glm): preserve FP8 block offsets for DTensors Signed-off-by: HuiyingLi <willwin.lee@gmail.com> * fix(glm): reshard experts after forward Signed-off-by: HuiyingLi <willwin.lee@gmail.com> --------- Signed-off-by: HuiyingLi <willwin.lee@gmail.com>
H
Huiying committed
d5a4b3f4448cb1f9dbe2ef5a1347e042c0defb40
Parent: f0f6b10
Committed by GitHub <noreply@github.com>
on 8/29/2026, 6:49:54 PM