SIGN IN SIGN UP

feat(glm): add GLM-5.3 cuDNN training support (#3747)

* feat(glm): add GLM-5.3 cuDNN training recipe

Signed-off-by: HuiyingLi <willwin.lee@gmail.com>

* fix(glm): dequantize GLM-5.3 blockwise FP8 weights

Signed-off-by: HuiyingLi <willwin.lee@gmail.com>

* fix(glm): preserve FP8 block offsets for DTensors

Signed-off-by: HuiyingLi <willwin.lee@gmail.com>

* fix(glm): reshard experts after forward

Signed-off-by: HuiyingLi <willwin.lee@gmail.com>

---------

Signed-off-by: HuiyingLi <willwin.lee@gmail.com>
H
Huiying committed
d5a4b3f4448cb1f9dbe2ef5a1347e042c0defb40
Parent: f0f6b10
Committed by GitHub <noreply@github.com> on 8/29/2026, 6:49:54 PM