Skip to content

[PyTorch]Fused ScaledActivation Kernel in TE Ops and reducing CPU overheads for MOE - #3238

Merged
vthumbe1503 merged 23 commits into
NVIDIA:mainfrom
vthumbe1503:grouped_linear_act_fusion
Aug 6, 2026
Merged

[PyTorch]Fused ScaledActivation Kernel in TE Ops and reducing CPU overheads for MOE#3238
vthumbe1503 merged 23 commits into
NVIDIA:mainfrom
vthumbe1503:grouped_linear_act_fusion

Commits

Commits on Jul 20, 2026

Commits on Jul 22, 2026

Commits on Jul 23, 2026

Commits on Jul 24, 2026

Commits on Jul 28, 2026

Commits on Jul 29, 2026

Commits on Aug 3, 2026

Commits on Aug 5, 2026