Skip to content

[PyTorch][MoE] MXFP8 Support to Reduce CPU Overhead By Fuse Torch Empty Calls - #1934

Merged
timmoon10 merged 4 commits into
NVIDIA:mainfrom
zhongbozhu:zhongbo/mxfp8_fuse_quantizer_torch_empty
Jul 9, 2025
Merged

[PyTorch][MoE] MXFP8 Support to Reduce CPU Overhead By Fuse Torch Empty Calls#1934
timmoon10 merged 4 commits into
NVIDIA:mainfrom
zhongbozhu:zhongbo/mxfp8_fuse_quantizer_torch_empty

lint

2cf00d3
Select commit
Loading
Failed to load commit list.