Skip to content

CUDA: Optimize accumulation in mmq for NVFP4 type - #29857

Merged
ORippler merged 3 commits into
ggml-org:masterfrom
kmorennv:optimize_mmq_nvfp4
Oct 5, 2026
Merged

ORippler merged 3 commits into
ggml-org:masterfrom
kmorennv:optimize_mmq_nvfp4

Commits

Commits on Oct 2, 2026

Commits on Oct 5, 2026