 qazalandGitHub
|
f258708d7d
|
llama: custom quantize_mxfp4+transpose kernel (codex) (#17434)
* llama: custom quantize_mxfp4+transpose kernel (codex)
* rename to cpp
* inline
* cleanup
* lds load_bf16x4
* more tests, add Estimates
|
2026-08-06 16:13:28 +09:00 |
|