llama.cpp

mirror of https://github.com/ggerganov/llama.cpp.git

History

Shawn Gu 3edd87cd05 opencl: optimize mxfp4 kernels (#16037 ) - flatten mxfp4 and packed fp4->fp16 bit-wise convert function (replace lut) - MoE kernel optimizations --------- Co-authored-by: Li He <lih@qti.qualcomm.com>		2025-09-18 12:03:34 -07:00
..
kernels	opencl: optimize mxfp4 kernels (#16037 )	2025-09-18 12:03:34 -07:00
CMakeLists.txt	opencl: optimize mxfp4 kernels (#16037 )	2025-09-18 12:03:34 -07:00
ggml-opencl.cpp	opencl: optimize mxfp4 kernels (#16037 )	2025-09-18 12:03:34 -07:00