ggml-cuda: widen Q4_K MMVQ weight loads to global_load_b128 - #88
Open
Annieren wants to merge 2 commits into
Open
ggml-cuda: widen Q4_K MMVQ weight loads to global_load_b128#88Annieren wants to merge 2 commits into
Annieren wants to merge 2 commits into