llama : use Q4_K for attn_v for Q2_K_S when n_gqa >= 4 (#4996)
Co-authored-by: Iwan Kawrakow <iwan.kawrakow@gmail.com>
K
Kawrakow committed
2b3a665d3917edf393761a24c4835447894df74a
Parent: 7563293
Committed by GitHub <noreply@github.com>
on 1/17/2024, 10:36:37 AM