Tuned llama.cpp Docker stack for GTX 1650 Ti — benchmarked KV quant, bigctx, TurboQuant FORCE_MMQ
Updated 2026-07-21 14:08:22 +02:00
Updated 2026-04-26 12:42:26 +02:00