LLM Da Ubuntu nudo a LLM locale su una GPU NVIDIA da 16 GB Da Ubuntu nudo a inferenza LLM locale su GPU NVIDIA da 16 GB: driver, CUDA, llama.cpp con offload, modelli che entrano e benchmark reali. Adriano Amalfi 26 set 2026 9 min di lettura