AI
Running Qwen3.8 Flash-Next on Dual RTX 3060s with Proxmox and llama.cpp
An experimental case study of running Qwen3.8 Flash-Next on dual RTX 3060 GPUs and dual-socket Xeon hardware using Proxmox, NUMA interleaving, and an experimental llama.cpp build.
10 min read