Users on Lobste.rs are discussing memory drifting issues when running LLMs across multiple GPUs. The conversation focuses on how uneven VRAM allocation degrades performance during long inference sessions. Practitioners should monitor per-card utilization closely. This incremental technical hurdle complicates home-server setups for those avoiding expensive enterprise-grade Nvidia hardware.