Gadgets
Build a Local LLM with Tesla V100, 32GB VRAM for $266
An enthusiast acquired a noisy Nvidia Tesla V100 SXM2 for $266 and combined it with an RTX 4080 to build a local LLM inference environment with 32GB VRAM. Successfully runs a 27B parameter model at 32 tokens per second.