A Reddit user demonstrates running a 176 billion parameter model (104 GB) on just 16 GB of VRAM without freezes, leveraging
reddit/r/LocalLLM
A Reddit user demonstrates running a 176 billion parameter model (104 GB) on just 16 GB of VRAM without freezes, leveraging