한 모더의 RTX 4080은 AAA 게임을 돌리기엔 충분했지만 LLM 구동에는 부족해, 그는 27B AI 모델을 돌리기 위해 헐값에 NVIDIA Tesla V100을 통합했다
A Modder’s RTX 4080 Was Enough to Play AAA Games, But Not to Run LLMs, So He Integrated NVIDIA’s Tesla V100 at a Throwaway Price to Run 27B AI Models

TL;DR AI
1분핵심 요약
한 PC 개조자가 RTX 4080에 중고 NVIDIA Tesla V100을 더해 로컬 AI 추론용 총 VRAM을 늘렸다.
SXM2-to-PCIe 어댑터와 개조한 쿨러를 사용해 소음과 호환성 문제를 해결했고, 32GB VRAM을 확보했다.
이 구성은 양자화한 Qwen3.6-27B 모델을 실사용 가능한 속도로 돌릴 수 있었다.
부품 비용은 300달러 미만이었다고 하며, 구형 엔터프라이즈 GPU를 LLM용으로 재활용하는 저비용 사례로 주목된다.



