한국 실거래 기준 국내에서 가장 싼 ‘실전 LLM 카드’입니다. GB당 환산이 신형 8GB 카드들보다 낮습니다 — 가성비 진입로로서 최종 평가.
이 카드에 올라가는 모델 (16종 전수 중)
| 모델 | tok/s (M5 Max 기준) |
VRAM | TTFT | 출처 |
|---|---|---|---|---|
llama3.1:8b |
100.8 | 4.9GB | 0.1s | 실측 |
deepseek-r1:8b |
79.7 | 5.2GB | 44.4s | 실측 |
qwen3.5:9b |
73.0 | 6.6GB | 0.1s | 실측 |
phi4:14b |
45.8 | 9.1GB | 14.8s | 실측 |
16종 중 12종 탈락. 위 표는 M5 Max 실측 기준이며, VRAM 용량 판정은 NVIDIA에서도 동일하게 적용됩니다.
스펙으로 보는 체감
- 메모리 대역폭 360 GB/s → 8B Q4 예상 약 41 tok/s (대역폭 기준 추정, 실측 아님)
- TDP 170W → 8시간/일 돌리면 전기세 월 약 6,120원
- VRAM 12GB → 실전 한계: 14B급 Q4까지
실거래가
오늘치 다나와 실거래: 중앙값 540,300원, 최저 532,000원 (n=6) · GB당 약 45,025원
시리즈 전체 — RTX 3050~5090 전 모델 · VRAM Fit Matrix
기준
VRAM·대역폭·TDP는 NVIDIA 공개 스펙, 적합표의 tok/s·TTFT는 M5 Max 128GB(MLX/Ollama) 실측값입니다. “올라가는가”는 VRAM 용량으로, “얼마나 빠른가”는 대역폭으로 결정됩니다. 전기세는 8시간/일 × kWh당 150원 근사. 카드 간 교차 비교는 VRAM Fit Matrix.
댓글 남기기