2026년 로컬 LLM을 시작하려면 GPU가 필수? 아닙니다. 실제_budget별 가이드를 정리했습니다.
3단계 시작법
1단계: 먼저 사용할 모델을 정하세요
- 코딩용 → qwen3-coder:30b, deepseek-r1:8b
- 일상 대화 → qwen3.5:9b, gemma4:26b
- 장문 처리 → qwen3.6:35b, qwen3.8:27b
2단계: VRAM 필요량을 계산하세요
vram_calc.py로 3초에 계산합니다. 가중치 + KV캐시 + 활성화 = 필요 VRAM
3단계: GPU를 고르세요
| 예산 | 추천 카드 | VRAM | 통하는 모델 |
|---|---|---|---|
| 100만원 | RTX 3090 중고 | 24GB | 35B급까지 |
| 110만원 | RTX 5070 12GB | 12GB | 9B급까지 |
| 160만원 | RTX 5070 Ti 16GB | 16GB | 30B급까지 |
| 220만원 | RTX 5080 16GB | 16GB | 26B급 최고속도 |
| 930만원 | RTX 5090 32GB | 32GB | 125B급까지 |
출처: daily-llm.com 시세 + 실측 데이터. 2026-10-03 기준.
댓글 남기기