이 사이트의 로컬 LLM 콘텐츠 전체를 하드웨어 질문 하나로 묶는 관문입니다. 내 사양을 고르면 아래 페이지로 이어집니다.
| 내 상황 | 여기서 시작 |
|---|---|
| 47종 생성 속도 차트 — 메인 — 제 실측 10종 + 공개 벤치 6종, 모델 발표 최신순 | 47종 생성 속도 차트 — 메인 |
| 양자화 사다리 104빌드 — 모델별 전 비트 파일 크기 실측 + 품질 기록 | 양자화 사다리 104빌드 |
| RTX 5060 Ti 16GB에 도는 모델 전부 — 가중치 예산 13~14.5GB 실측 9빌드 | RTX 5060 Ti 16GB에 도는 모델 전부 |
| Mac 통합메모리별 모델 — 16/32/64/128GB 단계별 예산과 MLX | Mac 통합메모리별 모델 |
| 8GB GPU 생존표 — GB당 단가 1위 3060 12GB + 설정 함정 | 8GB GPU 생존표 |
| 전기세 vs Claude API — break-even 월 출력 7~8M 토큰 | 전기세 vs Claude API |
| 중고 3090 토큰 단가 — 1,000tok 2.62원 + 48GB 최저 경로 | 중고 3090 토큰 단가 |
| 4090 LoRA 파인튜닝 — 8B 1.6h / 70B 16h 실측표 | 4090 LoRA 파인튜닝 |
| Ollama vs LM Studio vs llama.cpp — 포장지 실측 + 함정 3개 | Ollama vs LM Studio vs llama.cpp |
| VRAM 사용처별 가이드 — 용도별 필요 VRAM 공식 | VRAM 사용처별 가이드 |
| 노트북 GPU TGP 가이드 — 같은 모델명, 다른 성능의 이유 | 노트북 GPU TGP 가이드 |
30초 결정 트리
- Windows + NVIDIA 16GB 이상 → 5060 Ti 표 (4090/5090도 크기만 바꾸면 동일 공식)
- Mac → 통합메모리 표 — MLX부터
- VRAM 8GB → 생존표 — 3060 12GB 업그레이드가 가장 싸다
- 비트가 애매 → 양자화 사다리
- 런타임 미정 → 3종 비교
- 비용 계산 → 전기세 vs API + 3090 단가
- 학습할 거면 → LoRA 실측표
2026-09-28 작성 · 파일 크기는 Hugging Face 라이브 목록 실측, 속도는 출처 명시된 공개 측정과 제 실측만 사용 · 로컬 실행 없음 · 양자화 사다리 104빌드 · 47종 생성 속도 차트

댓글 남기기