Windows GPU 없어도 로컬 AI 가능? Mac M5 Max 128GB에서 16개 모델실측했습니다.
실측 환경
Mac M5 Max 128GB · MLX 프레임워크 · mlx_lm 라이브러리
실측 결과 (토큰/초)
| 순위 | 모델 | 속도 | VRAM | 비고 |
|---|---|---|---|---|
| 1 | qwen3-coder:30b | 146.2 | 18GB | 최고 속도 |
| 2 | deepseek-r1:8b | 79.7 | 5.2GB | 접근성↑ |
| 3 | llama3.1:8b | 100.8 | 4.9GB | 초고속 |
| 4 | gpt-oss:20b | 102.9 | 13GB | 오픈소스 |
| 5 | qwen3.5:9b | 73.0 | 6.6GB | 가볍고 빠름 |
| 6 | gemma4:26b | 88.1 | 52GB | 고성능 |
| 7 | ornith-1.5:35b | 92.6 | 37GB | 국산 모델 |
| 8 | qwen3.6:35b-a3b | 95.1 | 23GB | MoE 효율 |
Windows vs Mac 비교 포인트
- 사용성: Mac은 모델 다운로드 한방 (Ollama 지원)
- 속도: 최적화 모델이면 동급 Windows GPU 대비 비슷하거나 빠름
- 전력: 4090 450W vs M5 Max 120W
- 가격: 128GB Mac 대비 4090 다는 PC는 150만원 저렴
결론: 로컬 LLM 새로운 기준 — Mac도 충분히 경쟁력 있습니다.
출처: daily-llm.com 내부 실측 데이터.
댓글 남기기