GPU 시세 · VRAM · 온디바이스 AI

,

Mac M5 Max 128GB에서 로컬 LLM 16개실측 – 토큰/초 순위

· 읽는 시간 5분 · 데일리 딥러닝

Windows GPU 없어도 로컬 AI 가능? Mac M5 Max 128GB에서 16개 모델실측했습니다.

실측 환경

Mac M5 Max 128GB · MLX 프레임워크 · mlx_lm 라이브러리

실측 결과 (토큰/초)

순위 모델 속도 VRAM 비고
1 qwen3-coder:30b 146.2 18GB 최고 속도
2 deepseek-r1:8b 79.7 5.2GB 접근성↑
3 llama3.1:8b 100.8 4.9GB 초고속
4 gpt-oss:20b 102.9 13GB 오픈소스
5 qwen3.5:9b 73.0 6.6GB 가볍고 빠름
6 gemma4:26b 88.1 52GB 고성능
7 ornith-1.5:35b 92.6 37GB 국산 모델
8 qwen3.6:35b-a3b 95.1 23GB MoE 효율

Windows vs Mac 비교 포인트

  • 사용성: Mac은 모델 다운로드 한방 (Ollama 지원)
  • 속도: 최적화 모델이면 동급 Windows GPU 대비 비슷하거나 빠름
  • 전력: 4090 450W vs M5 Max 120W
  • 가격: 128GB Mac 대비 4090 다는 PC는 150만원 저렴

결론: 로컬 LLM 새로운 기준 — Mac도 충분히 경쟁력 있습니다.

출처: daily-llm.com 내부 실측 데이터.

댓글 남기기