GPU 시세 · VRAM · 온디바이스 AI

Mac M4 Pro 48GB 에서 로컬 LLM 돌리기 — RTX 5070 Ti vs 실측 비교

· 읽는 시간 5분 · 데일리 딥러닝

Mac M4 Pro 48GB = 로컬 LLM의 현실적 선택지인가?실측해보니 RTX 5070 Ti와 비슷한 성능을 보여줍니다.

실측 환경

Mac M4 Pro 48GB · MLX 프레임워크 · mlx_lm

실측 결과

모델 파라미터 Mac 속도 5070 Ti 속도 차이
qwen3-coder:30b 30B 132 tok/s 146 tok/s -10%
qwen3.5:9b 9B 88 tok/s 92.8 tok/s -5%
gemma4:26b 26B 79 tok/s 69.2 tok/s +14%
deepseek-r1:8b 8B 74 tok/s 79.7 tok/s -7%
qwen3.6:35b 35B 85 tok/s 58.9 tok/s +44%

결론

Mac M4 Pro 48GB는 35B급 이상에서 오히려 RTX 5070 Ti보다 빠를 수 있습니다. Mac이 MoE 모델에서 유리한 이유: 양자 메모리 대역폭이 2.7TB/s로 CUDA 대비 2배 이상 빠르기 때문입니다.

출처: daily-llm.com 내부실측 데이터.

댓글 남기기