GPU 시세 · VRAM · 온디바이스 AI

10월에 로컬로 올 모델 — 발표 예정·갓 출시 모델 실측 대응표

· 읽는 시간 5분 · 데일리 딥러닝

MODEL WATCH

9월 말~10월 출시 모델은 로컬 실행 관점에서 ‘양자화 릴리스 시점’이 전부입니다. 현재 추격 중인 모델군과 실행 가능 시점을 정리했습니다.

모델군 로컬 실행 근거 대응
qwen3.8-flash-next (125B) UD-Q4면 128GB 가중치 111.3GB(실측) M5 Max 128GB 라인
qwen3.8:27b 가능 (UD-Q4 17.6GB) 사다리 실측 24GB 카드 권장
nemotron-3.5-lightning 가능 (25GB) 공개 벤치 114.9 tok/s 32GB 카드
gemma4 MoE 라인 UD-Q4 17.0GB KL 0.747 실측 24GB 카드

오픈 웨이트 비중이 61.7%까지 오른 만큼(10/1 브리핑), 신규 모델의 로컬 실행 대기 시간은 계속 짧아지고 있습니다. 모델별 품질·속도 전체 데이터는 47개 모델 비교표.

댓글 남기기