GPU 시세 · VRAM · 온디바이스 AI

딥러닝 그래픽카드 순위 2026 — 실측 GB당 단가 (2026년 10월판)

· 읽는 시간 5분 · 데일리 딥러닝

딥러닝 그래픽카드 순위의 승자는 용량당 가격에서 갈린다. 2026년 10월 11일 실측 기준 1위 RTX 3060 12GB는 VRAM 1GB당 43,608원이고, 최하위 RTX 5090은 GB당 249,969원로 5.7배 차이다. 커뮤니티 1순위 추천인 중고 3090 두 장 구성이 실측 표에서도 이득인지, 새 카드와 나란 놓고 예산별로 계산한다.

딥러닝 그래픽카드 순위, 왜 클럭이 아니라 GB당 단가인가

LLM 추론과 파인튜닝에서 카드를 지배하는 변수는 두 개뿐이다. 모델 가중치와 KV cache가 들어가는 VRAM 용량, 그리고 토큰 하나를 만들어낼 때마다 가중치를 메모리에서 다시 읽는 속도를 정하는 대역폭이다. TFLOPS 같은 연산 성능은 큰 배치 학습에서야 의미가 있고, 개인과 연구실의 실전 체감은 ‘모델이 들어가느냐, 중간에 터지느냐’가 먼저다. 그래서 이 글의 딥러닝 그래픽카드 순위 기준은 최저가를 VRAM 용량으로 나눈 GB당 단가로 고정한다. 용량이 같은 카드끼리는 대역폭이 높은 쪽이 위다. 신형이 무조건 좋은 게 아니라, 같은 16GB면 싼 게 이긴다는 뜻이다.

2026년 10월 실측 계산표 — 11종 GB당 단가 순위

가격은 이 블로그 추적기가 2026-10-11 15:47(KST)에 수집한 실측값이다. 당일 스냅샷에 표본이 없는 카드는 추적기가 마지막으로 유효 샘플을 확보한 날짜를 기준일 칸에 그대로 표기했고, 표본 수(n)도 함께 실었다. 중고 두 종은 표본이 특히 적으니 최저가를 상시 시세로 착각하면 안 된다. 대역폭은 NVIDIA·AMD 공식 스펙이다.

순위 카드 최저가 GB당 단가 VRAM 대역폭 표본 기준일
1 RTX 3060 12GB 523,300원 43,608원 12GB 360 GB/s n=5 2026-10-09
2 RTX 3090 24GB (중고) 1,403,765원 58,490원 24GB 936 GB/s n=2 2026-10-10
3 RTX 5050 8GB 579,600원 72,450원 8GB 320 GB/s n=5 2026-10-10
4 RTX 5070 Ti 16GB 1,419,000원 88,688원 16GB 896 GB/s n=6 2026-10-11
5 RTX 5060 8GB 711,200원 88,900원 8GB 448 GB/s n=4 2026-10-09
6 RX 9070 XT 16GB 1,450,000원 90,625원 16GB 640 GB/s n=7 2026-10-11
7 RTX 5070 12GB 1,089,000원 90,750원 12GB 672 GB/s n=15 2026-10-11
8 RTX 5060 Ti 8GB 870,000원 108,750원 8GB 448 GB/s n=2 2026-10-10
9 RTX 5080 16GB 2,393,100원 149,569원 16GB 960 GB/s n=10 2026-10-11
10 RTX 4090 24GB (중고) 3,900,000원 162,500원 24GB 1,008 GB/s n=1 2026-10-07
11 RTX 5090 32GB 7,999,000원 249,969원 32GB 1,792 GB/s n=4 2026-10-11

표에서 두 가지가 보인다. 첫째, 용량당 1~2위는 신형이 아니라 2026-10-09 기준 RTX 3060 12GB(GB당 43,608원)와 2026-10-10 기준 중고 3090(GB당 58,490원)이다. 둘째, 신형 중에서는 RTX 5070 Ti 16GB(GB당 88,688원)가 RTX 5060 8GB(GB당 88,900원)와 거의 같은 단가인데 대역폭은 2배다. 반대로 RTX 5090은 대역폭 1,792 GB/s가 확실히 최강이지만 GB당 단가는 표 꼴찌로, 같은 돈을 용량이 아니라 대역폭에 쓰는 카드다.

커뮤니티의 “3090 두 장 NVLink”는 옳은가 — 여론 대 실측

커뮤니티 AI 빌드 문의 글의 단골 답변은 “신품 반값에 VRAM 두 배, 3090 두 장을 사라”다(퀘이사존 AI 빌드 게시물, 2025-10-15). 실측으로 대조하면 결론은 옳다. 중고 3090 두 장은 2,807,530원면 VRAM 48GB·대역폭 1,872 GB/s를 산다. 같은 예산 상한의 신형 조합 RTX 5070 두 장(2,178,000원, 24GB·1,344 GB/s)보다 629,530원 비싸지만 용량이 두 배고, 신형으로 48GB를 채우려면 RTX 5090(7,999,000원) 한 장도 이 조합보다 5,191,470원 비싸다. 48GB에 걸리는 LLM 파인튜닝 배치가 이 가격대에서 처음으로 현실적이 된다. 단 조건이 있다. 오늘 중고 3090 표본은 2건뿐이고 최저(1,403,765원)와 중간값(2,200,000원) 격차가 80만원이 넘는다. 이건 시세가 아니라 ‘잡히면 운 좋은 매물’ 수준이다. 검수 절차는 내부 글 중고 그래픽카드 채굴품 거르는 체크리스트를 먼저 읽고, 두 장을 같은 가격대에 동시에 확보할 수 있을 때만 진행하라.

대역폭으로 다시 보는 딥러닝 그래픽카드 순위 — 토큰 속도 상한

GB당 단가가 ‘들어가느냐’를 정한다면, 대역폭은 ‘몇 글자를 뽑아내느냐’를 정한다. 추론 중 토큰 생성 속도의 이론 상한은 대역폭을 모델 파일 크기로 나눈 값이다. 기준 모델은 ollama 태그 실측 8.1GB인 Gemma 3 12B Q4(내부 글 온디바이스 AI RTX 5070 12GB 한계)로 잡았다. 실제 속도는 KV cache·배치·양자화 오버헤드로 이보다 낮다.

카드 12B Q4 적재(8.1GB) 이론 상한 (토큰/s) 한계
RTX 3060 12GB 가능 약 44 27B Q4(약 17GB)는 불가
RTX 3090 24GB (중고) 가능 약 116 27B Q4(약 17GB)도 적재 가능
RTX 5070 Ti 16GB 가능 약 111 27B Q4(약 17GB)는 불가
RX 9070 XT 16GB 가능 약 79 27B Q4(약 17GB)는 불가
RTX 5070 12GB 가능 약 83 27B Q4(약 17GB)는 불가
RTX 5080 16GB 가능 약 119 27B Q4(약 17GB)는 불가
RTX 4090 24GB (중고) 가능 약 124 27B Q4(약 17GB)도 적재 가능
RTX 5090 32GB 가능 약 221 27B Q4(약 17GB)도 적재 가능

이 관점에서도 3090은 강하다. 936 GB/s로 5070 Ti(896 GB/s)를 앞지르고 최저가는 15,235원 저렴하다. 반대로 8GB 구간(RTX 5050·5060·5060 Ti 8GB)은 12B 모델이 물리적으로 안 들어가 이 표에 이름조차 올리지 못한다. 싼데 못 쓰는 구간이라, 순위표 상위인 5050(전체 3위)도 LLM 용도에서는 3060에게 밀린다.

예산별 구매 결정 — 학생 50만, 개인 150만, 연구실 250만

예산 추천 실측가 근거
학생 50만원대 RTX 3060 12GB 523,300원 표 전체 1위 GB당 43,608원, 12B Q4 적재·상한 44토큰/s, 보증 기간 내 신형 대비 실패 비용 최소
개인 150만원 중고 3090 (재고 시) → 아니면 RTX 5070 Ti 1,403,765원 / 1,419,000원 GB당 58,490원 vs 88,688원, 차이가 15,235원뿐이라 검수 자신이 없으면 무상 보증 쪽으로
연구실 250만원 RTX 5070 두 장 2,178,000원 24GB·1,344 GB/s, 새 보증 2장. RTX 5080(2,393,100원)보다 215,100원 싸면서 총 대역폭은 앞섬
서버 800만원 RTX 5090 7,999,000원 GB당 249,969원로 단가는 꼴찌, 1,792 GB/s·FP4에 지불하는 돈 — 다 사용자 추론 서버일 때만 정당화

한 가지만 더: AMD RX 9070 XT 16GB(1,450,000원, GB당 90,625원)는 5070 Ti보다 -31,000원 싸서 예산 후보에 오르지만, 학습 커널·라이브러리 지원은 CUDA가 여전히 앞선다. 추론 전용이면 검토, 실험용 학습이 목적이라면 이 순위표의 CUDA 카드에서 고르는 게 안전하다. 여러 장 구성은 ‘필요 용량이 총량으로 해결될 때’만 가치가 있다 — 단일 카드 용량 한도가 먼저다.

자주 묻는 질문

Q. AI 학습 시작은 신형 5070 Ti와 중고 3090 중 뭐가 낫나요?

검수 능력이 있으면 3090(1,403,765원, 24GB)이 GB당 단가(58,490원)에서 5070 Ti(88,688원)보다 1.52배 싸고 대역폭도 40 GB/s 높다. 확신이 없으면 무상 보증 쪽으로 가라. 중고 리스크는 위 체크리스트 글로 줄일 수 있다.

Q. 8GB 카드는 왜 순위 상위인데 추천에서 빠지나요?

Gemma 3 12B Q4 한 개(8.1GB)에도 VRAM이 부족해서다. 8GB 구간은 이미지 생성·소형 3B 이하 전용이고, LLM 입문 기준으로는 최저가 52만원대인 3060 12GB가 진입선이다.

Q. 두 장 구성은 언제 가치를 만드나요?

단일 카드로 안 되는 용량(32GB 초과 배치, 27B 초과 파인튜닝)이 목표일 때만이다. 같은 250만원이면 5070 두 장(24GB·1,344 GB/s)이 5080 한 장(16GB·960 GB/s)보다 총량에서 이기지만, 하나의 모델을 두 장에 쪼개는 오버헤드가 생긴다.

Q. GB당 단가 표는 언제 갱신되나요?

추적기가 매일 15:47(KST)에 갱신한다. 지난달 대비 추이는 VRAM 1GB당 최저가는 그대로 (2026년 9월판)에서 확인하고, 이번 달 기준은 이 글의 기준일 표가 대신한다.

출처·기준: GPU 가격 추적기 실측(2026-10-11 15:47 KST, 신형 8종·중고 2종·구형(3060) 1종, 당일 표본 없는 카드는 마지막 유효일·표본 수 표기), 대역폭은 NVIDIA·AMD 공식 스펙, 모델 파일 크기는 ollama 태그 실측(내부 글 2026-10-07). 커뮤니티 의견은 퀘이사존 공개 게시물(2025-10-15). 토큰/s는 대역폭 나눗셈 근사 상한이며 실측을 단정하지 않는다.

답글 남기기