GPU 시세 · VRAM · 온디바이스 AI

Con precios reales de hoy (2026-09-27), el mercado de segunda mano se ha invertido: mediana de la RTX 5070 nueva en 1,399,000 wones,
RTX 3090 usada en torno a 1,800,000 wones según anuncios FE en Bunjang: la tarjeta nueva cuesta menos que la usada.
La única pregunta que queda no es rendimiento, sino una sola cosa: ¿de verdad necesita 24GB?

🌐 · English · 中文 · Español · 한국어 · · Español Hub

La tabla de precios ya se ha invertido — evidencia y trampas

Categoría RTX 5070 12GB (nueva) RTX 3090 24GB (usada)
Precio anunciado medido 1.399.000 wons 1.800.000 KRW
Fuente y fecha Medición en Danawa 2026-09-27 Anuncio FE en Beonggae / comunidad 1,1–2 M
Garantía Distribución oficial, 3 años Ninguna: presupuesta una nueva reparación aparte
Amortizado mensualmente en 36 meses 38,861 wones 45,833 wones (punto medio de 1.5~1.8 millones)

La dispersión de precios en la comunidad es grande. Un post de mayo menciona 1,1 M KRW y un hilo de septiembre en Quasar Zone habla de 2 M KRW, pero el anuncio real de la FE publicado hoy en Beonggae está en 1,8 M KRW. Si compras una 3090, el coste total real es ese precio de anuncio más 40–50 mil KRW de reparación de segunda mano y resinteamiento. La garantía de 3 años que incluye la 5070 también debe ir en la misma balanza.

Especificaciones: los núcleos duplican, pero lo que decide es la brecha de capacidad

Ítem RTX 3090 (2020) RTX 5070 (2025)
VRAM 24GB GDDR6X 12GB GDDR7
Ancho de banda 936 GB/s 672 GB/s
FP16 Tensor 35.58 TFLOPS 126 TFLOPS
Punto flotante FP8 No admitido Compatible (ruta de caché de 8 bits)
NVLink Admitido (2 tarjetas, 48GB) No compatible (última generación compatible)
TDP 350W 250W
Q8 14B (pesos de ~14GB) Puede residir Volcado obligatorio

En tensores FP16 la 5070 saca 3,5 veces, pero en ancho de banda de memoria gana la 3090 por 1,39 (936 frente a 672). Un modelo 14B cuantizado a Q8 pesa ~14GB solo en pesos: en los 12GB de la 5070 no hay sitio, el volcado a CPU pasa a ser obligatorio y la velocidad se reduce a la mitad. La 3090 incluso deja hueco para la caché KV. Existe de verdad un terreno donde decide la carga, no el cálculo.

Velocidad de inferencia y electricidad: publico las fórmulas

Coste mensual (inferencia 24h) RTX 3090 RTX 5070
Electricidad mensual (350/250W) 37,800 KRW 27,000 wones
Volumen mensual generado (Q4 14B) 40M tok 59M tok
Productividad por coste eléctrico 935 wones/M ₩457/M
Amortización de la diferencia — Solo en luz: 10.800 wons/mes de ahorro

Fórmula: electricidad = W x 0.6 (carga tensorial media) x 720 horas x 250 KRW/kWh. Generación = t/s x 86,400 x 30 días x 0.6 (utilización). Los t/s de inferencia se basan en benchmarks públicos para Q4 14B en un solo flujo (3090: 26, 5070: 38), medidos en runtimes de la familia llama.cpp. La electricidad de la 5070 por millón de tokens es 457 KRW, un 51% más barata que la 3090.

NVLink: la única ventaja decisiva de la 3090

Ampere es la última generación de consumo con NVLink. Uniendo dos 3090 obtienes 48 GB y la inferencia de modelos de clase 32B se resuelve dentro de la GPU sin red. Pero el ancho de banda no se suma y el cuello de botella sigue ahí: para entrenar hace falta una configuración manual de fragmentación, y hay que calcular a la vez placas adicionales, caja y margen de fuente de alimentación. El coste total de dos tarjetas (~3,6 M KRW) es la mitad de una 5090 nueva (6,56 M KRW): la única vía en activo a 48 GB.

Quién debe comprar qué

  • Solo inferencia ≤14B y ajuste fino ligero:La nueva 5070. Más barata, más rápida, con garantía y con luz más barata.
  • Q8 14B residente: 24GB es la unidad mínima de trabajo:3090 de segunda mano + 50.000 KRW de presupuesto para resinteamiento.
  • Inferencia de 32B en local:Dos 3090 con NVLink. Lo demás es una 5090 o la nube.
  • Opciones ambiguas:Si necesitas 24 GB pero montar tú mismo te pesa, empieza con una 4060 Ti 16GB y usa la nube en paralelo.

Preguntas frecuentes

P: ¿Q8 14B es imposible en una RTX 5070?
R. Funciona con descarga. Pero el ida y vuelta CPU-RAM se vuelve el cuello de botella y la velocidad de un solo flujo cae en picado. Con Q4 (unos 9GB) te quedas dentro de 12GB.

P: ¿Qué reviso al comprar una 3090 de segunda mano?
R: Es la temperatura de la GDDR6X. Cualquier tarjeta cuya VRAM haya superado los 100 grados necesita cambio de almohadillas térmicas sí o sí, y eso va en el presupuesto desde el principio. Antes de comprar, pide 10 minutos de FurMark + registro de temperaturas con nvidia-smi.

P. ¿Dos 3090 con NVLink me dan entrenamiento de 48GB?
R: La inferencia sí es posible. El entrenamiento exige fijar a mano la estrategia de división (paralelismo de tensores o de pipeline) y, por el límite de ancho de banda, el rendimiento total se satura a 1.6~1.9 veces una sola tarjeta.