Con precios reales de hoy (2026-09-27), el mercado de segunda mano se ha invertido: mediana de la RTX 5070 nueva en 1,399,000 wones,
RTX 3090 usada en torno a 1,800,000 wones según anuncios FE en Bunjang: la tarjeta nueva cuesta menos que la usada.
La única pregunta que queda no es rendimiento, sino una sola cosa: ¿de verdad necesita 24GB?
🌐 · English · 中文 · Español · 한국어 · · Español Hub
La tabla de precios ya se ha invertido — evidencia y trampas
| Categoría | RTX 5070 12GB (nueva) | RTX 3090 24GB (usada) |
|---|---|---|
| Precio anunciado medido | 1.399.000 wons | 1.800.000 KRW |
| Fuente y fecha | Medición en Danawa 2026-09-27 | Anuncio FE en Beonggae / comunidad 1,1–2 M |
| Garantía | Distribución oficial, 3 años | Ninguna: presupuesta una nueva reparación aparte |
| Amortizado mensualmente en 36 meses | 38,861 wones | 45,833 wones (punto medio de 1.5~1.8 millones) |
La dispersión de precios en la comunidad es grande. Un post de mayo menciona 1,1 M KRW y un hilo de septiembre en Quasar Zone habla de 2 M KRW, pero el anuncio real de la FE publicado hoy en Beonggae está en 1,8 M KRW. Si compras una 3090, el coste total real es ese precio de anuncio más 40–50 mil KRW de reparación de segunda mano y resinteamiento. La garantía de 3 años que incluye la 5070 también debe ir en la misma balanza.
Especificaciones: los núcleos duplican, pero lo que decide es la brecha de capacidad
| Ítem | RTX 3090 (2020) | RTX 5070 (2025) |
|---|---|---|
| VRAM | 24GB GDDR6X | 12GB GDDR7 |
| Ancho de banda | 936 GB/s | 672 GB/s |
| FP16 Tensor | 35.58 TFLOPS | 126 TFLOPS |
| Punto flotante FP8 | No admitido | Compatible (ruta de caché de 8 bits) |
| NVLink | Admitido (2 tarjetas, 48GB) | No compatible (última generación compatible) |
| TDP | 350W | 250W |
| Q8 14B (pesos de ~14GB) | Puede residir | Volcado obligatorio |
En tensores FP16 la 5070 saca 3,5 veces, pero en ancho de banda de memoria gana la 3090 por 1,39 (936 frente a 672). Un modelo 14B cuantizado a Q8 pesa ~14GB solo en pesos: en los 12GB de la 5070 no hay sitio, el volcado a CPU pasa a ser obligatorio y la velocidad se reduce a la mitad. La 3090 incluso deja hueco para la caché KV. Existe de verdad un terreno donde decide la carga, no el cálculo.
Velocidad de inferencia y electricidad: publico las fórmulas
| Coste mensual (inferencia 24h) | RTX 3090 | RTX 5070 |
|---|---|---|
| Electricidad mensual (350/250W) | 37,800 KRW | 27,000 wones |
| Volumen mensual generado (Q4 14B) | 40M tok | 59M tok |
| Productividad por coste eléctrico | 935 wones/M | ₩457/M |
| Amortización de la diferencia | — | Solo en luz: 10.800 wons/mes de ahorro |
Fórmula: electricidad = W x 0.6 (carga tensorial media) x 720 horas x 250 KRW/kWh. Generación = t/s x 86,400 x 30 días x 0.6 (utilización). Los t/s de inferencia se basan en benchmarks públicos para Q4 14B en un solo flujo (3090: 26, 5070: 38), medidos en runtimes de la familia llama.cpp. La electricidad de la 5070 por millón de tokens es 457 KRW, un 51% más barata que la 3090.
NVLink: la única ventaja decisiva de la 3090
Ampere es la última generación de consumo con NVLink. Uniendo dos 3090 obtienes 48 GB y la inferencia de modelos de clase 32B se resuelve dentro de la GPU sin red. Pero el ancho de banda no se suma y el cuello de botella sigue ahí: para entrenar hace falta una configuración manual de fragmentación, y hay que calcular a la vez placas adicionales, caja y margen de fuente de alimentación. El coste total de dos tarjetas (~3,6 M KRW) es la mitad de una 5090 nueva (6,56 M KRW): la única vía en activo a 48 GB.
Quién debe comprar qué
- Solo inferencia ≤14B y ajuste fino ligero:La nueva 5070. Más barata, más rápida, con garantía y con luz más barata.
- Q8 14B residente: 24GB es la unidad mínima de trabajo:3090 de segunda mano + 50.000 KRW de presupuesto para resinteamiento.
- Inferencia de 32B en local:Dos 3090 con NVLink. Lo demás es una 5090 o la nube.
- Opciones ambiguas:Si necesitas 24 GB pero montar tú mismo te pesa, empieza con una 4060 Ti 16GB y usa la nube en paralelo.
Preguntas frecuentes
P: ¿Q8 14B es imposible en una RTX 5070?
R. Funciona con descarga. Pero el ida y vuelta CPU-RAM se vuelve el cuello de botella y la velocidad de un solo flujo cae en picado. Con Q4 (unos 9GB) te quedas dentro de 12GB.
P: ¿Qué reviso al comprar una 3090 de segunda mano?
R: Es la temperatura de la GDDR6X. Cualquier tarjeta cuya VRAM haya superado los 100 grados necesita cambio de almohadillas térmicas sí o sí, y eso va en el presupuesto desde el principio. Antes de comprar, pide 10 minutos de FurMark + registro de temperaturas con nvidia-smi.
P. ¿Dos 3090 con NVLink me dan entrenamiento de 48GB?
R: La inferencia sí es posible. El entrenamiento exige fijar a mano la estrategia de división (paralelismo de tensores o de pipeline) y, por el límite de ancho de banda, el rendimiento total se satura a 1.6~1.9 veces una sola tarjeta.