GPU 시세 · VRAM · 온디바이스 AI

按今天(2026-09-27)的实测行情,二手市场已经倒挂:全新 RTX 5070 中位价 1,399,000 韩元,
二手 RTX 3090 按 Bunjang 上 FE 在售计算约 180 万韩元——新卡比二手还便宜的价签。
剩下的问题不是性能,只有一个:你到底需不需要 24GB?

🌐 · English · 中文 · Español · 한국어 · · 中文 Hub

价目表已经反转 — 依据与陷阱

类别 RTX 5070 12GB(全新) RTX 3090 24GB(二手)
实测挂牌价 1,399,000 韩元 1,800,000 韩元
来源·日期 Danawa 实测 2026-09-27 Beonggae 市场 FE 在售 / 社区 110~200 万
保修 正规渠道 3 年保修 无——维修预算另计
36 个月月摊 38,861 韩元 45,833 韩元(150~180 万的中间值)

社区行情价差很大。5 月的帖子提到 110 万韩元,Quasar Zone 9 月的帖子说 200 万韩元,但今天 Beonggae 二手市场上实际挂牌的 FE 是 180 万韩元。买 3090 的真实总成本,是这个实售价再加上 4~5 万韩元的维修与重新导热费用。5070 含 3 年保修这点也要放上同一个天平。

规格:核心差距是2倍,但下结论的是容量差距

项目 RTX 3090 (2020) RTX 5070 (2025)
VRAM 24GB GDDR6X 12GB GDDR7
带宽 936 GB/s 672 GB/s
FP16 Tensor 35.58 TFLOPS 126 TFLOPS
FP8 浮点 不支持 支持(8bit 缓存路径)
NVLink 支持(2 卡 48GB) 不支持(最后支持的世代)
TDP 350W 250W
Q8 14B(权重约 14GB) 可常驻 必须卸载

FP16 张量性能 5070 是 3.5 倍,但内存带宽反而是 3090 领先 1.39 倍(936 对 672)。Q8 量化的 14B 模型光权重就约 14GB——5070 的 12GB 根本放不下,CPU 卸载成为必须,速度直接腰斩;而 3090 在那个位置上连 KV 缓存都还装得下。确实存在”决胜负的不是算力而是装载量”的区间。

推理速度·电费——公开算式

月成本(按 24 小时推理) RTX 3090 RTX 5070
月电费(350/250W) 37,800 韩元 27,000 韩元
月生成量(Q4 14B) 40M tok 59M tok
单位电费产出 935 韩元/百万 ₩457/M
差价回收 — 仅电费每月省 10,800 韩元

算式:电费 = W x 0.6(平均张量负载)x 720 小时 x 250 韩元/kWh。生成量 = t/s x 86,400 x 30 天 x 0.6(稼动率)。推理 t/s 依公开基准,Q4 14B 单流(3090 为 26,5070 为 38),为 llama.cpp 系运行时实测值。5070 每百万 token 电费 457 韩元,比 3090 便宜 51%。

NVLink——3090 唯一的绝对强项

安培是最后一个支持 NVLink 的消费级世代。两张 3090 桥接后共 48GB,32B 级模型推理完全在 GPU 内完成、无需网络。但带宽不会叠加、瓶颈依旧,训练需要手动分片配置,还得把扩展板、机箱和电源余量一起算进去。双卡总成本(约 360 万韩元)只有新 5090(656 万韩元)的一半,是当下通往 48GB 的唯一现役路径。

谁该买什么

  • 仅 14B 以下推理·轻度微调:新款 5070。更便宜、更快、有保修、电费更省。
  • Q8 14B 常驻,24GB 是工作最低单位:二手 3090 + 5 万韩元重新导热预算。
  • 本地跑 32B 推理:两张带 NVLink 的 3090。否则路径只有 5090 或云端。
  • 尴尬的中间选项:需要 24GB 但觉得自己装机有压力,不如先用 4060 Ti 16GB 起步,同时配合云端。

常见问题

问:RTX 5070 上 Q8 14B 就没戏了吗?
A. 靠卸载能跑。但 CPU-RAM 的往返会成为瓶颈,单流速度大幅下降。用 Q4(约 9GB)就能控制在 12GB 以内。

Q. 买二手3090要检查什么?
A. 那是GDDR6X温度。VRAM温度破100度的卡,必须换导热垫,预算从一开始就要算进去。买之前要求跑FurMark 10分钟+nvidia-smi温度日志。

问:两张 NVLink 连接的 3090 能做 48GB 训练吗?
A. 推理可以。训练需要手动配置切分策略(张量并行或流水线并行),且受带宽限制,总吞吐在单卡的1.6~1.9倍处饱和。