只论训练,二手 RTX 3090 24GB 赢。按 2026 年 9 月实际成交价,3090 为 150~180 万韩元,全新 RTX 4060 Ti 16GB 约 153 万韩元,差价只有 20 万韩元左右;而公开基准显示 QLoRA 训练速度 3090 快 1.96 倍,LLM 推理快 2.6 倍。但保修、功耗、散热风险全在 3090 这边,所以不是”无脑上 3090″。下面公开全部实际成交价、基准和电费算式。
🌐 · English · 中文 · Español · 한국어 · · 中文 Hub
二手RTX 3090行情,现在卖多少
以2026年9月26日核实为准,Bunjang(Bunjang)实际在售价格差异很大。MSI SUPRIM X和ASUS ROG STRIX挂到₩180万,求购帖在120万~₩140万一线。Joonggonara(Joonggonara)搜索均价显示₩222万,但那是被₩700万以上挂价拉高的数字,不能照单全收。我上一篇二手 3090 对比全新 5070里整理的结论是:可成交的实用区间为 150~180 万韩元,加上 4~5 万韩元的导热垫重做费用,实际总成本为 155~185 万韩元。同一天 Danawa 上 MSI 4060 Ti Gaming X Slim 16G 挂牌 1,522,000 韩元(运费 1 万韩元另计)。两张卡的实际差价约 10~30 万韩元。
训练基准:QLoRA 下 3090 快了 1.96 倍
被引用最多的实测是 Reddit r/LocalLLaMA 上的同环境对比:在 48GB 内存的 Threadripper 机器上用 4bit QLoRA 训练 Llama 2 一个 epoch(批次大小相同),3090 用时 468 秒,4060 Ti 16GB 用时 915 秒,915÷468 = 1.96 倍。推理方向相同:Hardware Corner 系的 llama.cpp 实测中,Q4 量化 8B 模型生成速度 3090 约 87 tok/s、4060 Ti 约 34 tok/s,相差 2.6 倍。
| 项目 | RTX 3090 24GB | RTX 4060 Ti 16GB |
|---|---|---|
| CUDA 核心 | 10,496(每 token) | 4,352(Ada) |
| 内存带宽 | 936 GB/s(384 位) | 288 GB/s(128 位) |
| QLoRA 1 epoch | 468 秒 | 915 秒(慢 1.96 倍) |
| 8B Q4 推理 | 约 87 tok/s | 约 34 tok/s(慢 2.6 倍) |
| 支持FP8 | 无 | 有(第四代张量) |
| TDP | 350W | 165W |
3.25 倍带宽定胜负
为什么上代显卡反而更强?4060 Ti 的败因不是算力,而是 128 位内存总线。用公式核实带宽:3090 是 19.5Gbps x 384-bit / 8 = 936 GB/s,4060 Ti 是 18Gbps x 128-bit / 8 = 288 GB/s,正好 3.25 倍。token 生成是带宽受限任务,每个 token 都要从内存读一次权重,所以只看 8B Q4(约 4.9GB)的理论上限就已分化:3090 是 936 / 4.9 = 191 tok/s,4060 Ti 是 288 / 4.9 = 59 tok/s。训练同样会因批次负担增大而吃亏,所以 VRAM 更大、能塞更大批次、减少梯度累积的 3090 更占优。只看 NVIDIA 官方 AI TOPS,4060 Ti(353)似乎高于 3090(285),这是与实测完全相反的陷阱点。要先确定各用途的最低 VRAMVRAM 按用途基准表一起查看。
16GB 与 24GB:能装下的分界线差在这里
Q4_K_M 量化约为每十亿参数 0.61GB。8B 是 4.9GB,14B 是 8.5GB,32B 是 19.5GB,此外 KV 缓存和活跃缓冲还要再加 15~20%。在 16GB 卡上,32B 根本不用算就装不下,连 20B 级也得削到 Q3 以下才勉强塞进去。24GB 的 3090 是唯一能在管理上下文的同时运行 32B Q4 的中低价消费级卡路径,实测也报告约 30 tok/s。即便需要同一模型的 Q8 级高精度驻留,24GB 才是安全线。这 8GB 的差距在训练中直接决定批次大小和序列长度。
电费与隐性成本——4060 Ti作为新一代该赢的地方
功耗差距很明确。按每天满负荷 8 小时计算,3090 月耗电为 0.35kW x 240 小时 = 84kWh,4060 Ti 为 39.6kWh,相差 44.4kWh。按夏季住宅低压二档阶梯电价(非高压;214.6 韩元 + 燃料费调整 5 韩元 + 气候环境 9 韩元,含增值税和基金约 258 韩元/kWh)折算,约每月 11,500 韩元、每年 138,000 韩元。但训练 1 个 epoch 本身的电费:3090 为 350W x 468 秒 / 3600 = 45.5Wh 即 11.4 韩元,4060 Ti 为 165W x 915 秒 = 41.9Wh 即 10.5 韩元——就算跑 1000 个 epoch 也只差 900 韩元。能效方面反而是更合时代的 4060 Ti 更好。按 36 个月月摊计算,3090 为 (165 万 + 5 万)/36 = 47,222 韩元,4060 Ti 为 153 万/36 = 42,556 韩元,每月差 4,666 韩元。3090 的真正风险不是电费,而是没有保修和 GDDR6X 发热。购买前务必要求跑 10 分钟 FurMark 并查看 nvidia-smi 显存温度日志。
按预算给结论:学生·实验室·上班族
- 学生(₩150万以下):全新 4060 Ti 16GB。3 年保修,550W 电源就够,8B~14B QLoRA 训练和实验都能覆盖。对第一次听说二手风险的人来说,买新卡就是正确答案。
- 实验室(200 万韩元):二手 3090 155 万~185 万韩元 + 750W 以上电源。32B 推理和加批次训练都能在本地搞定。但行情波动大,等 160 万韩元以下的档位更划算,若同档成交不易本地LLM安装指南像这样与云端并行的结构,也要算进账里。
- 上班族(低噪音·散热必备):把350W的老旗舰塞进客厅PC级机箱里跑,噪音让实际使用很难。没有电源余量和散热,4060 Ti或散热安静的5070 Ti 16GB更现实。
常见问题
问:现在买二手 RTX 3090,能比 4060 Ti 快多久?
A. 推理和QLoRA训练此刻仍是3090快2~2.6倍,这个差距是带宽硬件极限,软件更新翻不了盘。不过在用FP8·FP4路径的新运行时里,差距有所缩小。
Q. 需要多少 W 的电源(PSU)?
A. 3090 系统电源需 750W 以上,并为峰值尖峰留出余量。4060 Ti 16GB 用 550W 加一个 8pin 就够。老机升级的话,换电源要再加 5~10 万韩元。
Q. 3090 GDDR6X过热是真问题吗?
A. 实机案例中内存温度超100度的报告很多,换导热垫实际成了必做维护项。购买环节请确认跑FurMark 10分钟后的内存温度,若超95度,把₩4万–5万的重新作业费加进价格一起算。
问:训练时 16GB 出现 OOM 怎么办?
A. 首选是用 gradient accumulation 在保持有效 batch 的同时缩小 micro-batch;还不行就降级到 QLoRA 或缩短序列长度。如果是 3090,大多在这一步之前就解决了。
来源:截至 2026-09-26 核实 — Bunjang/Joonggonara 实际在售报价、Danawa 挂牌价(26.09)、Hardware Corner 与 Reddit r/LocalLLaMA 公开基准、韩电 2026 年第三季度电价表。价格和行情会波动,购买前请确认最新信息。