GPU 시세 · VRAM · 온디바이스 AI

🌐 English · 中文 · Español · 한국어

本站所有本地 LLM 内容都汇聚到一个硬件问题:您的机器是什么配置?选择配置,下方直接跳转。

您的情况 从这里开始
47 款模型生成速度总表 — 10 项自测 + 6 项公开基准,按发布时间排序 47 款速度表(韩文)
量化阶梯 · 104 个构建 — 每模型每位宽实测文件大小与质量记录 量化阶梯(韩文)
RTX 5060 Ti 16GB 能跑的所有模型 — 权重预算 13–14.5GB,9 个实测构建 5060 Ti 模型表(韩文)
按 Mac 统一内存选模型 — 16/32/64/128GB 各档预算与 MLX Mac 内存指南(韩文)
8GB 显卡生存表 — 每 GB 性价比第一是 RTX 3060 12GB + 配置陷阱 8GB 生存表(韩文)
电费 vs Claude API — 盈亏平衡点约每月 700–800 万输出 token 电费 vs API(韩文)
二手 RTX 3090 每 token 成本 — 每千 token ₩2.62 + 最便宜 48GB 路线 3090 成本(韩文)
4090 LoRA 微调实测 — 8B 1.6 小时 / 70B 16 小时 LoRA 实测(韩文)
Ollama vs LM Studio vs llama.cpp — 实测对比 + 3 个坑 运行时对比(韩文)
按用途算显存 — 每种工作负载所需 VRAM 公式 VRAM 指南(韩文)
笔记本 GPU TGP 指南 — 同型号性能为何不同 TGP 指南(韩文)

30 秒决策树

发布于 2026-09-28 · 文件大小实测自 Hugging Face 在线列表 · 速度仅用署名公开基准与自测 · 源页面为韩文,翻译进行中