🌐 English · 中文 · Español · 한국어
本站所有本地 LLM 内容都汇聚到一个硬件问题:您的机器是什么配置?选择配置,下方直接跳转。
| 您的情况 | 从这里开始 |
|---|---|
| 47 款模型生成速度总表 — 10 项自测 + 6 项公开基准,按发布时间排序 | 47 款速度表(韩文) |
| 量化阶梯 · 104 个构建 — 每模型每位宽实测文件大小与质量记录 | 量化阶梯(韩文) |
| RTX 5060 Ti 16GB 能跑的所有模型 — 权重预算 13–14.5GB,9 个实测构建 | 5060 Ti 模型表(韩文) |
| 按 Mac 统一内存选模型 — 16/32/64/128GB 各档预算与 MLX | Mac 内存指南(韩文) |
| 8GB 显卡生存表 — 每 GB 性价比第一是 RTX 3060 12GB + 配置陷阱 | 8GB 生存表(韩文) |
| 电费 vs Claude API — 盈亏平衡点约每月 700–800 万输出 token | 电费 vs API(韩文) |
| 二手 RTX 3090 每 token 成本 — 每千 token ₩2.62 + 最便宜 48GB 路线 | 3090 成本(韩文) |
| 4090 LoRA 微调实测 — 8B 1.6 小时 / 70B 16 小时 | LoRA 实测(韩文) |
| Ollama vs LM Studio vs llama.cpp — 实测对比 + 3 个坑 | 运行时对比(韩文) |
| 按用途算显存 — 每种工作负载所需 VRAM 公式 | VRAM 指南(韩文) |
| 笔记本 GPU TGP 指南 — 同型号性能为何不同 | TGP 指南(韩文) |
30 秒决策树
- Windows + NVIDIA ≥16GB → 5060 Ti 表(4090/5090 同理)
- Mac → 统一内存表,从 MLX 开始
- 8GB 显存 → 生存表,升级到 3060 12GB 最划算
- 不确定位宽 → 量化阶梯
- 没选运行时 → 三合一对比
- 算成本 → 电费 vs API + 3090 成本
- 想训练 → LoRA 实测表
发布于 2026-09-28 · 文件大小实测自 Hugging Face 在线列表 · 速度仅用署名公开基准与自测 · 源页面为韩文,翻译进行中