博客
在 DGX Spark 上跑 AI 任务的容量估算、成本和实用笔记。
128GB 装得下什么?模型权重容量估算指南
一分钟算出模型能不能放进 DGX Spark:参数量乘以每个参数的字节数,再给 KV 缓存留出空间。附常见规模的对照表。
2026年10月7日
为什么出字速度看内存带宽:DGX Spark 的 273 GB/s 意味着什么
文本生成每个 token 都要读一遍模型权重,所以速度受内存带宽封顶。用 DGX Spark 的 273 GB/s 做一个估算上限。
2026年10月7日
在租用的 DGX Spark 上做一次 70B QLoRA 微调要花多少钱?
用 NVIDIA 公布的 Llama 3.3 70B QLoRA 吞吐(每秒 759.79 个 token),估算 1000 万、1 亿和 10 亿训练 token 的耗时和费用。
2026年10月7日
为什么我们不写「比 H100 快 X 倍」
我们对 DGX Spark 数字的写法规则,以及三个常被写错的细节:1 petaFLOP、nvidia-smi 的显存读数、SM 版本。
2026年10月7日
准备好了就开机
先充值,再选规格。没有空闲机器时,排队不收费。