你租到的是什么
一台完整的 NVIDIA DGX Spark,归你独占。下面的数字来自 NVIDIA 的数据表。
- 超级芯片
- GB10
- 20 个 Arm 核心加一颗 Blackwell GPU,通过 NVLink-C2C 互联
- 内存
- 128 GB
- CPU 与 GPU 共享的 LPDDR5x,带宽最高 273 GB/s
- AI 算力
- 1 PFLOP
- 稀疏条件下的理论 FP4 值,不能和 FP8、FP16 的数字比
- 功耗与体积
- 240 W
- 整机,1.2 kg
三步开始
01
登录并添加 SSH 公钥
用邮箱登录,然后保存你登录时用的公钥。
02
充值并开机
给钱包充值,选规格,开机。没有空闲机器就进入排队。
03
登录
用控制台给出的命令 SSH 登录,开始工作。用完删除实例,计费随即停止。
你拿到的是什么
一台机器只服务一个租户
不和别人共享 GPU 和内存,128GB 统一内存全部可用。双节点和四节点规格(最高 512GB)即将上线。
按分钟计费
从容器就绪开始计,到你删除实例为止。排队、分配和擦除的时间不收费。
没有空闲机器时免费排队
轮到你时自动开机并发邮件通知,也可以选择等你确认后再开。
删除即销毁
你的数据放在单独的加密卷里,每次租用一把新密钥,删除实例时密钥随之销毁。
大家用 DGX Spark 跑什么
微调、本地推理、检索管线等等。每一页讲清楚 128GB 统一内存装得下什么,以及怎么开始。
在租用的 DGX Spark 上微调大语言模型
128GB 统一内存,足以微调那些在常见的 24GB 或 32GB 显卡上放不下的模型。
在 DGX Spark 上运行大模型推理
容量是这台机器的强项。解码速度则很大程度上取决于模型类型和软件。
在一台机器上搭检索增强生成(RAG)管线
RAG 系统需要几个模型和一个数据库。在共用一块内存的单机上,它们可以放在一起。
DGX Spark 上的量化:FP4、FP8 和 GGUF
量化是大模型能装下的原因。选哪种格式,决定省多少内存,也决定能用哪些软件。
不买硬件,也能跑模型评测和基准测试
一次评测是几个小时的工作,可能要重复十几次。两次之间的那些天,你并不需要一台机器。
按小时标价,按分钟扣费
按需使用,没有最低消费。价格以美元计。
单节点
×1$0.75每小时
折合每分钟 $0.0125
- 1 台 DGX Spark
- 128GB 统一内存
- 预留价(即将上线):$16.80/天
双节点和四节点规格即将上线,价格和细节见定价页。 全部规格和计费细节
准备好了就开机
先充值,再选规格。没有空闲机器时,排队不收费。