GPU 服务器
属于你的 GPU 服务器,显存从 20 到 96 GB。
整台服务器都听你调度,root 权限完整开放,驱动栈由你自己选择并锁定,显卡工作的每一小时都花在你自己的任务上。
每月US$330起
获取 GPU 服务器配置与价格由你在页面上选定,我们按你的订单把它搭建出来。
- 每一颗核心和每一张卡,都归你独享
- 完整 root 权限,驱动栈由你自己选
- 进出机器的流量都已包含在内
- 一个月费,只要你留着就一直是这个价
SparkUS$330每月
显卡显存20 GB
我们为你搭建的服务器
- Spark
- Forge
- Foundry
- Reactor
大家在跑什么
为你手上正在做的事而生。
这里的每一台服务器都能把整个模型放进显存,从入门款的 20 GB 到最大一台的 96 GB,你的任务都在一张卡上跑,并且一直留在那里。
- 微调你自己的模型带上一个开源模型和你自己的数据,在一张从头到尾都由你独享的卡上训练,把每一个检查点都留在只有你能进的服务器里。
- 把模型服务给你的用户整张卡都归你,推理可以全天候地跑,于是你周一测出来的响应时间,就是周五用户拿到的响应时间。
- 整夜运行的批处理把渲染、转码或者嵌入生成排进队列,让服务器全力跑到任务收尾为止,这一切都在同一个月费里。
服务器
挑一台装得下你模型的服务器。
显存决定你能加载多大的模型,围绕它的系统内存则给你充足的空间提前备好数据,让显卡在工作时一直有活可干。
每台服务器都按订单搭建,所以你拿到的就是你选定的那套配置,价格就是卡片上的价格。
只要这台服务器还在你名下,价格就一直锁定。
适配检查
找到能跑起你模型的那台服务器。
设定模型有多大、你打算怎么加载,我们就告诉你装得下它的最小一台服务器,以及它的价格。
8B 参数以 16-bit 加载,权重约为 16 GB。
每台能装多少
- Spark显存20 GB剩余 4 GB
- Forge显存96 GB系统内存256 GB剩余 80 GB
- Foundry显存96 GB系统内存512 GB剩余 80 GB
- Reactor显存96 GB系统内存768 GB剩余 80 GB
在权重之上给自己留出余量,显卡就能一直以全速推进你的任务。
你将获得
每台 GPU 服务器都自带这些。
- 整台服务器,只归你一个人显卡工作的每一小时都在为你的任务工作,整台服务器只听你的调度。
- 你的驱动栈,锁在你放的位置选好驱动和工具包,把它们一起锁定,从这一次运行到下一次,它们都停在你放的位置上。
- 随时都能要一个干净的 Linux在控制面板点几下就能重装,服务器回来时你的 SSH 密钥已经在里面了。
- 救援模式,随你差遣任何时间都能在控制面板用自己的密钥启动救援系统,几分钟就把控制权拿回手里。
说人话
GPU 服务器是什么。
GPU 服务器就是一台装了显卡的电脑,而显卡特别擅长把同一道小小的算式同时算上几百万遍,训练模型和运行模型,恰恰就是由这样的算式堆起来的。
从我们这里租一台,意味着整台服务器都是你的:显卡、处理器,还有它们周围的内存,只要你留着,就全都归你。
上面装什么由你决定,供电、联网和散热交给我们。
常见问题
大家常问的问题。
- 怎么知道自己需要哪一台?
- 先从显存看起,因为它决定你能加载多大的模型。推理跑在贴近权重大小的位置就很舒服,训练则会因为权重之上的余量而跑得更好,所以要训练就给自己多留一些。
- 怎么才能拿到一台?
- 按卡片上的价格选好你想要的那一台,我们就按订单搭建。想知道某一档当天的情况,问一声我们就告诉你。
- 驱动由谁维护?
- 在自主管理的服务器上由你维护,这也是大多数人来这里想要的。选好驱动和工具包,把它们一起锁定,它们就一直停在你放的位置上。托管版本里,操作系统交给我们的工程师照看。
- 怎么计费?
- 整台服务器一个月费,你留着它的每一天它都只属于你,续费时也按你签下时的价格续。
01
02
03
04