云服务器

GPU 和 AI 计算服务器

A Kapsule GPU server is a single-tenant physical machine fitted with NVIDIA graphics processors and the CPU, memory and fast storage needed to keep them fed, built for AI training, inference and…

Kapsule GPU 服务器是一台单租户物理机,配备 NVIDIA 显卡以及支持其运行所需的 CPU、内存和高速存储,专为 AI 训练、推理和其他大规模并行工作而设计。

您将获得整台机器的使用权。没有其他人的任务会与您共享 GPU、内存带宽或磁盘,这是您能够重现基准测试结果和无法重现的区别所在。本指南涵盖四个层级、它们的适用场景、考虑到 GPU 供应确实紧张时的订购方式,以及设置费的说明。

四个层级

层级GPUGPU 内存系统内存月价格一次性设置费
SparkNVIDIA RTX 400020 GB包含在配置中US$330.00
ForgeNVIDIA RTX PRO 600096 GB256 GBUS$1,680.00
FoundryNVIDIA RTX PRO 600096 GB512 GBUS$2,520.00
ReactorNVIDIA RTX PRO 600096 GB768 GBUS$3,240.00

价格显示不含 GST,以您的账户计费货币计价。每个层级都有非托管或托管两种选择,与我们的云服务器相同。

从 Spark 到 Forge 的升级是最重要的一步。Spark 是开发、小型模型和推理工作的入门选择。Forge、Foundry 和 Reactor 共享相同的 96 GB GPU 内存,在系统内存上有所不同,这决定了您可以在主机 RAM 中存储多少内容以配合模型使用:数据集暂存、预处理管道和处理多个并发请求。

您可以运行的内容

您对机器拥有完全控制权,因此可以运行自己的堆栈。这包括 PyTorch、TensorFlow、JAX、原生 CUDA 工作负载,以及它们上面的常用训练和服务框架。

典型用途:

  • 模型训练和微调,用于机器学习和深度学习。
  • 推理和服务在生产中,GPU 可以将无法接受的响应时间转变为可接受的时间。
  • 批量 AI 工作负载:嵌入、转录、图像和视频生成、渲染。
  • 科学和并行计算,受益于 GPU 加速。

首先根据 GPU 内存进行调整。最常见的错误是根据价格选择层级,然后发现模型不适合 VRAM。计算您的模型在预期精度和批量大小下需要的内存,预留一些余量,然后选择能够满足要求的层级。系统内存和 CPU 比无法加载的模型容易处理得多。

可用性和订购方式

GPU 硬件在整个行业需求量很大,供应有限。这是市场的事实,而不是 Kapsule 的政策,它影响这些机器的订购方式。

  • 这些是物理机器,所以它们是按订单配置而不是在几秒内配置的。
  • 可用性因层级和位置而异,当您查看计划页面时会进行实时检查。
  • Spark 目前供应紧张。 当它缺货时,面板会为您提供预留队列,而不是拒绝订单。

对于更大或自定义配置,我们会在配置和确切价格上与您确认后再进行配置,因此您总是知道您会得到什么。我们不会报价无法交付的配置。

预留队列

当 GPU 层级缺货时,您可以预留它而不是放弃:

  1. 从计划页面预留该层级。您会获得一个预留参考号。
  2. 不收取任何费用。 预留是免费的,没有订阅启动。
  3. 当容量可用时,我们会自动为您配置机器。
  4. 您的首次付款仅在服务器上线后才会扣除,您的计费日期从那天开始。
  5. 您可以在等待期间随时取消,不收任何费用。

地区、可用性和预留队列详细说明了其运作机制。

不要将 GPU 预留放在硬性期限上。容量何时返回就何时返回,我们宁愿直言相告而不是承诺我们无法兑现的日期。如果您有固定的交付日期,请在订购前与我们联系。

订购

  1. 登录 KPanel
  2. 打开左边栏中的商店并选择 GPU,或直接转到 /plans/compute?group=gpu
  3. 使用非托管托管切换来选择您想要的方式。
  4. 每个层级显示其 GPU、VRAM、系统内存、月价格和一次性设置费,以及实时库存徽章。

KPanel 中计算计划阶梯上的 GPU 组

设置费

GPU 服务器在结账时除了经常性的月价格外还需要一次性设置费,因为物理机器必须为您构建和配置。

  • 收取一次,在配置时。它永远不会出现在续期上。
  • 在结账时显示为单独的行,标记为设置(一次性),带有其自己的收据。
  • 当您的账户货币为 NZD 时需缴纳 GST。

参阅云服务器定价和 GST了解一次性和经常性费用如何出现在您的发票上。

GPU 服务器与云服务器的区别

云服务器GPU 服务器
硬件虚拟机配备 NVIDIA GPU 的单租户物理机
配置立即配置,受库存限制按订单配置,有时通过预留队列
设置费一次性
KPanel 中的实时调整大小
按以下条件调整大小vCPU、内存、磁盘GPU 内存优先,然后是系统内存

GPU 服务器无法原位调整大小。在层级之间移动意味着订购新机器并将您的工作迁移到它。选择适合您预期运行的模型的层级,而不仅仅是您本周运行的层级。

订购前

准备好这些答案,因为它们决定了层级:

  • 训练还是推理? 训练通常占用大量内存且运行时间长。推理通常对延迟敏感且需要并发。
  • 什么模型,什么精度? 这决定了 GPU 内存的下限。
  • 数据量有多少,数据存储在哪里? 暂存大型数据集是系统内存和磁盘的用途。
  • 什么框架? 这样我们可以提前确认驱动程序和 CUDA 的期望。

告诉我们这四件事,我们将指导您选择正确的层级,或者如果标准四个都不适合,我们将为您组装一个配置。在 KPanel 中询问 Kora,或发送电子邮件至 support@kapsulehost.com,我们的新西兰团队将为您提供帮助。

故障排除

我想要的层级显示缺货。 预留它。您在等待期间无需支付任何费用,当容量返回时我们会自动配置。

我的模型无法装入 VRAM。 升级到更高层级,或降低精度或批量大小。Forge、Foundry 和 Reactor 都配有 96 GB GPU 内存。

我需要多个 GPU 或未列出的配置。 告诉我们您的要求,我们会确认我们能构建什么以及费用是多少,然后再进行任何收费。

我可以在承诺前尝试吗? 与我们讨论从 Spark 开始进行开发工作,然后在您的管道经过验证后升级。

仍需帮助?

请发送邮件至 support@kapsulehost.com 或在 KPanel 中打开聊天。

打开 KPanel