Servidores en la nube

Descripción general de servidores GPU

GPU servers are single-tenant bare-metal machines fitted with NVIDIA accelerators, sized for AI training, inference, and rendering. This guide covers the four tiers, how ordering and delivery…

Los servidores GPU son máquinas bare-metal de un solo inquilino equipadas con aceleradores NVIDIA, dimensionadas para entrenamiento de IA, inferencia y renderizado. Esta guía cubre los cuatro niveles, cómo funciona realmente el pedido y la entrega, qué cubre la tarifa de configuración y cómo gestionar una máquina GPU una vez que esté en funcionamiento.

Qué es un servidor GPU

Un servidor GPU es una máquina física dedicada con una o más GPU NVIDIA, más la CPU, memoria del sistema y almacenamiento rápido necesarios para mantenerlas alimentadas. La máquina completa es tuya: nadie más está compartiendo los aceleradores, el ancho de banda PCIe ni los discos.

Instalas tu propia pila y la ejecutas como quieras. Las cargas de trabajo CUDA, PyTorch, TensorFlow, JAX y los marcos de servicio habituales funcionan exactamente como lo harían en cualquier caja Linux bare-metal, porque eso es lo que es.

La razón para querer tenencia única aquí no es solo el rendimiento. Las cargas de trabajo de GPU tienden a ejecutarse al máximo durante horas, y los aceleradores compartidos se comportan de manera muy diferente bajo ese tipo de carga sostenida que bajo un benchmark.

Los cuatro niveles

NivelGPUMemoria GPURAM del sistema
SparkNVIDIA RTX 400020 GBConfiguración de entrada
ForgeNVIDIA RTX PRO 600096 GB256 GB
FoundryNVIDIA RTX PRO 600096 GB512 GB
ReactorNVIDIA RTX PRO 600096 GB768 GB

Spark es el punto de entrada: memoria GPU suficiente para modelos más pequeños, ajuste fino, inferencia y trabajo de renderizado. Forge, Foundry y Reactor comparten el mismo acelerador y aumentan la memoria del sistema a su alrededor, que es lo que importa cuando estás preparando grandes conjuntos de datos o manteniendo varios modelos en la memoria del host.

Cada nivel se vende tanto sin gestionar como gestionado. Sin gestionar te entrega root y te deja el sistema operativo. Gestionado mantiene el mismo hardware con nuestros ingenieros en la capa de software. Consulta Servidores en la nube gestionados vs sin gestionar.

Para precios en vivo en tu propia moneda, abre Store en KPanel, luego la tarjeta GPU Compute.

Elegir un nivel

Comienza por el modelo, no por el precio.

  • ¿Cuánta memoria GPU necesita tu modelo en la forma que lo estás ejecutando? Esta es la restricción dura. Si los pesos más las activaciones no caben, ninguna cantidad de RAM del sistema ayuda.
  • ¿Estás entrenando o sirviendo? El entrenamiento consume mucha memoria y es de larga duración. La inferencia a menudo está limitada por la rapidez con que puedas obtener datos en la GPU, que es donde la RAM del sistema y el disco importan más.
  • ¿Qué tan grande es tu conjunto de trabajo? Si estás transmitiendo un conjunto de datos que no cabe en la memoria del host, las configuraciones Foundry y Reactor existen exactamente para esa razón.

Si no estás seguro, cuéntanos qué estás ejecutando, el tamaño del modelo, el marco y cuánta memoria GPU crees que necesitas. Te señalaremos el nivel correcto en lugar de dejarte comprar en exceso. GPU and AI Compute Servers tiene más sobre el lado de la carga de trabajo.

Cómo funciona realmente el pedido

El hardware GPU es escaso y caro, por lo que el proceso deliberadamente no es de un clic.

  1. Inicia sesión en KPanel.
  2. Haz clic en Store en la barra lateral izquierda.
  3. En Servers, haz clic en la tarjeta GPU Compute.
  4. Cambia entre Unmanaged y Managed, y elige un nivel.
  5. Completa el pago.

Niveles de servidor GPU en KPanel

Después del pago recibes un email de confirmación de pedido, y nuestro equipo confirma la capacidad actual y la construcción antes de que se asigne hardware para ti.

Un servidor GPU no se aprovisiona en el momento en que pagas. Nuestro equipo confirma primero la capacidad, y no publicamos un tiempo de entrega fijo porque la disponibilidad cambia. Si una fecha límite es importante, pregúntanos sobre el nivel que deseas antes de hacer el pedido en lugar de después.

Escucharás de nosotros de una forma u otra. Si has pagado y no has recibido un seguimiento que esperabas, responde al email de confirmación o abre un ticket desde Support y te diremos exactamente dónde se encuentra el pedido.

Tarifa de configuración y facturación

Los servidores GPU llevan una tarifa de configuración única además del precio mensual, en común con servidores dedicados y de almacenamiento, porque se construye y entrega una máquina física. Los servidores en la nube no llevan tarifa de configuración.

La tarifa de configuración se cobra una vez, nunca se repite, y se muestra por separado del precio mensual al momento del pago.

Los precios se muestran sin incluir GST. Si tu moneda de cuenta es NZD, se añade el 15 por ciento de GST al momento del pago y aparece en el total del botón de pago. Consulta Cloud Server Pricing and GST.

Porque un nivel GPU es un compromiso mensual en hardware caro en lugar de un alquiler por hora, toma la decisión en consecuencia. Si solo necesitas una GPU para una ráfaga corta, dilo cuando hables con nosotros.

Reservar un nivel

Cuando un nivel no tiene capacidad, la tarjeta de plan ofrece una reserva en lugar de una acción de configuración. Unirte a la cola registra tu interés en ese nivel.

Una reserva es un lugar en una cola, no una construcción programada, y no nos comprometemos con un tiempo de espera. Tampoco hay un botón de cancelación de autoservicio: si ya no deseas una reserva, ponte en contacto con soporte y la eliminaremos.

Gestionar un servidor GPU

Una vez que una máquina GPU está en vivo, se gestiona exactamente como cualquier otro servidor bare-metal, desde Dedicated Servers en la barra lateral de KPanel. No hay un elemento GPU separado en la barra lateral.

El conjunto de herramientas, documentado completamente en Managing a Dedicated Server, cubre:

  • Power: reinicio elegante, reinicio de hardware, ciclo de energía forzado y Wake-on-LAN.
  • Rescue system: un entorno Linux temporal, o una consola virtual basada en navegador.
  • Reverse DNS: registros PTR para cada IP enrutada.
  • IPs and subnets: lo que se enruta a la máquina, más IPv4 adicional.
  • Traffic: volumen de entrada y salida por día, mes o año.
  • Firewall: un filtro ascendente aplicado antes de que el tráfico llegue a la máquina.
  • Advanced: una reinstalación completa del sistema operativo, detrás de una confirmación escrita.

El acceso a la consola para una máquina que no arrancará está en Dedicated Server Console Access.

Notas prácticas antes de comenzar

Los drivers son responsabilidad tuya en una máquina sin gestionar. Instala el driver NVIDIA y la pila CUDA que coincida con las versiones de marco que tienes la intención de ejecutar, y fíjalas. Las versiones de driver y toolkit que no coinciden son la causa más común de una GPU que está presente pero no se puede usar.

Vigila tu disco. Los puntos de control de modelos y los conjuntos de datos llenan un disco más rápido que cualquier otra cosa en un servidor. Si la capacidad es tu verdadero problema en lugar de la computación, un servidor de almacenamiento junto a la máquina GPU es generalmente más barato que un nivel GPU más grande.

Firepwall apropiadamente. Una caja GPU ejecutando un punto de conexión de inferencia es un objetivo atractivo. Usa el firewall ascendente para permitir solo lo que necesita llegar a él, y mantén Allow platform services activado para que no te bloquees a ti mismo.

Reinstalar borra todo. La acción de reinstalación bajo Advanced borra todos los discos sin deshacer ni hace copias de seguridad para ti. Copia tus puntos de control primero.

Obtener ayuda

GPU es el producto donde hablar con nosotros primero ahorra más dinero. Pregunta a Kora dentro de KPanel, abre un ticket desde Support, o envía un email a support@kapsulehost.com con lo que estás ejecutando y cuánta memoria GPU necesitas.

Para el resto del rango de computación, consulta Cloud Servers Overview y Dedicated Servers Overview.

¿Aún necesitas ayuda?

Envíanos un correo electrónico a support@kapsulehost.com o abre un chat en KPanel.

Abrir KPanel
Descripción general de servidores GPU