GPU / Cómputo IA

GPU, ya disponibles.
Reales, con precios en directo.

Cómputo GPU para LLM de código abierto, visión artificial, ajuste fino e incrustaciones. Precios en directo abajo. El stock de GPU se asigna por pedido y se aprovisiona a mano, por lo que la puesta en marcha no es instantánea.

Pida hoy, asignado por pedido Precios en directo en su moneda Acceso root y control total
kpanel.kapsulecloud.com/compute

Cómputo GPU

Precios en directo, pida hoy

Especificación hardwareConfirmado
Stacks de IA preinstaladosConfirmado
Superficie API + KPanelConfirmado
Modelo de preciosPor hora confirmado
Precios en directoConfirmado
Tratamiento de datos conforme al RGPDConfirmado
Señal honesta: el stock se asigna por pedido y se aprovisiona a mano.

NVIDIA

GPU de clase RTX

4 niveles

De Spark a Reactor

Por pedido

Aprovisionado a mano

API

Aprovisionamiento + supervision

Cargas de trabajo objetivoInferencia de LLM de codigo abierto·Vision artificial·Ajuste fino·Canalizaciones de incrustaciones·Modelos de difusion·Modelos de audio / voz

La escala completa

Todos los niveles, no gestionados y gestionados

Spark

$330.00No gestionado /mes

NVIDIA RTX 4000 · 20 GB VRAM

Gestionado /mes: $750.00

Empezar

Forge

$1,680.00No gestionado /mes

NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM

Gestionado /mes: $3,850.00

Empezar

Foundry

$2,520.00No gestionado /mes

NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM

Gestionado /mes: $5,770.00

Empezar

Reactor

$3,240.00No gestionado /mes

NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM

Gestionado /mes: $7,420.00

Empezar

Limitado, reserve cuando escasee

En que lo usara

Cargas de trabajo que estamos desarrollando.

Estas son las cargas de trabajo para las que están diseñados los niveles de GPU. Si la suya coincide, elija el nivel que se ajuste y pídalo.

Alojamiento de LLM de codigo abierto

Ejecute Llama, Mistral, Gemma, Qwen y modelos similares en hardware que controla.

Modelos

Familia Llama, Mistral, Gemma, variantes ajustadas

Vision artificial

Clasificacion de imagenes, deteccion de objetos, segmentacion. Entrenamiento e inferencia en la misma plataforma sin volver a desplegar.

Modelos

YOLO, SAM, modelos personalizados de PyTorch / TensorFlow

Ajuste fino

Ajustes finos LoRA / QLoRA en modelos base abiertos. La facturación por hora significa que solo paga por el tiempo de entrenamiento real.

Modelos

LoRA, QLoRA, ajustes finos completos en modelos más pequenos

Incrustaciones + RAG

Genere incrustaciones a escala para canalizaciones de generación aumentada por recuperacion. Conectese a su base de datos vectorial.

Modelos

sentence-transformers, BGE, e5, incrustadores personalizados

Difusion / generación de imagenes

Stable Diffusion, FLUX, Kandinsky. Genere por lotes o exponga como punto de conexión de API.

Modelos

SD, SDXL, FLUX, ControlNet, puntos de control personalizados

Audio / voz

Voz a texto, texto a voz, clonacion de voz. Canalizaciones de transcripcion con Whisper.

Modelos

Whisper, Coqui, Bark, TTS personalizado

Disponible ahora mismo

Necesita computo hoy? Use Cloud VPS + JupyterHub.

Nuestra gama de Cloud VPS ejecuta JupyterHub como instalador con un clic. Inferencia de LLM con CPU, modelos más pequenos, generación de incrustaciones, canalizaciones por lotes, todo funciona hoy sin esperar a la GPU.

  • Instalacion de JupyterHub con un clic en cualquier nivel de Cloud VPS
  • Desde $35.00/mes Comet (2 vCPU, 4 GB) hasta $440.00/mes Nova (16 vCPU dedicados, 64 GB)
  • Facturación por hora, almacenamiento NVMe Gen4, SSH root
  • Migre al computo GPU en el lanzamiento, su codigo ya funciona

Preguntas frecuentes

Preguntas frecuentes

¿Con qué rapidez puedo obtener una caja GPU?+

Pida hoy cualquier nivel al precio mostrado. El stock de GPU se asigna por pedido y se aprovisiona a mano (hardware de clase Robot), por lo que hay un breve tiempo de espera entre el pedido y la entrega en lugar de un aprovisionamiento automático instantáneo. Confirmamos los plazos al pagar.

Que hardware usaran?+

GPU NVIDIA en cuatro niveles: Spark en una RTX 4000, y Forge, Foundry y Reactor en la RTX PRO 6000 con memoria de sistema creciente. Cada nivel indica su GPU, su VRAM y su RAM en la tabla de precios de arriba.

¿Dónde se ubican las GPU?+

Confirmamos con usted la ubicación exacta del centro de datos antes de la entrega. El stock se asigna por pedido y se aprovisiona a mano, por lo que somos transparentes sobre la región y los detalles en el lanzamiento.

Y los precios?+

Los precios mensuales en directo están en esta página, por nivel, en su moneda. Se muestran tanto los precios no gestionados como los gestionados.

Puedo hacer algo util hoy mientras espero?+

Si. Ponga en marcha un Cloud VPS con JupyterHub instalado con un clic. Inferencia de LLM con CPU (modelos más pequenos), generación de incrustaciones, canalizaciones por lotes, todo funciona alli hoy. Cuando llegue la GPU, migre el codigo, sin necesidad de reescritura.

Para que cargas de trabajo no es adecuado?+

Entrenamiento de grandes modelos de base desde cero (estamos apuntando al ajuste fino y la inferencia, no a la escala de ejecuciones de entrenamiento de más de 10 millones de dolares). Modelos propietarios de codigo cerrado que requieren acuerdos con proveedores. Cualquier cosa que requiera clusters multi-GPU a escala InfiniBand en el lanzamiento (multi-GPU esta en la hoja de ruta, no en la disponibilidad general).

¿Cómo se asigna el stock de GPU?+

El stock se asigna por pedido y se aprovisiona a mano, por lo que puede haber un breve tiempo de espera entre el pedido y la entrega. Es la misma vía de aprovisionamiento manual que nuestras líneas de servidores dedicados y de almacenamiento.

Sabra Kora ayudarme con las cargas de trabajo de GPU?+

Kora conoce el producto de cómputo GPU: el hardware, los precios, los marcos compatibles y los patrones de despliegue.

GPU / Cómputo IA

Ponga en marcha una caja GPU hoy mismo.

Precios mensuales en directo por nivel, acceso root. El stock se asigna por pedido y se aprovisiona a mano, por lo que la puesta en marcha no es instantánea.