Alojamiento de LLM de codigo abierto
Ejecute Llama, Mistral, Gemma, Qwen y modelos similares en hardware que controla.
Modelos
Familia Llama, Mistral, Gemma, variantes ajustadas
GPU / Cómputo IA
Cómputo GPU para LLM de código abierto, visión artificial, ajuste fino e incrustaciones. Precios en directo abajo. El stock de GPU se asigna por pedido y se aprovisiona a mano, por lo que la puesta en marcha no es instantánea.
Cómputo GPU
Precios en directo, pida hoy
NVIDIA
GPU de clase RTX
4 niveles
De Spark a Reactor
Por pedido
Aprovisionado a mano
API
Aprovisionamiento + supervision
La escala completa
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
Gestionado /mes: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
Gestionado /mes: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
Gestionado /mes: $7,420.00
Limitado, reserve cuando escasee
En que lo usara
Estas son las cargas de trabajo para las que están diseñados los niveles de GPU. Si la suya coincide, elija el nivel que se ajuste y pídalo.
Ejecute Llama, Mistral, Gemma, Qwen y modelos similares en hardware que controla.
Modelos
Familia Llama, Mistral, Gemma, variantes ajustadas
Clasificacion de imagenes, deteccion de objetos, segmentacion. Entrenamiento e inferencia en la misma plataforma sin volver a desplegar.
Modelos
YOLO, SAM, modelos personalizados de PyTorch / TensorFlow
Ajustes finos LoRA / QLoRA en modelos base abiertos. La facturación por hora significa que solo paga por el tiempo de entrenamiento real.
Modelos
LoRA, QLoRA, ajustes finos completos en modelos más pequenos
Genere incrustaciones a escala para canalizaciones de generación aumentada por recuperacion. Conectese a su base de datos vectorial.
Modelos
sentence-transformers, BGE, e5, incrustadores personalizados
Stable Diffusion, FLUX, Kandinsky. Genere por lotes o exponga como punto de conexión de API.
Modelos
SD, SDXL, FLUX, ControlNet, puntos de control personalizados
Voz a texto, texto a voz, clonacion de voz. Canalizaciones de transcripcion con Whisper.
Modelos
Whisper, Coqui, Bark, TTS personalizado
Disponible ahora mismo
Nuestra gama de Cloud VPS ejecuta JupyterHub como instalador con un clic. Inferencia de LLM con CPU, modelos más pequenos, generación de incrustaciones, canalizaciones por lotes, todo funciona hoy sin esperar a la GPU.
Preguntas frecuentes
Pida hoy cualquier nivel al precio mostrado. El stock de GPU se asigna por pedido y se aprovisiona a mano (hardware de clase Robot), por lo que hay un breve tiempo de espera entre el pedido y la entrega en lugar de un aprovisionamiento automático instantáneo. Confirmamos los plazos al pagar.
GPU NVIDIA en cuatro niveles: Spark en una RTX 4000, y Forge, Foundry y Reactor en la RTX PRO 6000 con memoria de sistema creciente. Cada nivel indica su GPU, su VRAM y su RAM en la tabla de precios de arriba.
Confirmamos con usted la ubicación exacta del centro de datos antes de la entrega. El stock se asigna por pedido y se aprovisiona a mano, por lo que somos transparentes sobre la región y los detalles en el lanzamiento.
Los precios mensuales en directo están en esta página, por nivel, en su moneda. Se muestran tanto los precios no gestionados como los gestionados.
Si. Ponga en marcha un Cloud VPS con JupyterHub instalado con un clic. Inferencia de LLM con CPU (modelos más pequenos), generación de incrustaciones, canalizaciones por lotes, todo funciona alli hoy. Cuando llegue la GPU, migre el codigo, sin necesidad de reescritura.
Entrenamiento de grandes modelos de base desde cero (estamos apuntando al ajuste fino y la inferencia, no a la escala de ejecuciones de entrenamiento de más de 10 millones de dolares). Modelos propietarios de codigo cerrado que requieren acuerdos con proveedores. Cualquier cosa que requiera clusters multi-GPU a escala InfiniBand en el lanzamiento (multi-GPU esta en la hoja de ruta, no en la disponibilidad general).
El stock se asigna por pedido y se aprovisiona a mano, por lo que puede haber un breve tiempo de espera entre el pedido y la entrega. Es la misma vía de aprovisionamiento manual que nuestras líneas de servidores dedicados y de almacenamiento.
Kora conoce el producto de cómputo GPU: el hardware, los precios, los marcos compatibles y los patrones de despliegue.
GPU / Cómputo IA
Precios mensuales en directo por nivel, acceso root. El stock se asigna por pedido y se aprovisiona a mano, por lo que la puesta en marcha no es instantánea.