GPU / Calcolo IA

GPU, disponibili.
Reali, con prezzi in tempo reale.

Calcolo GPU per LLM open source, visione artificiale, fine-tuning ed embedding. Prezzi in tempo reale qui sotto. Lo stock di GPU viene assegnato per ordine e predisposto a mano, quindi l'attivazione non è immediata.

Ordini oggi, assegnato per ordine Prezzi in tempo reale nella sua valuta Accesso root e controllo completo
kpanel.kapsulecloud.com/compute

Calcolo GPU

Prezzi in tempo reale, ordina oggi

Specifiche hardwareConfermato
Stack IA preinstallatiConfermato
Superficie API + KPanelConfermato
Modello di prezziOrario confermato
Prezzi in tempo realeConfermato
Gestione dei dati conforme al GDPRConfermato
Segnale onesto: lo stock viene assegnato per ordine e predisposto a mano.

NVIDIA

GPU di classe RTX

4 livelli

Da Spark a Reactor

Per ordine

Predisposto a mano

API

Provisioning + monitoraggio

Carichi di lavoro targetInferenza LLM open source·Visione artificiale·Fine-tuning·Pipeline di embedding·Modelli di diffusione·Modelli audio / vocali

La scala completa

Ogni livello, non gestito e gestito

Spark

$330.00Non gestito /mese

NVIDIA RTX 4000 · 20 GB VRAM

Gestito /mese: $750.00

Inizia

Forge

$1,680.00Non gestito /mese

NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM

Gestito /mese: $3,850.00

Inizia

Foundry

$2,520.00Non gestito /mese

NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM

Gestito /mese: $5,770.00

Inizia

Reactor

$3,240.00Non gestito /mese

NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM

Gestito /mese: $7,420.00

Inizia

Limitata, prenoti quando scarseggia

Cosa ci eseguira

Carichi di lavoro che stiamo prendendo di mira.

Questi sono i carichi di lavoro per cui sono progettati i livelli GPU. Se il suo corrisponde, scelga il livello adatto e lo ordini.

Hosting LLM open source

Esegua Llama, Mistral, Gemma, Qwen e modelli simili su hardware che controlla.

Modelli

Famiglia Llama, Mistral, Gemma, varianti fine-tuned

Visione artificiale

Classificazione di immagini, rilevamento di oggetti, segmentazione. Training e inferenza sulla stessa piattaforma senza ridistribuire.

Modelli

YOLO, SAM, modelli personalizzati PyTorch / TensorFlow

Fine-tuning

Fine-tune LoRA / QLoRA su modelli base aperti. La fatturazione oraria significa che paga solo per il tempo di training effettivo.

Modelli

LoRA, QLoRA, fine-tune completi su modelli piu piccoli

Embedding + RAG

Generi embedding su larga scala per pipeline di generazione aumentata dal recupero. Si connetta al Suo database vettoriale.

Modelli

sentence-transformers, BGE, e5, embedder personalizzati

Diffusione / generazione di immagini

Stable Diffusion, FLUX, Kandinsky. Generazione batch o esposizione come endpoint API.

Modelli

SD, SDXL, FLUX, ControlNet, checkpoint personalizzati

Audio / voce

Voce in testo, testo in voce, clonazione vocale. Pipeline di trascrizione Whisper.

Modelli

Whisper, Coqui, Bark, TTS personalizzato

Disponibile adesso

Ha bisogno di calcolo oggi? Usi Cloud VPS + JupyterHub.

La nostra gamma Cloud VPS esegue JupyterHub come installatore con un clic. Inferenza LLM su CPU, modelli piu piccoli, generazione di embedding, pipeline batch, tutto funziona oggi senza aspettare la GPU.

  • Installazione JupyterHub con un clic su qualsiasi livello Cloud VPS
  • Da $35.00/mese Comet (2 vCPU, 4 GB) a $440.00/mese Nova (16 vCPU dedicati, 64 GB)
  • Fatturazione oraria, storage NVMe Gen4, SSH root
  • Migri al calcolo GPU al lancio, il Suo codice funziona gia

FAQ

Domande frequenti

Quanto velocemente posso ottenere una box GPU?+

Ordini oggi qualsiasi livello al prezzo indicato. Lo stock di GPU viene assegnato per ordine e predisposto a mano (hardware di classe Robot), quindi c'è un breve tempo di attesa tra l'ordine e la consegna anziché un provisioning automatico immediato. Confermiamo i tempi al checkout.

Quale hardware userete?+

GPU NVIDIA su quattro livelli: Spark su una RTX 4000 e Forge, Foundry e Reactor sulla RTX PRO 6000 con memoria di sistema crescente. Ogni livello indica la sua GPU, la sua VRAM e la sua RAM nella griglia dei prezzi qui sopra.

Dove si trovano le GPU?+

Confermiamo con lei l'esatta posizione del data center prima della consegna. Lo stock viene assegnato per ordine e predisposto a mano, quindi siamo trasparenti su regione e dettagli al lancio.

E i prezzi?+

I prezzi mensili in tempo reale sono su questa pagina, per livello, nella sua valuta. Vengono mostrati sia i prezzi non gestiti sia quelli gestiti.

Posso fare qualcosa di utile oggi mentre aspetto?+

Si. Avvii un Cloud VPS con JupyterHub installato con un clic. Inferenza LLM su CPU (modelli piu piccoli), generazione di embedding, pipeline batch, tutto funziona li oggi. Quando arriva la GPU, migra il codice, senza riscrittura.

Per quali carichi di lavoro non e adatto?+

Training di grandi modelli di base da zero (stiamo puntando al fine-tuning e all'inferenza, non alla scala di training run da oltre 10 M$). Modelli proprietari a codice chiuso che richiedono accordi con i fornitori. Qualsiasi cosa richieda cluster multi-GPU a scala InfiniBand al lancio (il multi-GPU e nella roadmap, non in disponibilita generale).

Come viene assegnato lo stock di GPU?+

Lo stock viene assegnato per ordine e predisposto a mano, quindi può esserci un breve tempo di attesa tra l'ordine e la consegna. È lo stesso percorso di provisioning manuale delle nostre linee di server dedicati e di storage.

Kora sapra aiutarmi con i carichi di lavoro GPU?+

Kora conosce il prodotto di calcolo GPU: l'hardware, i prezzi, i framework supportati e i pattern di deploy.

GPU / Calcolo IA

Avvii una box GPU oggi stesso.

Prezzi mensili in tempo reale per livello, accesso root. Lo stock viene assegnato per ordine e predisposto a mano, quindi l'attivazione non è immediata.