Hosting LLM open source
Esegua Llama, Mistral, Gemma, Qwen e modelli simili su hardware che controlla.
Modelli
Famiglia Llama, Mistral, Gemma, varianti fine-tuned
GPU / Calcolo IA
Calcolo GPU per LLM open source, visione artificiale, fine-tuning ed embedding. Prezzi in tempo reale qui sotto. Lo stock di GPU viene assegnato per ordine e predisposto a mano, quindi l'attivazione non è immediata.
Calcolo GPU
Prezzi in tempo reale, ordina oggi
NVIDIA
GPU di classe RTX
4 livelli
Da Spark a Reactor
Per ordine
Predisposto a mano
API
Provisioning + monitoraggio
La scala completa
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
Gestito /mese: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
Gestito /mese: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
Gestito /mese: $7,420.00
Limitata, prenoti quando scarseggia
Cosa ci eseguira
Questi sono i carichi di lavoro per cui sono progettati i livelli GPU. Se il suo corrisponde, scelga il livello adatto e lo ordini.
Esegua Llama, Mistral, Gemma, Qwen e modelli simili su hardware che controlla.
Modelli
Famiglia Llama, Mistral, Gemma, varianti fine-tuned
Classificazione di immagini, rilevamento di oggetti, segmentazione. Training e inferenza sulla stessa piattaforma senza ridistribuire.
Modelli
YOLO, SAM, modelli personalizzati PyTorch / TensorFlow
Fine-tune LoRA / QLoRA su modelli base aperti. La fatturazione oraria significa che paga solo per il tempo di training effettivo.
Modelli
LoRA, QLoRA, fine-tune completi su modelli piu piccoli
Generi embedding su larga scala per pipeline di generazione aumentata dal recupero. Si connetta al Suo database vettoriale.
Modelli
sentence-transformers, BGE, e5, embedder personalizzati
Stable Diffusion, FLUX, Kandinsky. Generazione batch o esposizione come endpoint API.
Modelli
SD, SDXL, FLUX, ControlNet, checkpoint personalizzati
Voce in testo, testo in voce, clonazione vocale. Pipeline di trascrizione Whisper.
Modelli
Whisper, Coqui, Bark, TTS personalizzato
Disponibile adesso
La nostra gamma Cloud VPS esegue JupyterHub come installatore con un clic. Inferenza LLM su CPU, modelli piu piccoli, generazione di embedding, pipeline batch, tutto funziona oggi senza aspettare la GPU.
FAQ
Ordini oggi qualsiasi livello al prezzo indicato. Lo stock di GPU viene assegnato per ordine e predisposto a mano (hardware di classe Robot), quindi c'è un breve tempo di attesa tra l'ordine e la consegna anziché un provisioning automatico immediato. Confermiamo i tempi al checkout.
GPU NVIDIA su quattro livelli: Spark su una RTX 4000 e Forge, Foundry e Reactor sulla RTX PRO 6000 con memoria di sistema crescente. Ogni livello indica la sua GPU, la sua VRAM e la sua RAM nella griglia dei prezzi qui sopra.
Confermiamo con lei l'esatta posizione del data center prima della consegna. Lo stock viene assegnato per ordine e predisposto a mano, quindi siamo trasparenti su regione e dettagli al lancio.
I prezzi mensili in tempo reale sono su questa pagina, per livello, nella sua valuta. Vengono mostrati sia i prezzi non gestiti sia quelli gestiti.
Si. Avvii un Cloud VPS con JupyterHub installato con un clic. Inferenza LLM su CPU (modelli piu piccoli), generazione di embedding, pipeline batch, tutto funziona li oggi. Quando arriva la GPU, migra il codice, senza riscrittura.
Training di grandi modelli di base da zero (stiamo puntando al fine-tuning e all'inferenza, non alla scala di training run da oltre 10 M$). Modelli proprietari a codice chiuso che richiedono accordi con i fornitori. Qualsiasi cosa richieda cluster multi-GPU a scala InfiniBand al lancio (il multi-GPU e nella roadmap, non in disponibilita generale).
Lo stock viene assegnato per ordine e predisposto a mano, quindi può esserci un breve tempo di attesa tra l'ordine e la consegna. È lo stesso percorso di provisioning manuale delle nostre linee di server dedicati e di storage.
Kora conosce il prodotto di calcolo GPU: l'hardware, i prezzi, i framework supportati e i pattern di deploy.
GPU / Calcolo IA
Prezzi mensili in tempo reale per livello, accesso root. Lo stock viene assegnato per ordine e predisposto a mano, quindi l'attivazione non è immediata.