Open-Source-LLM-Hosting
Betreiben Sie Llama, Mistral, Gemma, Qwen und ähnliche Modelle auf Hardware, die Sie kontrollieren.
Modelle
Llama-Familie, Mistral, Gemma, fine-tuned Varianten
GPU / KI-Compute
GPU-Compute für Open-Source-LLMs, Computer Vision, Fine-Tuning und Embeddings. Live-Preise unten. GPU-Bestand wird pro Bestellung zugeteilt und manuell bereitgestellt, daher ist die Einrichtung nicht sofort verfügbar.
GPU-Computing
Live-Preise, heute bestellen
NVIDIA
GPUs der RTX-Klasse
4 Stufen
Spark bis Reactor
Pro Bestellung
Manuell bereitgestellt
API
Bereitstellung + Monitoring
Die vollständige Leiter
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
Managed /Mon.: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
Managed /Mon.: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
Managed /Mon.: $7,420.00
Begrenzt, bei Knappheit reservieren
Was Sie darauf ausführen werden
Das sind die Workloads, für die die GPU-Stufen gebaut sind. Wenn Ihre dazu passt, wählen Sie die passende Stufe und bestellen Sie sie.
Betreiben Sie Llama, Mistral, Gemma, Qwen und ähnliche Modelle auf Hardware, die Sie kontrollieren.
Modelle
Llama-Familie, Mistral, Gemma, fine-tuned Varianten
Bildklassifizierung, Objekterkennung, Segmentierung. Training und Inferenz auf derselben Plattform ohne Neudeployment.
Modelle
YOLO, SAM, benutzerdefinierte PyTorch / TensorFlow-Modelle
LoRA / QLoRA-Fine-Tunes auf Open-Base-Modellen. Stundenweise Abrechnung bedeutet, dass Sie nur für die tatsächliche Trainingszeit zahlen.
Modelle
LoRA, QLoRA, vollständige Fine-Tunes auf kleineren Modellen
Embeddings in großem Maßstab generieren für Retrieval-Augmented-Generation-Pipelines. Mit Ihrer Vektordatenbank verbinden.
Modelle
sentence-transformers, BGE, e5, benutzerdefinierte Embedder
Stable Diffusion, FLUX, Kandinsky. Stapelweise generieren oder als API-Endpunkt bereitstellen.
Modelle
SD, SDXL, FLUX, ControlNet, benutzerdefinierte Checkpoints
Sprache-zu-Text, Text-zu-Sprache, Sprachklonierung. Whisper-Transkriptions-Pipelines.
Modelle
Whisper, Coqui, Bark, benutzerdefiniertes TTS
Jetzt verfügbar
Unsere Cloud VPS-Reihe betreibt JupyterHub als Ein-Klick-Installer. CPU-gebundene Inferenz, kleinere Modelle, Embedding-Generierung, Batch-Pipelines - alles läuft heute ohne auf GPU warten zu müssen.
FAQ
Bestellen Sie noch heute jede Stufe zum angezeigten Preis. GPU-Bestand wird pro Bestellung zugeteilt und manuell bereitgestellt (Hardware der Robot-Klasse), sodass zwischen Bestellung und Übergabe eine kurze Vorlaufzeit liegt statt einer sofortigen Selbstbereitstellung. Den Zeitpunkt bestätigen wir an der Kasse.
NVIDIA-GPUs in vier Stufen: Spark auf einer RTX 4000 sowie Forge, Foundry und Reactor auf der RTX PRO 6000 mit steigendem Systemspeicher. Jede Stufe listet ihre GPU, ihren VRAM und ihren RAM im Preisraster oben auf.
Den genauen Rechenzentrumsstandort bestätigen wir vor der Übergabe mit Ihnen. Der Bestand wird pro Bestellung zugeteilt und manuell bereitgestellt, daher informieren wir bei Markteinführung transparent über Region und Details.
Live-Monatspreise finden Sie auf dieser Seite, pro Stufe, in Ihrer Währung. Es werden sowohl unverwaltete als auch verwaltete Preise angezeigt.
Ja. Starten Sie einen Cloud VPS mit installiertem JupyterHub Ein-Klick. CPU-gebundene LLM-Inferenz (kleinere Modelle), Embedding-Generierung, Batch-Pipelines - alles läuft dort heute. Wenn GPU kommt, migrieren Sie den Code, kein Umschreiben.
Training großer Foundation-Modelle von Grund auf (wir zielen auf Fine-Tuning und Inferenz ab, nicht auf die >$10M Training-Run-Skala). Closed-Source-proprietäre Modelle, die Hersteller-Vereinbarungen erfordern. Alles, das InfiniBand-skalige Multi-GPU-Cluster bei Markteinführung erfordert (Multi-GPU ist Roadmap, nicht GA).
Der Bestand wird pro Bestellung zugeteilt und manuell bereitgestellt, sodass zwischen Bestellung und Übergabe eine kurze Vorlaufzeit liegen kann. Das ist derselbe manuelle Bereitstellungsweg wie bei unseren Dedicated- und Storage-Server-Linien.
Kora kennt das GPU-Compute-Produkt: die Hardware, die Preise, die unterstützten Frameworks und die Deployment-Muster.
GPU / KI-Compute
Live-Monatspreise pro Stufe, Root-Zugriff. Der Bestand wird pro Bestellung zugeteilt und manuell bereitgestellt, daher ist die Einrichtung nicht sofort verfügbar.