Açık kaynaklı LLM barındırma
Kontrol ettiğiniz donanımda Llama, Mistral, Gemma, Qwen ve benzer modelleri çalıştırın.
Modeller
Llama ailesi, Mistral, Gemma, ince ayarlı varyantlar
GPU / AI İşlem
Açık kaynaklı LLM'ler, bilgisayarlı görü, ince ayar ve gömme işlemleri için GPU hesaplaması. Canlı fiyatlar aşağıda. GPU stoğu her sipariş için ayrılır ve elle sağlanır, bu nedenle kurulum anında olmaz.
GPU Hesaplama
Canlı fiyatlar, bugün sipariş verin
NVIDIA
RTX sınıfı GPU'lar
4 katman
Spark'tan Reactor'a
Sipariş başına
Elle sağlanır
API
Hazırlama + izleme
Tam kademe
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
Yönetimli /ay: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
Yönetimli /ay: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
Yönetimli /ay: $7,420.00
Sınırlı, azaldığında rezerve edin
Üzerinde ne çalıştıracaksınız
Bunlar, GPU katmanlarının tasarlandığı iş yükleridir. Sizinki uyuyorsa, uygun katmanı seçip sipariş verin.
Kontrol ettiğiniz donanımda Llama, Mistral, Gemma, Qwen ve benzer modelleri çalıştırın.
Modeller
Llama ailesi, Mistral, Gemma, ince ayarlı varyantlar
Görüntü sınıflandırma, nesne tespiti, segmentasyon. Yeniden dağıtmadan aynı platformda eğitim ve çıkarım.
Modeller
YOLO, SAM, özel PyTorch / TensorFlow modelleri
Açık temel modellerde LoRA / QLoRA ince ayarları. Saatlik faturalandırma, yalnızca gerçek eğitim süresi için ödeme yaparsınız.
Modeller
LoRA, QLoRA, daha küçük modellerde tam ince ayar
Retrieval-augmented generation hatları için ölçekte gömmeler oluşturun. Vektör DB'nize bağlanın.
Modeller
sentence-transformers, BGE, e5, özel gömücüler
Stable Diffusion, FLUX, Kandinsky. Toplu oluşturma veya API uç noktası olarak sunma.
Modeller
SD, SDXL, FLUX, ControlNet, özel kontrol noktaları
Konuşmadan metne, metinden konuşmaya, ses klonlama. Whisper transkripsiyon hatları.
Modeller
Whisper, Coqui, Bark, özel TTS
Şu anda mevcut
Cloud VPS serimiz JupyterHub'ı tek tıkla yükleyici olarak çalıştırır. CPU'ya bağlı çıkarım, daha küçük modeller, gömme oluşturma, toplu hatlar: GPU'yu beklemeden bugün çalışır.
SSS
Herhangi bir katmanı bugün gösterilen fiyattan sipariş edin. GPU stoğu her sipariş için ayrılır ve elle sağlanır (Robot sınıfı donanım), bu nedenle anında kendi kendine sağlama yerine sipariş ile teslim arasında kısa bir hazırlık süresi olur. Zamanlamayı ödeme sırasında teyit ederiz.
Dört katmanda NVIDIA GPU'lar: Spark bir RTX 4000 üzerinde, Forge, Foundry ve Reactor ise artan sistem belleğiyle RTX PRO 6000 üzerinde. Her katman kendi GPU, VRAM ve RAM değerlerini yukarıdaki fiyat tablosunda gösterir.
Kesin veri merkezi konumunu teslimden önce sizinle teyit ederiz. Stok her sipariş için ayrılır ve elle sağlanır, bu nedenle lansmanda bölge ve ayrıntılar konusunda şeffaf davranırız.
Canlı aylık fiyatlar bu sayfada, katman başına, sizin para biriminizle yer alır. Hem yönetilmeyen hem de yönetilen fiyatlar gösterilir.
Evet. JupyterHub tek tıkla kurulu bir Cloud VPS başlatın. CPU'ya bağlı LLM çıkarımı (daha küçük modeller), gömme oluşturma, toplu hatlar, hepsi bugün orada çalışır. GPU geldiğinde kodu taşırsınız, yeniden yazmaya gerek yok.
Temel modelleri sıfırdan eğitmek (ince ayar ve çıkarımı hedefliyoruz, 10 milyon dolar üzeri eğitim çalışması ölçeğini değil). Satıcı anlaşmaları gerektiren kapalı kaynaklı özel modeller. Başlatıldığında InfiniBand ölçeğinde çok GPU kümelerini gerektiren her şey (çok GPU yol haritasında, GA'da değil).
Stok her sipariş için ayrılır ve elle sağlanır, bu nedenle sipariş ile teslim arasında kısa bir hazırlık süresi olabilir. Bu, ayrılmış ve depolama sunucusu hatlarımızla aynı elle karşılama yoludur.
Kora GPU hesaplama ürününü bilir: donanım, fiyatlandırma, desteklenen çerçeveler ve dağıtım modelleri.
GPU / AI İşlem
Katman başına canlı aylık fiyatlar, root erişimi. Stok her sipariş için ayrılır ve elle sağlanır, bu nedenle kurulum anında olmaz.