ओपन-सोर्स LLM होस्टिंग
उस हार्डवेयर पर Llama, Mistral, Gemma, Qwen और समान मॉडल चलाएं जिसे आप नियंत्रित करते हैं।
मॉडल
Llama परिवार, Mistral, Gemma, फाइन-ट्यून्ड वेरिएंट
GPU / AI कंप्यूट
ओपन-सोर्स LLM, कंप्यूटर विज़न, फाइन-ट्यूनिंग और एम्बेडिंग के लिए GPU कंप्यूट। लाइव मूल्य नीचे दिए गए हैं। GPU स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए सेटअप तत्काल नहीं होता।
GPU कंप्यूट
लाइव मूल्य, आज ऑर्डर करें
NVIDIA
RTX-श्रेणी के GPU
4 स्तर
Spark से Reactor तक
प्रति ऑर्डर
हाथ से प्रावधानित
API
प्रोविज़निंग + मॉनिटरिंग
पूरी ladder
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
Managed /माह: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
Managed /माह: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
Managed /माह: $7,420.00
सीमित, कमी होने पर reserve करें
आप इस पर क्या चलाएंगे
ये वे वर्कलोड हैं जिनके लिए GPU स्तर बनाए गए हैं। यदि आपका वर्कलोड मेल खाता है, तो उपयुक्त स्तर चुनें और उसे ऑर्डर करें।
उस हार्डवेयर पर Llama, Mistral, Gemma, Qwen और समान मॉडल चलाएं जिसे आप नियंत्रित करते हैं।
मॉडल
Llama परिवार, Mistral, Gemma, फाइन-ट्यून्ड वेरिएंट
इमेज क्लासिफिकेशन, ऑब्जेक्ट डिटेक्शन, सेगमेंटेशन। री-डिप्लॉय किए बिना उसी प्लेटफ़ॉर्म पर ट्रेनिंग और इन्फरेंस।
मॉडल
YOLO, SAM, कस्टम PyTorch / TensorFlow मॉडल
ओपन-बेस मॉडल पर LoRA / QLoRA फाइन-ट्यून। प्रति-घंटे बिलिंग का मतलब है कि आप केवल वास्तविक ट्रेनिंग समय के लिए भुगतान करते हैं।
मॉडल
LoRA, QLoRA, छोटे मॉडल पर पूर्ण फाइन-ट्यून
रिट्रीवल-ऑगमेंटेड जनरेशन पाइपलाइन के लिए स्केल पर एम्बेडिंग जनरेट करें। अपने वेक्टर DB से कनेक्ट करें।
मॉडल
sentence-transformers, BGE, e5, कस्टम एम्बेडर
Stable Diffusion, FLUX, Kandinsky। बैच-जनरेट करें या API एंडपॉइंट के रूप में एक्सपोज़ करें।
मॉडल
SD, SDXL, FLUX, ControlNet, कस्टम चेकपॉइंट
स्पीच-टू-टेक्स्ट, टेक्स्ट-टू-स्पीच, वॉइस क्लोनिंग। Whisper ट्रांसक्रिप्शन पाइपलाइन।
मॉडल
Whisper, Coqui, Bark, कस्टम TTS
अभी उपलब्ध
हमारी Cloud VPS लाइनअप एक-क्लिक इंस्टॉलर के रूप में JupyterHub चलाती है। CPU-बाउंड इन्फरेंस, छोटे मॉडल, एम्बेडिंग जनरेशन, बैच पाइपलाइन: सभी GPU का इंतज़ार किए बिना आज चलते हैं।
FAQ
दिखाए गए मूल्य पर आज कोई भी स्तर ऑर्डर करें। GPU स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है (Robot-श्रेणी का हार्डवेयर), इसलिए तत्काल स्व-प्रावधान के बजाय ऑर्डर और सुपुर्दगी के बीच एक छोटा समय लगता है। हम चेकआउट पर समय की पुष्टि करते हैं।
चार स्तरों में NVIDIA GPU: Spark एक RTX 4000 पर, और Forge, Foundry तथा Reactor बढ़ती सिस्टम मेमोरी के साथ RTX PRO 6000 पर। प्रत्येक स्तर अपना GPU, VRAM और RAM ऊपर दिए गए मूल्य ग्रिड में दर्शाता है।
सटीक डेटा-सेंटर स्थान की पुष्टि हम सौंपने से पहले आपके साथ करते हैं। स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए लॉन्च पर हम क्षेत्र और विवरण के बारे में पारदर्शी रहते हैं।
लाइव मासिक कीमतें इस पृष्ठ पर, प्रति स्तर, आपकी मुद्रा में हैं। अनमैनेज्ड और मैनेज्ड दोनों कीमतें दिखाई जाती हैं।
हां। JupyterHub वन-क्लिक इंस्टॉल के साथ Cloud VPS स्पिन करें। CPU-बाउंड LLM इन्फरेंस (छोटे मॉडल), एम्बेडिंग जनरेशन, बैच पाइपलाइन — सभी वहां आज चलते हैं। जब GPU आए तो कोड माइग्रेट करें, कोई पुनर्लेखन नहीं।
स्क्रैच से बड़े फाउंडेशन मॉडल ट्रेनिंग (हम फाइन-ट्यूनिंग और इन्फरेंस लक्षित कर रहे हैं, >$10M ट्रेनिंग-रन स्केल नहीं)। वेंडर समझौतों की आवश्यकता वाले क्लोज्ड-सोर्स प्रोप्राइटरी मॉडल। लॉन्च पर InfiniBand-स्केल मल्टी-GPU क्लस्टर की आवश्यकता वाली कोई भी चीज़ (मल्टी-GPU रोडमैप है, GA नहीं)।
स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए ऑर्डर और सुपुर्दगी के बीच एक छोटा समय लग सकता है। यह हमारी डेडिकेटेड और स्टोरेज सर्वर श्रृंखलाओं के समान ही मैन्युअल फुलफिलमेंट पथ है।
Kora GPU कंप्यूट उत्पाद को जानती है: हार्डवेयर, मूल्य निर्धारण, समर्थित फ्रेमवर्क और डिप्लॉय पैटर्न।
GPU / AI कंप्यूट
प्रति स्तर लाइव मासिक कीमतें, रूट एक्सेस। स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए सेटअप तत्काल नहीं होता।