GPU / AI कंप्यूट

GPU, अब उपलब्ध।
असली वाले, लाइव कीमत पर।

ओपन-सोर्स LLM, कंप्यूटर विज़न, फाइन-ट्यूनिंग और एम्बेडिंग के लिए GPU कंप्यूट। लाइव मूल्य नीचे दिए गए हैं। GPU स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए सेटअप तत्काल नहीं होता।

आज ऑर्डर करें, प्रति ऑर्डर आवंटित आपकी मुद्रा में लाइव कीमत रूट एक्सेस और पूर्ण नियंत्रण
kpanel.kapsulecloud.com/compute

GPU कंप्यूट

लाइव मूल्य, आज ऑर्डर करें

हार्डवेयर स्पेकपुष्टि
पूर्व-स्थापित AI स्टैकपुष्टि
API + KPanel इंटरफ़ेसपुष्टि
मूल्य निर्धारण मॉडलप्रति-घंटा पुष्टि
लाइव कीमतपुष्टि
GDPR-अनुरूप डेटा प्रबंधनपुष्टि
ईमानदार संकेत: स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है।

NVIDIA

RTX-श्रेणी के GPU

4 स्तर

Spark से Reactor तक

प्रति ऑर्डर

हाथ से प्रावधानित

API

प्रोविज़निंग + मॉनिटरिंग

लक्षित वर्कलोडओपन-सोर्स LLM इन्फरेंस·कंप्यूटर विज़न·फाइन-ट्यूनिंग·एम्बेडिंग पाइपलाइन·डिफ्यूजन मॉडल·ऑडियो / स्पीच मॉडल

पूरी ladder

हर tier, unmanaged और managed

Spark

$330.00Unmanaged /माह

NVIDIA RTX 4000 · 20 GB VRAM

Managed /माह: $750.00

शुरू करें

Forge

$1,680.00Unmanaged /माह

NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM

Managed /माह: $3,850.00

शुरू करें

Foundry

$2,520.00Unmanaged /माह

NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM

Managed /माह: $5,770.00

शुरू करें

Reactor

$3,240.00Unmanaged /माह

NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM

Managed /माह: $7,420.00

शुरू करें

सीमित, कमी होने पर reserve करें

आप इस पर क्या चलाएंगे

वे वर्कलोड जिन्हें हम लक्षित कर रहे हैं।

ये वे वर्कलोड हैं जिनके लिए GPU स्तर बनाए गए हैं। यदि आपका वर्कलोड मेल खाता है, तो उपयुक्त स्तर चुनें और उसे ऑर्डर करें।

ओपन-सोर्स LLM होस्टिंग

उस हार्डवेयर पर Llama, Mistral, Gemma, Qwen और समान मॉडल चलाएं जिसे आप नियंत्रित करते हैं।

मॉडल

Llama परिवार, Mistral, Gemma, फाइन-ट्यून्ड वेरिएंट

कंप्यूटर विज़न

इमेज क्लासिफिकेशन, ऑब्जेक्ट डिटेक्शन, सेगमेंटेशन। री-डिप्लॉय किए बिना उसी प्लेटफ़ॉर्म पर ट्रेनिंग और इन्फरेंस।

मॉडल

YOLO, SAM, कस्टम PyTorch / TensorFlow मॉडल

फाइन-ट्यूनिंग

ओपन-बेस मॉडल पर LoRA / QLoRA फाइन-ट्यून। प्रति-घंटे बिलिंग का मतलब है कि आप केवल वास्तविक ट्रेनिंग समय के लिए भुगतान करते हैं।

मॉडल

LoRA, QLoRA, छोटे मॉडल पर पूर्ण फाइन-ट्यून

एम्बेडिंग + RAG

रिट्रीवल-ऑगमेंटेड जनरेशन पाइपलाइन के लिए स्केल पर एम्बेडिंग जनरेट करें। अपने वेक्टर DB से कनेक्ट करें।

मॉडल

sentence-transformers, BGE, e5, कस्टम एम्बेडर

डिफ्यूजन / इमेज-जेन

Stable Diffusion, FLUX, Kandinsky। बैच-जनरेट करें या API एंडपॉइंट के रूप में एक्सपोज़ करें।

मॉडल

SD, SDXL, FLUX, ControlNet, कस्टम चेकपॉइंट

ऑडियो / स्पीच

स्पीच-टू-टेक्स्ट, टेक्स्ट-टू-स्पीच, वॉइस क्लोनिंग। Whisper ट्रांसक्रिप्शन पाइपलाइन।

मॉडल

Whisper, Coqui, Bark, कस्टम TTS

अभी उपलब्ध

आज कंप्यूट चाहिए? Cloud VPS + JupyterHub उपयोग करें।

हमारी Cloud VPS लाइनअप एक-क्लिक इंस्टॉलर के रूप में JupyterHub चलाती है। CPU-बाउंड इन्फरेंस, छोटे मॉडल, एम्बेडिंग जनरेशन, बैच पाइपलाइन: सभी GPU का इंतज़ार किए बिना आज चलते हैं।

  • किसी भी Cloud VPS टियर पर वन-क्लिक JupyterHub इंस्टॉल
  • $35.00/माह Comet (2 vCPU, 4 GB) से $440.00/माह Nova (16 डेडिकेटेड vCPU, 64 GB) तक
  • प्रति-घंटे बिलिंग, NVMe Gen4 स्टोरेज, रूट SSH
  • लॉन्च पर GPU कंप्यूट में माइग्रेट करें, आपका कोड पहले से चलता है

FAQ

अक्सर पूछे जाने वाले प्रश्न

मुझे GPU बॉक्स कितनी जल्दी मिल सकता है?+

दिखाए गए मूल्य पर आज कोई भी स्तर ऑर्डर करें। GPU स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है (Robot-श्रेणी का हार्डवेयर), इसलिए तत्काल स्व-प्रावधान के बजाय ऑर्डर और सुपुर्दगी के बीच एक छोटा समय लगता है। हम चेकआउट पर समय की पुष्टि करते हैं।

आप किस हार्डवेयर का उपयोग करेंगे?+

चार स्तरों में NVIDIA GPU: Spark एक RTX 4000 पर, और Forge, Foundry तथा Reactor बढ़ती सिस्टम मेमोरी के साथ RTX PRO 6000 पर। प्रत्येक स्तर अपना GPU, VRAM और RAM ऊपर दिए गए मूल्य ग्रिड में दर्शाता है।

GPU कहाँ स्थित हैं?+

सटीक डेटा-सेंटर स्थान की पुष्टि हम सौंपने से पहले आपके साथ करते हैं। स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए लॉन्च पर हम क्षेत्र और विवरण के बारे में पारदर्शी रहते हैं।

मूल्य निर्धारण के बारे में क्या?+

लाइव मासिक कीमतें इस पृष्ठ पर, प्रति स्तर, आपकी मुद्रा में हैं। अनमैनेज्ड और मैनेज्ड दोनों कीमतें दिखाई जाती हैं।

क्या मैं इंतज़ार करते हुए आज कुछ उपयोगी कर सकता/सकती हूं?+

हां। JupyterHub वन-क्लिक इंस्टॉल के साथ Cloud VPS स्पिन करें। CPU-बाउंड LLM इन्फरेंस (छोटे मॉडल), एम्बेडिंग जनरेशन, बैच पाइपलाइन — सभी वहां आज चलते हैं। जब GPU आए तो कोड माइग्रेट करें, कोई पुनर्लेखन नहीं।

कौन से वर्कलोड उपयुक्त नहीं हैं?+

स्क्रैच से बड़े फाउंडेशन मॉडल ट्रेनिंग (हम फाइन-ट्यूनिंग और इन्फरेंस लक्षित कर रहे हैं, >$10M ट्रेनिंग-रन स्केल नहीं)। वेंडर समझौतों की आवश्यकता वाले क्लोज्ड-सोर्स प्रोप्राइटरी मॉडल। लॉन्च पर InfiniBand-स्केल मल्टी-GPU क्लस्टर की आवश्यकता वाली कोई भी चीज़ (मल्टी-GPU रोडमैप है, GA नहीं)।

GPU स्टॉक कैसे आवंटित किया जाता है?+

स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए ऑर्डर और सुपुर्दगी के बीच एक छोटा समय लग सकता है। यह हमारी डेडिकेटेड और स्टोरेज सर्वर श्रृंखलाओं के समान ही मैन्युअल फुलफिलमेंट पथ है।

क्या Kora GPU वर्कलोड में मेरी मदद करना जानेगी?+

Kora GPU कंप्यूट उत्पाद को जानती है: हार्डवेयर, मूल्य निर्धारण, समर्थित फ्रेमवर्क और डिप्लॉय पैटर्न।

GPU / AI कंप्यूट

आज ही एक GPU बॉक्स शुरू करें।

प्रति स्तर लाइव मासिक कीमतें, रूट एक्सेस। स्टॉक प्रत्येक ऑर्डर के अनुसार आवंटित किया जाता है और हाथ से प्रावधानित किया जाता है, इसलिए सेटअप तत्काल नहीं होता।