GPU / AI-вычисления

GPU уже доступны.
Настоящие, с ценами в реальном времени.

GPU-вычисления для open-source LLM, компьютерного зрения, дообучения и векторных представлений. Актуальные цены ниже. Запас GPU выделяется под каждый заказ и настраивается вручную, поэтому подготовка не мгновенная.

Закажите сегодня, выделяется под заказ Актуальные цены в вашей валюте Root-доступ и полный контроль
kpanel.kapsulecloud.com/compute

GPU-вычисления

Актуальные цены, закажите сегодня

Спецификация железаПодтверждено
Предустановленные AI-стекиПодтверждено
API + интерфейс KPanelПодтверждено
Модель ценообразованияПочасовая оплата подтверждена
Актуальные ценыПодтверждено
Обработка данных в соответствии с GDPRПодтверждено
Честный сигнал: запас выделяется под каждый заказ и настраивается вручную.

NVIDIA

GPU класса RTX

4 уровня

От Spark до Reactor

Под заказ

Настройка вручную

API

Подготовка + мониторинг

Целевые рабочие нагрузкиИнференс open-source LLM·Компьютерное зрение·Дообучение·Конвейеры векторных представлений·Модели диффузии·Модели аудио / речи

Вся лестница

Каждый уровень, без управления и с управлением

Spark

$330.00Без управления /мес

NVIDIA RTX 4000 · 20 GB VRAM

С управлением /мес: $750.00

Начать

Forge

$1,680.00Без управления /мес

NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM

С управлением /мес: $3,850.00

Начать

Foundry

$2,520.00Без управления /мес

NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM

С управлением /мес: $5,770.00

Начать

Reactor

$3,240.00Без управления /мес

NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM

С управлением /мес: $7,420.00

Начать

Ограниченно, бронируйте при нехватке

Что на этом запустить

Целевые рабочие нагрузки.

Это рабочие нагрузки, для которых созданы уровни GPU. Если ваша подходит, выберите подходящий уровень и закажите его.

Хостинг open-source LLM

Запускайте Llama, Mistral, Gemma, Qwen и подобные модели на оборудовании, которое вы контролируете.

Модели

Llama, Mistral, Gemma, дообученные варианты

Компьютерное зрение

Классификация изображений, обнаружение объектов, сегментация. Обучение и инференс на одной платформе без повторного развёртывания.

Модели

YOLO, SAM, кастомные модели PyTorch / TensorFlow

Дообучение

LoRA / QLoRA дообучение на open-source базовых моделях. Почасовая оплата — вы платите только за фактическое время обучения.

Модели

LoRA, QLoRA, полное дообучение на меньших моделях

Векторные представления + RAG

Генерация векторных представлений в масштабе для конвейеров RAG. Подключайтесь к своей векторной базе данных.

Модели

sentence-transformers, BGE, e5, кастомные энкодеры

Диффузия / генерация изображений

Stable Diffusion, FLUX, Kandinsky. Пакетная генерация или API-эндпоинт.

Модели

SD, SDXL, FLUX, ControlNet, кастомные чекпоинты

Аудио / речь

Речь-в-текст, текст-в-речь, клонирование голоса. Конвейеры транскрипции Whisper.

Модели

Whisper, Coqui, Bark, кастомные TTS

Доступно прямо сейчас

Нужны вычисления сегодня? Используйте Cloud VPS + JupyterHub.

В нашем Cloud VPS JupyterHub доступен как установщик в один клик. Инференс с привязкой к CPU, меньшие модели, генерация векторных представлений, пакетные конвейеры: всё работает уже сейчас без ожидания GPU.

  • Установка JupyterHub в один клик на любом тарифе Cloud VPS
  • От $35.00/мес Comet (2 vCPU, 4 ГБ) до $440.00/мес Nova (16 выделенных vCPU, 64 ГБ)
  • Почасовая оплата, NVMe Gen4-хранилище, root SSH
  • Переход на GPU-вычисления при запуске — ваш код уже работает

FAQ

Часто задаваемые вопросы

Как быстро я могу получить GPU-сервер?+

Закажите любой уровень сегодня по указанной цене. Запас GPU выделяется под каждый заказ и настраивается вручную (оборудование класса Robot), поэтому между заказом и передачей есть небольшой срок подготовки, а не мгновенная самостоятельная настройка. Сроки мы подтверждаем при оформлении.

Какое оборудование вы будете использовать?+

GPU NVIDIA на четырёх уровнях: Spark на RTX 4000, а Forge, Foundry и Reactor на RTX PRO 6000 с возрастающим объёмом системной памяти. Для каждого уровня в таблице цен выше указаны GPU, VRAM и RAM.

Где расположены GPU?+

Точное расположение дата-центра мы подтверждаем с вами до передачи. Запас выделяется под каждый заказ и настраивается вручную, поэтому при запуске мы прозрачно сообщаем регион и детали.

Как насчёт цен?+

Актуальные ежемесячные цены приведены на этой странице, по каждому уровню, в вашей валюте. Показаны цены как без управления, так и с управлением.

Можно ли сделать что-то полезное сегодня, пока жду?+

Да. Запустите Cloud VPS с установленным JupyterHub в один клик. Инференс LLM с привязкой к CPU (меньшие модели), генерация векторных представлений, пакетные конвейеры — всё работает уже сейчас. При выходе GPU просто переносите код — без переписывания.

Какие нагрузки не подходят?+

Обучение больших базовых моделей с нуля (мы ориентируемся на дообучение и инференс, а не на масштаб обучения >$10 млн). Закрытые проприетарные модели, требующие соглашений с поставщиком. Всё, требующее многоузловых кластеров масштаба InfiniBand при запуске (многоузловые GPU — в дорожной карте, не в GA).

Как выделяется запас GPU?+

Запас выделяется под каждый заказ и настраивается вручную, поэтому между заказом и передачей может быть небольшой срок подготовки. Это тот же путь ручной подготовки, что и для наших линеек выделенных серверов и серверов хранения.

Будет ли Kora помогать с GPU-нагрузками?+

Kora знает продукт GPU-вычислений: оборудование, цены, поддерживаемые фреймворки и схемы развёртывания.

GPU / AI-вычисления

Запустите GPU-сервер уже сегодня.

Актуальные ежемесячные цены по уровням, root-доступ. Запас выделяется под каждый заказ и настраивается вручную, поэтому подготовка не мгновенная.