Хостинг open-source LLM
Запускайте Llama, Mistral, Gemma, Qwen и подобные модели на оборудовании, которое вы контролируете.
Модели
Llama, Mistral, Gemma, дообученные варианты
GPU / AI-вычисления
GPU-вычисления для open-source LLM, компьютерного зрения, дообучения и векторных представлений. Актуальные цены ниже. Запас GPU выделяется под каждый заказ и настраивается вручную, поэтому подготовка не мгновенная.
GPU-вычисления
Актуальные цены, закажите сегодня
NVIDIA
GPU класса RTX
4 уровня
От Spark до Reactor
Под заказ
Настройка вручную
API
Подготовка + мониторинг
Вся лестница
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
С управлением /мес: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
С управлением /мес: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
С управлением /мес: $7,420.00
Ограниченно, бронируйте при нехватке
Что на этом запустить
Это рабочие нагрузки, для которых созданы уровни GPU. Если ваша подходит, выберите подходящий уровень и закажите его.
Запускайте Llama, Mistral, Gemma, Qwen и подобные модели на оборудовании, которое вы контролируете.
Модели
Llama, Mistral, Gemma, дообученные варианты
Классификация изображений, обнаружение объектов, сегментация. Обучение и инференс на одной платформе без повторного развёртывания.
Модели
YOLO, SAM, кастомные модели PyTorch / TensorFlow
LoRA / QLoRA дообучение на open-source базовых моделях. Почасовая оплата — вы платите только за фактическое время обучения.
Модели
LoRA, QLoRA, полное дообучение на меньших моделях
Генерация векторных представлений в масштабе для конвейеров RAG. Подключайтесь к своей векторной базе данных.
Модели
sentence-transformers, BGE, e5, кастомные энкодеры
Stable Diffusion, FLUX, Kandinsky. Пакетная генерация или API-эндпоинт.
Модели
SD, SDXL, FLUX, ControlNet, кастомные чекпоинты
Речь-в-текст, текст-в-речь, клонирование голоса. Конвейеры транскрипции Whisper.
Модели
Whisper, Coqui, Bark, кастомные TTS
Доступно прямо сейчас
В нашем Cloud VPS JupyterHub доступен как установщик в один клик. Инференс с привязкой к CPU, меньшие модели, генерация векторных представлений, пакетные конвейеры: всё работает уже сейчас без ожидания GPU.
FAQ
Закажите любой уровень сегодня по указанной цене. Запас GPU выделяется под каждый заказ и настраивается вручную (оборудование класса Robot), поэтому между заказом и передачей есть небольшой срок подготовки, а не мгновенная самостоятельная настройка. Сроки мы подтверждаем при оформлении.
GPU NVIDIA на четырёх уровнях: Spark на RTX 4000, а Forge, Foundry и Reactor на RTX PRO 6000 с возрастающим объёмом системной памяти. Для каждого уровня в таблице цен выше указаны GPU, VRAM и RAM.
Точное расположение дата-центра мы подтверждаем с вами до передачи. Запас выделяется под каждый заказ и настраивается вручную, поэтому при запуске мы прозрачно сообщаем регион и детали.
Актуальные ежемесячные цены приведены на этой странице, по каждому уровню, в вашей валюте. Показаны цены как без управления, так и с управлением.
Да. Запустите Cloud VPS с установленным JupyterHub в один клик. Инференс LLM с привязкой к CPU (меньшие модели), генерация векторных представлений, пакетные конвейеры — всё работает уже сейчас. При выходе GPU просто переносите код — без переписывания.
Обучение больших базовых моделей с нуля (мы ориентируемся на дообучение и инференс, а не на масштаб обучения >$10 млн). Закрытые проприетарные модели, требующие соглашений с поставщиком. Всё, требующее многоузловых кластеров масштаба InfiniBand при запуске (многоузловые GPU — в дорожной карте, не в GA).
Запас выделяется под каждый заказ и настраивается вручную, поэтому между заказом и передачей может быть небольшой срок подготовки. Это тот же путь ручной подготовки, что и для наших линеек выделенных серверов и серверов хранения.
Kora знает продукт GPU-вычислений: оборудование, цены, поддерживаемые фреймворки и схемы развёртывания.
GPU / AI-вычисления
Актуальные ежемесячные цены по уровням, root-доступ. Запас выделяется под каждый заказ и настраивается вручную, поэтому подготовка не мгновенная.