GPU / AI 컴퓨팅

GPU, 이용 가능.
진짜, 실시간 가격으로.

오픈소스 LLM, 컴퓨터 비전, 파인튜닝, 임베딩을 위한 GPU 컴퓨팅입니다. 실시간 가격은 아래에 있습니다. GPU 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로 설정이 즉시 이루어지지는 않습니다.

오늘 주문, 주문별 할당 귀하의 통화로 표시되는 실시간 가격 루트 액세스 및 완전한 제어
kpanel.kapsulecloud.com/compute

GPU 컴퓨팅

실시간 가격, 오늘 주문

하드웨어 사양확정
사전 설치된 AI 스택확정
API + KPanel 인터페이스확정
가격 책정 모델시간당 요금 확정
실시간 가격확정
GDPR을 준수하는 데이터 처리확정
정직한 신호: 재고는 주문별로 할당되고 수작업으로 프로비저닝됩니다.

NVIDIA

RTX급 GPU

4개 등급

Spark부터 Reactor까지

주문별

수작업 프로비저닝

API

프로비저닝 + 모니터링

목표 워크로드오픈소스 LLM 추론·컴퓨터 비전·파인튜닝·임베딩 파이프라인·디퓨전 모델·오디오 / 음성 모델

전체 사다리

모든 등급, Unmanaged와 Managed

Spark

$330.00Unmanaged /월

NVIDIA RTX 4000 · 20 GB VRAM

Managed /월: $750.00

시작하기

Forge

$1,680.00Unmanaged /월

NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM

Managed /월: $3,850.00

시작하기

Foundry

$2,520.00Unmanaged /월

NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM

Managed /월: $5,770.00

시작하기

Reactor

$3,240.00Unmanaged /월

NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM

Managed /월: $7,420.00

시작하기

한정, 부족할 때 예약

실행할 수 있는 것

목표 워크로드.

이는 GPU 등급이 지원하도록 설계된 워크로드입니다. 귀하의 워크로드가 해당된다면 적합한 등급을 선택하여 주문하십시오.

오픈소스 LLM 호스팅

직접 제어하는 하드웨어에서 Llama, Mistral, Gemma, Qwen 및 유사 모델 실행.

모델

Llama 계열, Mistral, Gemma, 파인튜닝 변형

컴퓨터 비전

이미지 분류, 객체 감지, 세그멘테이션. 재배포 없이 동일한 플랫폼에서 학습 및 추론.

모델

YOLO, SAM, 커스텀 PyTorch / TensorFlow 모델

파인튜닝

오픈 베이스 모델에 LoRA / QLoRA 파인튜닝. 시간당 청구로 실제 학습 시간만 지불.

모델

LoRA, QLoRA, 소규모 모델의 전체 파인튜닝

임베딩 + RAG

검색 증강 생성 파이프라인을 위한 대규모 임베딩 생성. 벡터 DB에 연결.

모델

sentence-transformers, BGE, e5, 커스텀 임베더

디퓨전 / 이미지 생성

Stable Diffusion, FLUX, Kandinsky. 배치 생성 또는 API 엔드포인트로 노출.

모델

SD, SDXL, FLUX, ControlNet, 커스텀 체크포인트

오디오 / 음성

음성-텍스트, 텍스트-음성, 보이스 클로닝. Whisper 전사 파이프라인.

모델

Whisper, Coqui, Bark, 커스텀 TTS

지금 이용 가능

오늘 컴퓨팅이 필요하신가요? Cloud VPS + JupyterHub를 사용하십시오.

Cloud VPS 라인업에서 JupyterHub를 원클릭으로 설치할 수 있습니다. CPU 집약적 추론, 소규모 모델, 임베딩 생성, 배치 파이프라인 - 모두 GPU를 기다리지 않고 오늘 실행됩니다.

  • 모든 Cloud VPS 등급에서 원클릭 JupyterHub 설치
  • 월 $35.00 Comet (vCPU 3개, 4 GB)에서 월 $440.00 Nova (전용 vCPU 16개, 64 GB)까지
  • 시간당 청구, NVMe Gen4 스토리지, 루트 SSH
  • 출시 시 GPU 컴퓨팅으로 이전, 코드는 이미 실행됩니다

FAQ

자주 묻는 질문

GPU 박스를 얼마나 빨리 받을 수 있나요?+

표시된 가격으로 오늘 어떤 등급이든 주문하실 수 있습니다. GPU 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로(Robot급 하드웨어) 즉시 셀프 프로비저닝되는 대신 주문과 인도 사이에 짧은 리드 타임이 있습니다. 시점은 결제 시 확인해 드립니다.

어떤 하드웨어를 사용하나요?+

네 가지 등급의 NVIDIA GPU: Spark는 RTX 4000, Forge, Foundry, Reactor는 시스템 메모리가 점차 늘어나는 RTX PRO 6000을 사용합니다. 각 등급의 GPU, VRAM, RAM은 위의 가격표에 표시됩니다.

GPU는 어디에 위치하나요?+

정확한 데이터센터 위치는 인도 전에 귀하와 확인합니다. 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로, 출시 시 지역과 세부 사항을 투명하게 안내합니다.

가격은 어떻게 되나요?+

실시간 월간 가격은 등급별로 귀하의 통화로 이 페이지에 있습니다. 언매니지드와 매니지드 가격이 모두 표시됩니다.

기다리는 동안 오늘 유용한 것을 할 수 있나요?+

예. JupyterHub가 원클릭으로 설치된 Cloud VPS를 사용하십시오. CPU 집약적 LLM 추론(소규모 모델), 임베딩 생성, 배치 파이프라인은 모두 오늘 실행됩니다. GPU가 출시되면 코드를 이전하면 됩니다, 재작성 불필요.

적합하지 않은 워크로드는 무엇인가요?+

처음부터 대형 파운데이션 모델 학습(파인튜닝 및 추론을 목표로 하며, $10M 이상의 학습 규모는 아닙니다). 벤더 계약이 필요한 클로즈드 소스 독점 모델. 출시 시 InfiniBand 규모의 멀티 GPU 클러스터가 필요한 것(멀티 GPU는 로드맵이며, GA가 아닙니다).

GPU 재고는 어떻게 할당되나요?+

재고는 주문별로 할당되고 수작업으로 프로비저닝되므로 주문과 인도 사이에 짧은 리드 타임이 있을 수 있습니다. 이는 당사의 전용 서버 및 스토리지 서버 라인과 동일한 수동 처리 경로입니다.

Kora가 GPU 워크로드를 도와줄 수 있나요?+

Kora는 GPU 컴퓨팅 제품을 알고 있습니다: 하드웨어, 가격, 지원 프레임워크, 배포 패턴.

GPU / AI 컴퓨팅

오늘 GPU 박스를 시작하십시오.

등급별 실시간 월간 가격, 루트 액세스. 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로 설정이 즉시 이루어지지는 않습니다.