오픈소스 LLM 호스팅
직접 제어하는 하드웨어에서 Llama, Mistral, Gemma, Qwen 및 유사 모델 실행.
모델
Llama 계열, Mistral, Gemma, 파인튜닝 변형
GPU / AI 컴퓨팅
오픈소스 LLM, 컴퓨터 비전, 파인튜닝, 임베딩을 위한 GPU 컴퓨팅입니다. 실시간 가격은 아래에 있습니다. GPU 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로 설정이 즉시 이루어지지는 않습니다.
GPU 컴퓨팅
실시간 가격, 오늘 주문
NVIDIA
RTX급 GPU
4개 등급
Spark부터 Reactor까지
주문별
수작업 프로비저닝
API
프로비저닝 + 모니터링
전체 사다리
한정, 부족할 때 예약
실행할 수 있는 것
이는 GPU 등급이 지원하도록 설계된 워크로드입니다. 귀하의 워크로드가 해당된다면 적합한 등급을 선택하여 주문하십시오.
직접 제어하는 하드웨어에서 Llama, Mistral, Gemma, Qwen 및 유사 모델 실행.
모델
Llama 계열, Mistral, Gemma, 파인튜닝 변형
이미지 분류, 객체 감지, 세그멘테이션. 재배포 없이 동일한 플랫폼에서 학습 및 추론.
모델
YOLO, SAM, 커스텀 PyTorch / TensorFlow 모델
오픈 베이스 모델에 LoRA / QLoRA 파인튜닝. 시간당 청구로 실제 학습 시간만 지불.
모델
LoRA, QLoRA, 소규모 모델의 전체 파인튜닝
검색 증강 생성 파이프라인을 위한 대규모 임베딩 생성. 벡터 DB에 연결.
모델
sentence-transformers, BGE, e5, 커스텀 임베더
Stable Diffusion, FLUX, Kandinsky. 배치 생성 또는 API 엔드포인트로 노출.
모델
SD, SDXL, FLUX, ControlNet, 커스텀 체크포인트
음성-텍스트, 텍스트-음성, 보이스 클로닝. Whisper 전사 파이프라인.
모델
Whisper, Coqui, Bark, 커스텀 TTS
지금 이용 가능
Cloud VPS 라인업에서 JupyterHub를 원클릭으로 설치할 수 있습니다. CPU 집약적 추론, 소규모 모델, 임베딩 생성, 배치 파이프라인 - 모두 GPU를 기다리지 않고 오늘 실행됩니다.
FAQ
표시된 가격으로 오늘 어떤 등급이든 주문하실 수 있습니다. GPU 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로(Robot급 하드웨어) 즉시 셀프 프로비저닝되는 대신 주문과 인도 사이에 짧은 리드 타임이 있습니다. 시점은 결제 시 확인해 드립니다.
네 가지 등급의 NVIDIA GPU: Spark는 RTX 4000, Forge, Foundry, Reactor는 시스템 메모리가 점차 늘어나는 RTX PRO 6000을 사용합니다. 각 등급의 GPU, VRAM, RAM은 위의 가격표에 표시됩니다.
정확한 데이터센터 위치는 인도 전에 귀하와 확인합니다. 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로, 출시 시 지역과 세부 사항을 투명하게 안내합니다.
실시간 월간 가격은 등급별로 귀하의 통화로 이 페이지에 있습니다. 언매니지드와 매니지드 가격이 모두 표시됩니다.
예. JupyterHub가 원클릭으로 설치된 Cloud VPS를 사용하십시오. CPU 집약적 LLM 추론(소규모 모델), 임베딩 생성, 배치 파이프라인은 모두 오늘 실행됩니다. GPU가 출시되면 코드를 이전하면 됩니다, 재작성 불필요.
처음부터 대형 파운데이션 모델 학습(파인튜닝 및 추론을 목표로 하며, $10M 이상의 학습 규모는 아닙니다). 벤더 계약이 필요한 클로즈드 소스 독점 모델. 출시 시 InfiniBand 규모의 멀티 GPU 클러스터가 필요한 것(멀티 GPU는 로드맵이며, GA가 아닙니다).
재고는 주문별로 할당되고 수작업으로 프로비저닝되므로 주문과 인도 사이에 짧은 리드 타임이 있을 수 있습니다. 이는 당사의 전용 서버 및 스토리지 서버 라인과 동일한 수동 처리 경로입니다.
Kora는 GPU 컴퓨팅 제품을 알고 있습니다: 하드웨어, 가격, 지원 프레임워크, 배포 패턴.
GPU / AI 컴퓨팅
등급별 실시간 월간 가격, 루트 액세스. 재고는 주문별로 할당되고 수작업으로 프로비저닝되므로 설정이 즉시 이루어지지는 않습니다.