GPU / IA Compute

GPUs, disponíveis.
Reais, com preços em direto.

Computação GPU para LLMs open-source, visão computacional, fine-tuning e embeddings. Preços em direto abaixo. O stock de GPU é atribuído por encomenda e aprovisionado à mão, por isso a configuração não é instantânea.

Encomende hoje, atribuído por encomenda Preços em direto na sua moeda Acesso root e controlo total
kpanel.kapsulecloud.com/compute

Computação GPU

Preços em direto, encomende hoje

Especificação de hardwareConfirmado
Stacks de IA pré-instaladosConfirmado
Superfície API + KPanelConfirmado
Modelo de preçosPor hora confirmado
Preços em diretoConfirmado
Tratamento de dados em conformidade com o RGPDConfirmado
Sinal honesto: o stock é atribuído por encomenda e aprovisionado à mão.

NVIDIA

GPUs de classe RTX

4 níveis

De Spark a Reactor

Por encomenda

Aprovisionado à mão

API

Provisionamento + monitorizacao

Cargas de trabalho alvoInferencia LLM open-source·Visao computacional·Fine-tuning·Pipelines de embedding·Modelos de difusao·Modelos de audio / discurso

A escala completa

Todos os níveis, não geridos e geridos

Spark

$330.00Não gerido /mês

NVIDIA RTX 4000 · 20 GB VRAM

Gerido /mês: $750.00

Começar

Forge

$1,680.00Não gerido /mês

NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM

Gerido /mês: $3,850.00

Começar

Foundry

$2,520.00Não gerido /mês

NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM

Gerido /mês: $5,770.00

Começar

Reactor

$3,240.00Não gerido /mês

NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM

Gerido /mês: $7,420.00

Começar

Limitado, reserve quando escasso

O que vai correr nisto

Cargas de trabalho que estamos a alvejar.

Estas são as cargas de trabalho para as quais os níveis de GPU foram criados. Se a sua corresponder, escolha o nível adequado e encomende-o.

Alojamento LLM open-source

Execute Llama, Mistral, Gemma, Qwen e modelos similares em hardware que controla.

Modelos

Familia Llama, Mistral, Gemma, variantes fine-tuned

Visao computacional

Classificacao de imagens, detetion de objetos, segmentacao.

Modelos

YOLO, SAM, modelos PyTorch / TensorFlow personalizados

Fine-tuning

Fine-tunes LoRA / QLoRA em modelos base abertos.

Modelos

LoRA, QLoRA, fine-tunes completos em modelos menores

Embeddings + RAG

Gere embeddings em escala para pipelines de geração aumentada por recuperacao.

Modelos

sentence-transformers, BGE, e5, embedders personalizados

Difusao / geração de imagem

Stable Diffusion, FLUX, Kandinsky. Gerar em batch ou expor como endpoint API.

Modelos

SD, SDXL, FLUX, ControlNet, checkpoints personalizados

Audio / discurso

Discurso-para-texto, texto-para-discurso, clonagem de voz. Pipelines de transcricao Whisper.

Modelos

Whisper, Coqui, Bark, TTS personalizado

Disponivel agora

Precisa de compute hoje? Use Cloud VPS + JupyterHub.

A nossa linha Cloud VPS executa JupyterHub como instalador de um clique.

  • Instalacao JupyterHub de um clique em qualquer tier Cloud VPS
  • De $35.00/mo Comet (2 vCPU, 4 GB) a $440.00/mo Nova (16 vCPU dedicado, 64 GB)
  • Faturacao por hora, armazenamento NVMe Gen4, root SSH
  • Migre para GPU compute no lancamento, o seu codigo ja funciona

FAQ

Perguntas frequentes

Com que rapidez posso obter uma caixa GPU?+

Encomende hoje qualquer nível ao preço apresentado. O stock de GPU é atribuído por encomenda e aprovisionado à mão (hardware de classe Robot), por isso há um curto prazo entre a encomenda e a entrega em vez de um aprovisionamento automático instantâneo. Confirmamos os prazos ao finalizar a compra.

Que hardware ira utilizar?+

GPUs NVIDIA em quatro níveis: Spark numa RTX 4000, e Forge, Foundry e Reactor na RTX PRO 6000 com memória de sistema crescente. Cada nível indica a sua GPU, a sua VRAM e a sua RAM na grelha de preços acima.

Onde estão localizadas as GPU?+

Confirmamos consigo a localização exata do centro de dados antes da entrega. O stock é atribuído por encomenda e aprovisionado à mão, por isso somos transparentes sobre a região e os detalhes no lançamento.

E quanto aos precos?+

Os preços mensais em direto estão nesta página, por nível, na sua moeda. São apresentados tanto os preços não geridos como os geridos.

Posso fazer algo util hoje enquanto espero?+

Sim. Inicie um Cloud VPS com JupyterHub instalado com um clique.

Que cargas de trabalho nao sao adequadas?+

Treinar grandes modelos fundamentais do zero. Modelos proprietarios de codigo fechado. Clusters multi-GPU de escala InfiniBand no lancamento.

Como é atribuído o stock de GPU?+

O stock é atribuído por encomenda e aprovisionado à mão, por isso pode haver um curto prazo entre a encomenda e a entrega. É o mesmo percurso de aprovisionamento manual que as nossas linhas de servidores dedicados e de armazenamento.

A Kora saberá como me ajudar com cargas de trabalho GPU?+

A Kora conhece o produto de computação GPU: o hardware, os preços, os frameworks suportados e os padrões de implementação.

GPU / IA Compute

Coloque uma caixa GPU em funcionamento hoje.

Preços mensais em direto por nível, acesso root. O stock é atribuído por encomenda e aprovisionado à mão, por isso a configuração não é instantânea.