Alojamento LLM open-source
Execute Llama, Mistral, Gemma, Qwen e modelos similares em hardware que controla.
Modelos
Familia Llama, Mistral, Gemma, variantes fine-tuned
GPU / IA Compute
Computação GPU para LLMs open-source, visão computacional, fine-tuning e embeddings. Preços em direto abaixo. O stock de GPU é atribuído por encomenda e aprovisionado à mão, por isso a configuração não é instantânea.
Computação GPU
Preços em direto, encomende hoje
NVIDIA
GPUs de classe RTX
4 níveis
De Spark a Reactor
Por encomenda
Aprovisionado à mão
API
Provisionamento + monitorizacao
A escala completa
Forge
NVIDIA RTX PRO 6000 · 96 GB VRAM · 256 GB RAM
Gerido /mês: $3,850.00
Foundry
NVIDIA RTX PRO 6000 · 96 GB VRAM · 512 GB RAM
Gerido /mês: $5,770.00
Reactor
NVIDIA RTX PRO 6000 · 96 GB VRAM · 768 GB RAM
Gerido /mês: $7,420.00
Limitado, reserve quando escasso
O que vai correr nisto
Estas são as cargas de trabalho para as quais os níveis de GPU foram criados. Se a sua corresponder, escolha o nível adequado e encomende-o.
Execute Llama, Mistral, Gemma, Qwen e modelos similares em hardware que controla.
Modelos
Familia Llama, Mistral, Gemma, variantes fine-tuned
Classificacao de imagens, detetion de objetos, segmentacao.
Modelos
YOLO, SAM, modelos PyTorch / TensorFlow personalizados
Fine-tunes LoRA / QLoRA em modelos base abertos.
Modelos
LoRA, QLoRA, fine-tunes completos em modelos menores
Gere embeddings em escala para pipelines de geração aumentada por recuperacao.
Modelos
sentence-transformers, BGE, e5, embedders personalizados
Stable Diffusion, FLUX, Kandinsky. Gerar em batch ou expor como endpoint API.
Modelos
SD, SDXL, FLUX, ControlNet, checkpoints personalizados
Discurso-para-texto, texto-para-discurso, clonagem de voz. Pipelines de transcricao Whisper.
Modelos
Whisper, Coqui, Bark, TTS personalizado
Disponivel agora
A nossa linha Cloud VPS executa JupyterHub como instalador de um clique.
FAQ
Encomende hoje qualquer nível ao preço apresentado. O stock de GPU é atribuído por encomenda e aprovisionado à mão (hardware de classe Robot), por isso há um curto prazo entre a encomenda e a entrega em vez de um aprovisionamento automático instantâneo. Confirmamos os prazos ao finalizar a compra.
GPUs NVIDIA em quatro níveis: Spark numa RTX 4000, e Forge, Foundry e Reactor na RTX PRO 6000 com memória de sistema crescente. Cada nível indica a sua GPU, a sua VRAM e a sua RAM na grelha de preços acima.
Confirmamos consigo a localização exata do centro de dados antes da entrega. O stock é atribuído por encomenda e aprovisionado à mão, por isso somos transparentes sobre a região e os detalhes no lançamento.
Os preços mensais em direto estão nesta página, por nível, na sua moeda. São apresentados tanto os preços não geridos como os geridos.
Sim. Inicie um Cloud VPS com JupyterHub instalado com um clique.
Treinar grandes modelos fundamentais do zero. Modelos proprietarios de codigo fechado. Clusters multi-GPU de escala InfiniBand no lancamento.
O stock é atribuído por encomenda e aprovisionado à mão, por isso pode haver um curto prazo entre a encomenda e a entrega. É o mesmo percurso de aprovisionamento manual que as nossas linhas de servidores dedicados e de armazenamento.
A Kora conhece o produto de computação GPU: o hardware, os preços, os frameworks suportados e os padrões de implementação.
GPU / IA Compute
Preços mensais em direto por nível, acesso root. O stock é atribuído por encomenda e aprovisionado à mão, por isso a configuração não é instantânea.