DeepSeek-R1 completo, em bloco multi-GPU
DeepSeek-R1 completo (671B) — raciocínio SOTA
- Memória de vídeo
- 700 GB
- Instalação
- ~15 min
- Acesso
- porta 8000
- Cobrança
- por hora, em reais
O R1 completo é um modelo de raciocínio de peso pesado e precisa de um bloco de GPUs para caber na memória. Este template já sobe o vLLM com o particionamento configurado — você só escolhe a máquina.
DeepSeek-R1 completo (671B MoE) servido via vLLM com API OpenAI-compatível. Raciocínio de ponta (AIME, matemática, código). ATENÇÃO: exige múltiplas GPUs H100/H200 ou variante quantizada (ajuste tensor-parallel e o modelo). Para 1 GPU, use o template DeepSeek-R1-Distill.
Para que serve
- Raciocínio de ponta sem enviar o problema a terceiros
- Avaliação interna de modelo de fronteira aberto
- Pesquisa e comparação com licença permissiva
- Uso intensivo com custo previsível por hora
Como subir
- Crie sua conta e adicione saldo em reais (Pix ou cartão, sem mensalidade).
- No console, escolha o template DeepSeek-R1 (full) e a máquina — o próprio console esconde as que não atendem ao requisito.
- Em cerca de 15 minutos a instalação termina e o endereço de acesso aparece no painel, na porta 8000.
Terminou? Basta destruir a máquina: a cobrança para junto. Nada de contrato ou franquia mínima.
Perguntas frequentes
Quanta memória de vídeo?
Da ordem de 700 GB, ou seja, um bloco de oito placas grandes. Verifique a disponibilidade no console antes de reservar.
Existe opção mais barata?
Sim, as versões destiladas rodam em uma única placa de 24 GB com boa parte do resultado.
Quanto tempo até responder?
O download dos pesos é longo. Planeje uma janela de alguns minutos antes do primeiro teste.