Perfil da ferramenta

RunPod

PorRunPodUS

Nuvem de GPU para IA: aluguel por segundo, endpoints serverless e públicos e clusters, com contêineres próprios ou modelos prontos.

Marca RunPod em branco sobre fundo escuro com gradiente suave, composição centralizada e minimalista
País
US
Disponibilidade
Proprietário

O RunPod (EUA) é uma nuvem de GPU para cargas de IA. Reúne aluguel de GPUs por segundo, endpoints serverless, clusters e endpoints públicos de modelos. O usuário pode rodar contêineres próprios ou chamar modelos prontos por API, pagando pelo tempo de GPU usado.

Para que serve

  • Alugar GPUs por segundo para treino e inferência
  • Publicar endpoints serverless com contêineres próprios
  • Chamar modelos prontos por endpoints públicos
  • Montar clusters para cargas distribuídas

Como funciona

  • O usuário escolhe a GPU e sobe um contêiner ou usa um modelo pronto
  • Pods ficam disponíveis por sessão; endpoints serverless escalam por demanda
  • A cobrança é por segundo de uso, sem taxa de saída de dados
  • Volumes de rede mantêm dados entre execuções

Modelos e infraestrutura

  • Dezenas de endpoints públicos de imagem, vídeo, texto e áudio
  • Contêineres próprios com Docker, vLLM e outras pilhas
  • GPUs das gerações mais recentes em várias regiões
  • Rede comunitária e nuvem segura com níveis de isolamento

Preços públicos

  • Cobrança por segundo de GPU, sem mensalidade
  • Endpoints públicos cobrados por token ou por saída gerada
  • Armazenamento e volumes cobrados por GB/mês
  • Descontos em planos de compromisso de três e seis meses

Pontos fortes

  • Grande variedade de GPUs e regiões
  • Modelo serverless sem gerir servidores
  • Sem taxa de saída de dados

Pontos de atenção

  • Exige configurar contêineres para cargas próprias
  • Custos dependem da GPU e do tempo de execução
  • Capacidade comunitária pode variar por região