O RunPod (EUA) é uma nuvem de GPU para cargas de IA. Reúne aluguel de GPUs por segundo, endpoints serverless, clusters e endpoints públicos de modelos. O usuário pode rodar contêineres próprios ou chamar modelos prontos por API, pagando pelo tempo de GPU usado.
Para que serve
- Alugar GPUs por segundo para treino e inferência
- Publicar endpoints serverless com contêineres próprios
- Chamar modelos prontos por endpoints públicos
- Montar clusters para cargas distribuídas
Como funciona
- O usuário escolhe a GPU e sobe um contêiner ou usa um modelo pronto
- Pods ficam disponíveis por sessão; endpoints serverless escalam por demanda
- A cobrança é por segundo de uso, sem taxa de saída de dados
- Volumes de rede mantêm dados entre execuções
Modelos e infraestrutura
- Dezenas de endpoints públicos de imagem, vídeo, texto e áudio
- Contêineres próprios com Docker, vLLM e outras pilhas
- GPUs das gerações mais recentes em várias regiões
- Rede comunitária e nuvem segura com níveis de isolamento
Preços públicos
- Cobrança por segundo de GPU, sem mensalidade
- Endpoints públicos cobrados por token ou por saída gerada
- Armazenamento e volumes cobrados por GB/mês
- Descontos em planos de compromisso de três e seis meses
Pontos fortes
- Grande variedade de GPUs e regiões
- Modelo serverless sem gerir servidores
- Sem taxa de saída de dados
Pontos de atenção
- Exige configurar contêineres para cargas próprias
- Custos dependem da GPU e do tempo de execução
- Capacidade comunitária pode variar por região

