Perfil de herramienta

RunPod

PorRunPodUS

Nube de GPU para IA: alquiler por segundo, endpoints serverless y públicos y clústeres, con contenedores propios o modelos listos.

Marca RunPod en blanco sobre fondo oscuro con degradado suave, composición centrada y minimalista
País
US
Disponibilidad
Propietario

RunPod (EE. UU.) es una nube de GPU para cargas de IA. Reúne alquiler de GPUs por segundo, endpoints serverless, clústeres y endpoints públicos de modelos. El usuario puede ejecutar contenedores propios o llamar modelos listos por API, pagando por el tiempo de GPU utilizado.

Para qué sirve

  • Alquilar GPUs por segundo para entrenamiento e inferencia
  • Publicar endpoints serverless con contenedores propios
  • Llamar modelos listos por endpoints públicos
  • Montar clústeres para cargas distribuidas

Cómo funciona

  • El usuario elige la GPU y levanta un contenedor o usa un modelo listo
  • Los Pods quedan disponibles por sesión; los endpoints serverless escalan por demanda
  • El cobro es por segundo de uso, sin tarifa de salida de datos
  • Los volúmenes de red mantienen datos entre ejecuciones

Modelos e infraestructura

  • Decenas de endpoints públicos de imagen, vídeo, texto y audio
  • Contenedores propios con Docker, vLLM y otras pilas
  • GPUs de las generaciones más recientes en varias regiones
  • Red comunitaria y nube segura con niveles de aislamiento

Precios públicos

  • Cobro por segundo de GPU, sin cuota mensual
  • Endpoints públicos cobrados por token o por salida generada
  • Almacenamiento y volúmenes cobrados por GB/mes
  • Descuentos en planes de compromiso de tres y seis meses

Puntos fuertes

  • Gran variedad de GPUs y regiones
  • Modelo serverless sin gestionar servidores
  • Sin tarifa de salida de datos

Puntos de atención

  • Exige configurar contenedores para cargas propias
  • Los costos dependen de la GPU y del tiempo de ejecución
  • La capacidad comunitaria puede variar por región