RunPod (EE. UU.) es una nube de GPU para cargas de IA. Reúne alquiler de GPUs por segundo, endpoints serverless, clústeres y endpoints públicos de modelos. El usuario puede ejecutar contenedores propios o llamar modelos listos por API, pagando por el tiempo de GPU utilizado.
Para qué sirve
- Alquilar GPUs por segundo para entrenamiento e inferencia
- Publicar endpoints serverless con contenedores propios
- Llamar modelos listos por endpoints públicos
- Montar clústeres para cargas distribuidas
Cómo funciona
- El usuario elige la GPU y levanta un contenedor o usa un modelo listo
- Los Pods quedan disponibles por sesión; los endpoints serverless escalan por demanda
- El cobro es por segundo de uso, sin tarifa de salida de datos
- Los volúmenes de red mantienen datos entre ejecuciones
Modelos e infraestructura
- Decenas de endpoints públicos de imagen, vídeo, texto y audio
- Contenedores propios con Docker, vLLM y otras pilas
- GPUs de las generaciones más recientes en varias regiones
- Red comunitaria y nube segura con niveles de aislamiento
Precios públicos
- Cobro por segundo de GPU, sin cuota mensual
- Endpoints públicos cobrados por token o por salida generada
- Almacenamiento y volúmenes cobrados por GB/mes
- Descuentos en planes de compromiso de tres y seis meses
Puntos fuertes
- Gran variedad de GPUs y regiones
- Modelo serverless sin gestionar servidores
- Sin tarifa de salida de datos
Puntos de atención
- Exige configurar contenedores para cargas propias
- Los costos dependen de la GPU y del tiempo de ejecución
- La capacidad comunitaria puede variar por región

