fal (EE. UU.) es una plataforma de inferencia orientada a modelos multimedia. Sirve por API modelos de imagen, vídeo, audio y 3D, y además permite desplegar modelos propios en infraestructura serverless con GPU. El catálogo reúne desde modelos abiertos hasta modelos propietarios de generación de medios.
Para qué sirve
- Generar y editar imagen, vídeo, audio y 3D por API
- Probar y comparar modelos multimedia en un mismo panel
- Desplegar modelos propios con contenedor y runtime gestionados
- Ejecutar cargas de medios con GPU bajo demanda
Cómo funciona
- El usuario elige un modelo y llama a un endpoint HTTP
- Cada llamada exitosa se cobra según el modelo y la salida
- Los modelos propios corren en contenedores publicados en la plataforma
- La infraestructura ajusta la capacidad según la cola de peticiones
Modelos e infraestructura
- Más de mil modelos de imagen, vídeo, audio y 3D
- Modelos abiertos y propietarios en el mismo catálogo
- Serverless para modelos propios y GPUs dedicadas por hora
- Cobro por salida generada y por tiempo de ejecución
Precios públicos
- Créditos prepagos, sin cuota mensual obligatoria
- Precio por salida, por ejemplo por imagen o por segundo de vídeo
- GPUs dedicadas cobradas por hora
- Programas de crédito para startups e investigación
Puntos fuertes
- Especialización en medios generativos, con muchos modelos reunidos
- Despliegue de modelos propios sin gestionar servidores
- Escalado bajo demanda para picos de generación
Puntos de atención
- El enfoque en medios es distinto del de las plataformas de texto
- Las funciones adicionales de serverless pueden requerir aprobación
- El costo crece con el volumen y el tamaño de las salidas

