O fal (EUA) é uma plataforma de inferência voltada a modelos multimídia. Serve por API modelos de imagem, vídeo, áudio e 3D, além de permitir implantar modelos próprios em infraestrutura serverless com GPU. O catálogo reúne desde modelos abertos até modelos proprietários de geração de mídia.
Para que serve
- Gerar e editar imagem, vídeo, áudio e 3D por API
- Testar e comparar modelos multimídia em um mesmo painel
- Implantar modelos próprios com contêiner e runtime gerenciados
- Rodar cargas de mídia com GPU sob demanda
Como funciona
- O usuário escolhe um modelo e chama um endpoint HTTP
- Cada chamada com sucesso é cobrada conforme o modelo e a saída
- Modelos próprios rodam em contêineres publicados na plataforma
- A infraestrutura ajusta a capacidade conforme a fila de requisições
Modelos e infraestrutura
- Mais de mil modelos de imagem, vídeo, áudio e 3D
- Modelos abertos e proprietários no mesmo catálogo
- Serverless para modelos próprios e GPUs dedicadas por hora
- Cobrança por saída gerada e por tempo de execução
Preços públicos
- Créditos pré-pagos, sem mensalidade obrigatória
- Preço por saída, por exemplo por imagem ou por segundo de vídeo
- GPUs dedicadas cobradas por hora
- Programas de crédito para startups e pesquisa
Pontos fortes
- Especialização em mídia generativa, com muitos modelos reunidos
- Implantação de modelos próprios sem gerir servidores
- Escala sob demanda para picos de geração
Pontos de atenção
- O foco em mídia é diferente de plataformas de texto
- Recursos adicionais de serverless podem exigir aprovação
- O custo cresce com o volume e o tamanho das saídas

