A Crusoe (Estados Unidos) opera uma nuvem de IA construída sobre data centers próprios e, sobre ela, o Crusoe Intelligence Foundry, camada de serving gerenciado. O produto reúne inferência serverless cobrada por token, deployments self-service em GPU dedicada, ambientes sob medida e ajuste fino serverless com pesos exportáveis. O motor de inferência é o MemoryAlloy, desenvolvido pela própria empresa.
Para que serve
- Chamar modelos hospedados por API sem administrar GPU
- Publicar um modelo próprio ou ajustado em poucos passos, com endpoint dedicado
- Ajustar modelos por LoRA e levar os pesos para onde o time preferir
Como funciona
- A inferência serverless responde por uma API compatível com OpenAI e cobra por token
- Deployments self-service entregam um endpoint em GPU dedicada com cobrança por hora
- O ajuste fino serverless gera adaptadores que podem ser exportados em formato aberto
- Contas novas recebem créditos para testar o fluxo completo antes de escalar
Pontos fortes
- Infraestrutura verticalizada: energia, data centers e serving no mesmo fornecedor
- Caminho curto entre ajuste fino e endpoint em produção
- Camada gerenciada sobre uma nuvem de GPU já consolidada
Pontos de atenção
- A nuvem de GPU por hora continua sendo o produto principal; a ficha cobre o serving gerenciado
- Ambientes sob medida e volumes grandes passam por negociação comercial
- O catálogo serverless é menor que o de plataformas dedicadas apenas a modelos

