Crusoe (Estados Unidos) opera una nube de IA construida sobre data centers propios y, sobre ella, Crusoe Intelligence Foundry, su capa de serving gestionado. El producto reúne inferencia serverless cobrada por token, despliegues self-service en GPU dedicada, entornos a medida y ajuste fino serverless con pesos exportables. El motor de inferencia es MemoryAlloy, desarrollado por la propia empresa.
Para qué sirve
- Llamar modelos alojados por API sin administrar GPU
- Publicar un modelo propio o ajustado en pocos pasos, con endpoint dedicado
- Ajustar modelos por LoRA y llevar los pesos adonde el equipo prefiera
Cómo funciona
- La inferencia serverless responde por una API compatible con OpenAI y cobra por token
- Los despliegues self-service entregan un endpoint en GPU dedicada con cobro por hora
- El ajuste fino serverless genera adaptadores que pueden exportarse en formato abierto
- Las cuentas nuevas reciben créditos para probar el flujo completo antes de escalar
Puntos fuertes
- Infraestructura verticalizada: energía, data centers y serving en el mismo proveedor
- Camino corto entre el ajuste fino y el endpoint en producción
- Capa gestionada sobre una nube de GPU ya consolidada
Puntos de atención
- La nube de GPU por hora sigue siendo el producto principal; la ficha cubre el serving gestionado
- Los entornos a medida y los volúmenes grandes pasan por negociación comercial
- El catálogo serverless es más pequeño que el de plataformas dedicadas solo a modelos

