Déploiement de la génération d'images et de vidéos avec vLLM-Omni sur SageMaker AI
Un guide technique détaille comment déployer les modèles FLUX.2 et Wan2.1 sur Amazon SageMaker en utilisant un conteneur vLLM-Omni partagé avec des schémas d'inférence mixtes.
