vLLM Scale-to-Zero sur GKE: KEDA & Datadog
Surveiller et scaler une stack vLLM sur Google Kubernetes Engine avec Datadog, en utilisant un proxy personnalisé pour le scale-to-zero synchrone.
Réflexions sur l'ingénierie des données, l'architecture cloud et le développement de l'IA.
Surveiller et scaler une stack vLLM sur Google Kubernetes Engine avec Datadog, en utilisant un proxy personnalisé pour le scale-to-zero synchrone.
Une vue d'ensemble de la transition d'Amazon DataZone à SageMaker Unified Studio, explorant les changements structurels et l'impact de la migration.
Connecter un hôte d'UI générative au véritable serveur AWS MCP : proxy CORS, connexion OAuth 2.1 et données AWS en direct rendues sous forme de widgets.
Une plongée en profondeur pour réduire les coûts d'inactivité en mettant à l'échelle un nœud GPU vLLM à zéro avec KEDA et son add-on HTTP sur GKE.
Plongée dans la création de projets avec le blueprint Lakehouse Database à travers plusieurs comptes et régions depuis un domaine SageMaker Unified Studio.
Découvrez comment les chats IA génèrent des interfaces utilisateur dynamiques en utilisant les applications MCP et le modèle BYOK.
Plongée dans les différences du blueprint DataLakehouse entre DataZone et SageMaker Unified Studio (SMUS) et comment reproduire la structure v1.
Un guide pratique pour déployer des modèles open-weight sur Google Kubernetes Engine en utilisant vLLM pour le développement assisté par IA.
Une analyse approfondie de l'architecture et du cycle de vie des projets dans SageMaker Unified Studio.
Une plongée approfondie dans le Model Context Protocol (MCP) et la création d'outils WebMCP pour les agents d'IA.
Une analyse approfondie des blueprints gérés par AWS et personnalisés dans SageMaker Unified Studio.
Comment synchroniser votre coffre-fort Obsidian de manière sécurisée avec Git et intégrer l'IA via Copilot pour créer un second cerveau puissant.
Bienvenue sur mon blog consacré à l'ingénierie des données, l'architecture Cloud et le développement d'IA.