La plateforme GitHub a été paralysée pendant près de huit heures le 17 août dernier, affectant l'ensemble de ses services critiques, de l'authentification aux outils de développement comme Copilot. Cette interruption majeure, la deuxième en un mois, met en lumière les défis structurels auxquels fait face le leader mondial du code face à une croissance exponentielle de son trafic.
Une défaillance technique en cascade
L'incident a été déclenché par un pic de trafic que l'infrastructure n'a pas su absorber. Selon Vlad Fedorov, vice-président ingénierie de GitHub, le problème provient d'un mauvais réglage du système d'ajustement automatique de la capacité dans un datacenter aux États-Unis. Cette défaillance initiale a provoqué un effet domino, saturant les équipements d'aiguillage et engorgeant le système d'authentification global. La situation a été aggravée par un comportement inattendu de l'éditeur VS Code : face à la lenteur du service, celui-ci multipliait les tentatives de reconnexion, démultipliant artificiellement la charge sur les serveurs.
L'impact de l'intelligence artificielle sur le trafic
La multiplication des incidents techniques confirme les inquiétudes concernant la capacité de la plateforme à supporter l'usage intensif lié à l'intelligence artificielle. Entre avril et août 2026, le volume mensuel de commits sur la plateforme a doublé, passant de 1,4 à 2,9 milliards. Cette activité frénétique, portée par l'automatisation et les outils d'IA, pousse les infrastructures actuelles dans leurs retranchements, rendant la gestion de la charge de plus en plus complexe pour les équipes techniques.
La stratégie cloud de Microsoft en question
Pour répondre à cette pression, GitHub accélère sa migration vers Azure, qui gère désormais 58 % de la charge de la plateforme, contre seulement 12 % en mai dernier. Toutefois, cette transition semble insuffisante pour absorber seule la demande. Des rapports récents indiquent que la filiale de Microsoft aurait dû recourir aux services d'AWS, son concurrent direct, pour maintenir la stabilité de ses opérations. Ce recours à une infrastructure multi-cloud souligne l'urgence pour GitHub de stabiliser ses capacités techniques pour éviter de nouvelles interruptions préjudiciables aux développeurs et entreprises du monde entier.