La stratégie d'intelligence artificielle de Microsoft est-elle ralentie par une pénurie de puces ?

La stratégie d'intelligence artificielle de Microsoft est-elle ralentie par une pénurie de puces ?

Les puces sont assez petites — certaines tiennent dans la paume de votre main. Mais elles sont essentielles pour construire des modèles d'intelligence artificielle, et les plus grandes entreprises technologiques du monde ont besoin d'énormes quantités de ces puces pour rester en tête.

Microsoft est l'une de ces entreprises. Et sur le papier, elle semble avoir un problème. Une enquête du Guardian a révélé un décalage apparent entre ce que Microsoft a déclaré concernant sa capacité en IA et le nombre de puces d'IA avancées qu'elle utilise réellement.

Et ce n'est pas un petit écart. Microsoft visait apparemment à installer 1,8 million de puces d'IA dans ses centres de données dans le monde d'ici la fin 2024. Près de deux ans plus tard, au milieu d'une expansion de 280 milliards de dollars, l'entreprise a installé 2,2 millions de puces d'IA, selon des documents internes consultés par le Guardian. C'est moins de la moitié du nombre que certains experts avaient prévu.

En termes simples, la course mondiale à l'IA exige de construire des centres de données massifs qui fonctionnent avec des puces extrêmement coûteuses. Le décalage apparent suggère que les centres de données les plus récents de Microsoft pourraient ne pas être entièrement opérationnels — ou, s'ils le sont, ils n'ont pas les puces dont ils ont besoin.

Cela pointe également vers un problème plus vaste : il est difficile de suivre la progression réelle de la technologie de l'IA. Les puces qui alimentent l'IA sont fabriquées par Nvidia, l'une des deux entreprises les plus valorisées au monde. Sa chaîne d'approvisionnement est l'un des secrets les mieux gardés de l'industrie.

À quelques exceptions près, Nvidia ne divulgue pas combien de ces puces elle vend ni à qui. Ses clients — les plus grandes entreprises technologiques du monde — ne révèlent pas non plus combien ils en possèdent. Sans ces informations, il est très difficile pour quiconque de savoir si l'IA est réellement en plein essor ou non.

Microsoft : un vide de pouvoir ?

Au cours des deux dernières années, Microsoft affirme avoir construit son infrastructure d'IA à une vitesse fulgurante. Son PDG, Satya Nadella, a déclaré l'année dernière qu'il doublerait son empreinte mondiale de centres de données d'ici mi-2027. Depuis 2022, l'entreprise a investi environ 280 milliards de dollars dans des terrains, des bâtiments et des infrastructures informatiques pour construire l'IA. Cela comprend plus de 41 milliards de dollars rien qu'au dernier trimestre.

Mais il est difficile d'estimer combien de centres de données Microsoft a construits avec cet argent.

Une façon d'évaluer les progrès de l'entreprise est d'examiner ses annonces publiques, notamment en ce qui concerne les besoins en électricité. Les centres de données nécessitent de l'électricité, donc une façon d'estimer combien sont opérationnels est d'additionner l'énergie dont Microsoft dispose — sa capacité en IA.

Les propres déclarations de Microsoft, dans ses rapports annuels et ses résultats trimestriels, suggèrent qu'elle a ajouté 5 gigawatts (GW) de capacité de centres de données au cours des deux dernières années dans le cadre de son déploiement de l'IA. Elle affirme désormais posséder des centaines de centres de données sur cinq continents.

Cinq gigawatts représentent une quantité d'énergie énorme — quatre fois la taille du plus grand parc de centres de données en Europe. Mais la capacité totale de Microsoft devrait être encore plus grande que cela ; elle construit des infrastructures d'IA depuis 2022. De combien plus grande est une question ouverte.

Dans une présentation interne de 2024, Microsoft aurait prétendu avoir déjà installé 5 GW de capacité de centres de données. Cela suggérerait qu'elle pourrait désormais avoir un total de 10 GW. On ne sait pas si tous sont des centres de données d'IA — certains pourraient être destinés à d'autres services cloud. Mais les propres déclarations de Microsoft indiquent que l'écrasante majorité de ses dépenses récentes a été consacrée à la construction d'infrastructures d'IA.

Dix gigawatts de centres de données d'IA suggéreraient que Microsoft devrait avoir environ 6,4 millions d'unités de traitement graphique (GPU). Shaolei Ren, professeur à l'Université de Californie à Riverside, a déclaré que les rapports de développement durable de Microsoft — qui incluent les chiffres de consommation d'électricité et sont publiés séparément de ses états financiers — dressent un tableau différent. Il a déclaré que ces rapports suggèrent que la capacité en IA de Microsoft en 2024 était probablement plus proche de 1,2 GW. Mais même ce chiffre plus bas signifierait que Microsoft aurait besoin d'environ 4 millions de puces d'IA — si elle a ajouté 5 GW de centres de données d'IA au cours des deux dernières années.

« Selon leurs propres indicateurs, Microsoft pourrait avoir raison. Mais on ne sait pas clairement ce qu'ils veulent dire quand ils affirment avoir ajouté de la capacité de centres de données. Ils fournissent un contexte insuffisant », a déclaré Ren. « Les rapports de développement durable sont audités par un tiers. Ils ont plus de crédibilité que les annonces. »

Un analyste spécialisé dans Nvidia a déclaré qu'il pensait que Microsoft aurait plus de puces, compte tenu de ses déclarations publiques. « C'est faible pour moi. C'est moins que ce que j'attendais de Microsoft », a-t-il déclaré.

Microsoft a insisté sur le fait que les calculs du Guardian étaient basés sur des informations incorrectes. L'entreprise n'a offert aucun aperçu sur lesquels des chiffres du Guardian étaient incorrects ni pourquoi. Ce qui est clair, c'est que le déploiement de la capacité en IA de Microsoft semble aller beaucoup plus lentement que ce que ses rapports annuels pourraient suggérer.

Ren a déclaré : « Il peut être plausible d'obtenir ou d'annoncer 1 GW de capacité électrique en un seul trimestre sur le papier. Mais mettre cette capacité en service et l'utiliser réellement pour l'informatique dans le même trimestre serait bien plus difficile. »

Des sources internes à Microsoft affirment que le nombre total de puces d'IA de l'entreprise a « à peine bougé » au cours de l'année écoulée.

Une partie du décalage apparent pourrait s'expliquer par le partenariat de Microsoft avec OpenAI. Les termes exacts de leur partenariat commercial ne sont pas publics, mais cette unité pourrait représenter une partie des déploiements de centres de données de Microsoft, qui ne figureraient pas dans les documents que le Guardian a consultés.

Voir l'image en plein écran
Un centre de données Microsoft à Middenmeer, aux Pays-Bas. Photographie : ANP/Shutterstock

« Vous pouvez avoir un tas de puces… que vous ne pouvez pas brancher »

Il y a un autre facteur : certains des grands projets de Microsoft semblent loin d'être opérationnels.

Prenons le plus grand développement d'IA de Microsoft aux États-Unis, une paire de centres de données dans le Wisconsin et en Géorgie appelée Fairwater. En avril, Nadella, le directeur général de Microsoft, a déclaré que le projet Fairwater dans le Wisconsin « entre en service ».

Des images satellite du bâtiment d'Epoch AI semblent cependant indiquer que seule une partie est opérationnelle. En mai, Microsoft a admis à un journal du Wisconsin que Fairwater n'était pas encore en ligne.

C'est très courant, a déclaré Ren. Au départ, c'était un investissement de plusieurs gigawatts et plusieurs milliards de dollars. Trois ans plus tard, seulement 300 MW ont été construits.

Voir l'image en plein écran
Satya Nadella a déclaré l'année dernière que Microsoft doublerait son empreinte mondiale de centres de données d'ici mi-2027. Photographie : Jeff Chiu/AP

Le document interne indique également que Microsoft possède moins de la nouvelle génération de puces de Nvidia, la Blackwell, que ce à quoi on pourrait s'attendre compte tenu des annonces publiques de Nvidia. En mars dernier, Jensen Huang, le directeur général de Nvidia, a déclaré que les commandes de Blackwells des quatre principaux clients de Nvidia — largement considérés comme Amazon, Oracle, Microsoft et Google — s'élevaient à 3,6 millions.

Aucune ventilation n'a été fournie pour ce chiffre, mais Microsoft a historiquement été l'un des plus grands clients de Nvidia. Si c'était toujours le cas, cela placerait les avoirs totaux de Microsoft en Blackwells à près d'un million de puces. En réalité, elle en a installé moins de la moitié de ce montant.

Où sont les puces, si ce n'est pas dans les centres de données ?

Les bilans de Nvidia semblent indiquer qu'elle a vendu un très grand nombre de puces ; elle a affiché un chiffre d'affaires de 215,9 milliards de dollars en février. Microsoft a-t-elle acheté ces puces sans les installer ? Combien, et toutes sont-elles en sa possession ?

Nadella a semblé faire allusion à cette question dans un podcast fin de l'année dernière appelé All Things AI, où il a parlé du déploiement des centres de données de Microsoft. Le plus grand problème, a-t-il dit, était l'électricité et la construction de centres de données suffisamment proches de l'endroit où se trouve l'énergie.

« Si vous ne pouvez pas faire cela, vous pouvez en fait avoir un tas de puces en stock que je ne peux pas brancher. En fait, c'est mon problème aujourd'hui. Ce n'est pas un problème d'approvisionnement en puces. C'est en réalité que je n'ai pas de coquilles chaudes dans lesquelles brancher. »

Un porte-parole de Microsoft a déclaré : « Sur plusieurs décennies, Microsoft a construit une infrastructure mondiale pour répondre à la demande croissante des clients pour les services cloud et d'IA. Nos centres de données combinent du silicium personnalisé, des puces AMD, Intel et Nvidia sur plusieurs générations, ainsi que l'infrastructure de réseau, de stockage et de systèmes nécessaire pour fonctionner à grande échelle. Microsoft ne divulgue pas le volume de puces spécifiques dans son infrastructure d'IA. Les estimations que le Guardian a partagées avec nous sont inexactes, tirant de mauvaises conclusions à partir d'hypothèses incorrectes. »

Nvidia n'a pas répondu à une demande de commentaire.

Comment calculer le nombre de puces à partir de la « capacité en IA » d'une entreprise

Les plus grandes entreprises technologiques du monde mesurent leur capacité en IA en termes de puissance : gigawatts. Un gigawatt alimente entre 700 000 et 1 million de foyers. Meta affirme que son controversé centre de données Hyperion en Louisiane aura une capacité de 5 GW. L'entreprise britannique DataVita prévoit un centre de données de 1 GW dans le Lanarkshire.

Pour convertir ces chiffres en puces, vous devez calculer combien de puces peuvent fonctionner avec cette quantité d'énergie. Le Guardian a utilisé la méthode suivante, en vérifiant ces calculs avec Abdeltawab Hendawi, professeur à l'Université de Rhode Island, et Ren.

Le premier manifestant anti-IA à avoir été emprisonné a un message pour OpenAI, Anthropic et Meta : « Retrouvez votre humanité » – lire plus.

Pour avoir une idée approximative du nombre de puces dans un centre de données, vous pourriez diviser la consommation électrique du centre de données par la consommation électrique d'une puce d'IA, comme la H100. Une seule H100 utilise 700 W. Si Microsoft a 10 GW de capacité, diviser cela par 700 watts suggère qu'elle devrait avoir environ 12 millions de puces.

Les H100 constituent la majorité des puces mentionnées dans le document interne. Il indique également que Microsoft possède des A100, qui consomment moins d'énergie, et des Blackwells, qui en consomment plus.

Mais cette estimation approximative ne tient pas compte de plusieurs facteurs. Premièrement, les centres de données ont des systèmes de refroidissement et d'autres équipements qui utilisent également de l'électricité. Ren estime que dans un centre de données d'IA typique, 80 % de l'électricité va aux puces informatiques. Cela correspond à peu près aux chiffres de l'Agence internationale de l'énergie, bien que le nombre exact dépende de l'efficacité du centre de données. Quatre-vingts pour cent de 10 GW suggéreraient qu'environ 8 GW sont réellement utilisés.

C'est légèrement inférieur aux propres chiffres de Microsoft pour l'efficacité des centres de données, qui apparaissent dans un rapport de développement durable de 2024. Ce rapport suggère que 89 % de l'électricité dans ses nouveaux centres de données alimente les systèmes informatiques, avec 11 % de frais généraux.

Deuxièmement, toutes les puces dans un centre de données ne sont pas des puces d'IA. Les puces d'IA sont montées sur des racks de serveurs avec d'autres puces informatiques, comme des puces mémoire, qui aident à effectuer les calculs. Un serveur avec huit GPU H100 utilise un maximum d'environ 10 kW de puissance.

Diviser 8 GW par 10 kW donne 800 000 serveurs, soit 6,4 millions de puces.

C'est une estimation prudente, car en pratique, des entreprises comme Microsoft sursouscrivent dans une certaine mesure leur capacité électrique — mettant plus de puces dans un centre de données que ce que leur capacité informatique peut pleinement supporter, a déclaré Ren.

Questions fréquemment posées
Voici une liste de questions fréquemment posées sur la stratégie d'IA de Microsoft et la pénurie de puces, rédigée dans un ton naturel et convivial.



Questions de niveau débutant



1 Microsoft ralentit-elle réellement ses projets d'IA à cause des puces ?

Réponse Pas vraiment. Microsoft avance toujours très vite, mais elle doit être plus intelligente sur l'endroit où elle place ses fonctionnalités d'IA. Elle priorise les grands clients à forte valeur et ses propres produits essentiels plutôt que de déployer des fonctionnalités à tout le monde en même temps. Elle conçoit également ses logiciels pour utiliser les puces plus efficacement.



2 Que signifie la pénurie de puces pour une personne normale utilisant les produits Microsoft ?

Réponse Pour vous, cela peut signifier qu'une nouvelle fonctionnalité d'IA arrive un peu plus tard que prévu, ou qu'elle est d'abord déployée auprès d'un groupe plus restreint d'utilisateurs avant d'être publiée pour tous. Il est rare que des fonctionnalités soient annulées — elles sont simplement retardées ou échelonnées.



3 Pourquoi Microsoft a-t-elle besoin d'autant de puces pour l'IA ?

Réponse Les modèles d'IA sont comme des calculatrices massives et complexes. Ils doivent traiter des milliards de calculs pour répondre à une seule question. Des puces spécialisées sont le seul moyen de le faire assez rapidement pour que l'IA semble instantanée. Microsoft a besoin de millions de ces puces pour alimenter l'IA pour tous ses clients en même temps.



4 Cette pénurie concerne-t-elle simplement la fabrication de plus de puces ou autre chose ?

Réponse C'est un peu des deux. Les usines ne peuvent pas les fabriquer assez vite, mais il s'agit aussi de savoir quelles puces elles peuvent fabriquer. Les puces haut de gamme spécifiques utilisées pour l'IA sont les plus difficiles à produire, et il n'y a que quelques entreprises dans le monde capables de les fabriquer.



Questions avancées et techniques



5 Quelles puces spécifiques Microsoft a-t-elle du mal à obtenir ?

Réponse Le principal goulot d'étranglement est la mémoire à large bande passante et les GPU avancés, en particulier les séries H100 et H200 de Nvidia. Ces GPU sont la norme de l'industrie pour entraîner et exécuter des modèles d'IA, et l'offre n'a pas suivi la demande massive de Microsoft, Google et Amazon en même temps.



6 Microsoft fait-elle quelque chose pour résoudre ce problème ? Construit-elle ses propres puces ?