
{"id":77786,"date":"2026-04-03T08:00:00","date_gmt":"2026-04-03T08:00:00","guid":{"rendered":"https:\/\/exittechnologies.com\/?p=77786"},"modified":"2026-04-02T16:27:57","modified_gmt":"2026-04-02T16:27:57","slug":"la-penurie-de-memoire-est-plus-quun-simple-incident-dans-la-chaine-dapprovisionnement","status":"publish","type":"post","link":"https:\/\/exittechnologies.com\/fr\/blog\/memoire\/la-penurie-de-memoire-est-plus-quun-simple-incident-dans-la-chaine-dapprovisionnement\/","title":{"rendered":"La p\u00e9nurie de m\u00e9moires est plus qu'un simple incident dans la cha\u00eene d'approvisionnement"},"content":{"rendered":"<span class=\"span-reading-time rt-reading-time\" style=\"display: block;\"><span class=\"rt-label rt-prefix\">Temps de lecture : <\/span> <span class=\"rt-time\"> 4<\/span> <span class=\"rt-label rt-postfix\">minutes<\/span><\/span>\n<p class=\"wp-block-paragraph\">Un fabricant de taille moyenne de l'Ohio pr\u00e9voit un budget de 1T4T180 000 pour le rafra\u00eechissement d'un serveur en utilisant la m\u00eame configuration que celle qu'il ach\u00e8te depuis trois ans. Le devis revient \u00e0 $240 000. D\u00e9lai d'ex\u00e9cution : 34 semaines.&nbsp;<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Les modules de m\u00e9moire dont ils ont besoin sont attribu\u00e9s. Non abandonn\u00e9.&nbsp;<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ils sont demand\u00e9s par quelqu'un qui a pass\u00e9 une commande il y a six mois avec un capital plus important et un horizon de planification plus long.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ce sc\u00e9nario se d\u00e9roule actuellement dans tous les secteurs qui touchent au mat\u00e9riel informatique. La cause premi\u00e8re n'est pas un incendie d'usine ou un probl\u00e8me de logistique d\u00fb \u00e0 une pand\u00e9mie. Elle est structurelle : L'IA consomme de la m\u00e9moire plus rapidement que l'industrie ne peut en produire, et le reste du march\u00e9 ach\u00e8te ce qui reste.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Comprendre pourquoi cela se produit, et pourquoi cela ne se r\u00e9soudra pas tout seul, est la seule fa\u00e7on de planifier.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Pourquoi l'IA consomme-t-elle de la m\u00e9moire \u00e0 cette \u00e9chelle ?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">L'entra\u00eenement d'un grand mod\u00e8le d'IA n'est pas un calcul unique. Il s'agit de milliards de param\u00e8tres charg\u00e9s en m\u00e9moire simultan\u00e9ment, trait\u00e9s par des milliers de c\u0153urs de GPU fonctionnant en parall\u00e8le.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">L'approche la plus courante est le parall\u00e9lisme des donn\u00e9es : l'ensemble des donn\u00e9es d'apprentissage est r\u00e9parti de mani\u00e8re \u00e9gale sur le mat\u00e9riel. Chaque composant ex\u00e9cute le mod\u00e8le complet sur la tranche qui lui est attribu\u00e9e, et le mod\u00e8le r\u00e9concilie les r\u00e9sultats. Lorsque vous entra\u00eenez un mod\u00e8le avec des centaines de milliards de param\u00e8tres, chaque GPU a besoin d'une m\u00e9moire \u00e0 large bande passante (HBM) pour conserver sa part de la charge de travail pendant le traitement. Plus de param\u00e8tres signifie plus de GPU et plus de HBM. La relation est \u00e0 peu pr\u00e8s lin\u00e9aire et il n'y a pas de raccourci architectural possible.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">L'inf\u00e9rence ajoute une couche suppl\u00e9mentaire. Lorsqu'un utilisateur soumet une requ\u00eate, le mod\u00e8le lance des charges de travail parall\u00e8les pour g\u00e9n\u00e9rer la r\u00e9ponse. L'inf\u00e9rence est moins gourmande en m\u00e9moire que l'entra\u00eenement, mais \u00e0 l'\u00e9chelle \u00e0 laquelle les hyperscalers fonctionnent - des millions de requ\u00eates par heure - elle consomme toujours une capacit\u00e9 HBM significative.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Le r\u00e9sultat : <a href=\"https:\/\/exittechnologies.com\/fr\/blog\/gpu\/choisir-le-meilleur-gpu-pour-lintelligence-artificielle-et-lapprentissage-automatique-un-guide-complet-pour-2024\/\">tous les grands projets d'IA<\/a> est un \u00e9v\u00e9nement soutenu d'acquisition de m\u00e9moire en grande quantit\u00e9. Et il y en a des dizaines qui se produisent simultan\u00e9ment.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Le goulot d'\u00e9tranglement L'int\u00e9rieur du goulot d'\u00e9tranglement<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Les GPU d'aujourd'hui (H100, B200) sont suffisamment rapides pour que la m\u00e9moire ne puisse pas suivre. Certains GPU peuvent traiter des donn\u00e9es plus rapidement que la m\u00e9moire HBM la plus performante ne peut le faire, ce qui oblige le GPU \u00e0 r\u00e9duire sa vitesse pour s'adapter \u00e0 la bande passante de la m\u00e9moire. Vous payez pour une capacit\u00e9 de calcul maximale et vous ne l'utilisez qu'\u00e0 une fraction de celle-ci.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Imaginez le GPU comme une cuisine. Les chefs sont les processeurs et la m\u00e9moire est l'exp\u00e9diteur, qui communique entre le chef et les serveurs. Si l'exp\u00e9diteur ne peut livrer qu'un repas par minute, il importe peu que le chef puisse cuisiner un plat par seconde. Le rythme auquel les plats sont servis d\u00e9pend autant de l'exp\u00e9diteur que du chef.&nbsp;<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Les entreprises peuvent ajouter de la m\u00e9moire pour rem\u00e9dier en partie \u00e0 ce probl\u00e8me. Le d\u00e9placement des donn\u00e9es d'un GPU \u00e0 l'autre, ou d'un GPU au stockage, reste trop lent, quelle que soit la quantit\u00e9 de m\u00e9moire disponible. Plus de m\u00e9moire augmente la capacit\u00e9. Elle ne r\u00e8gle pas la vitesse de transfert. L'exp\u00e9diteur peut contenir plus de tickets, mais la nourriture met toujours le m\u00eame temps \u00e0 arriver.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">C'est pourquoi les hyperscalers ne se contentent pas d'acheter plus de m\u00e9moire. Ils ach\u00e8tent toute la m\u00e9moire la plus performante disponible, la bloquent dans des accords pluriannuels et la retirent du march\u00e9 avant que l'acheteur suivant n'ait la possibilit\u00e9 de soumettre une offre.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Ce qui devient d\u00e9j\u00e0 plus cher<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Les cat\u00e9gories de mat\u00e9riel informatique qui subissent les plus fortes augmentations de prix et les plus faibles disponibilit\u00e9s \u00e0 l'heure actuelle :<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Disques SSD de grande capacit\u00e9 (2TB-8TB)<\/li>\n\n\n\n<li>Kits de RAM de grande taille (32GB-128GB)<\/li>\n\n\n\n<li>1TB+ cartes microSD<\/li>\n\n\n\n<li>Cartes CFexpress et SD professionnelles<\/li>\n\n\n\n<li>GPU dot\u00e9s d'une grande VRAM. H100, A100 et leurs \u00e9quivalents grand public<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Ce ph\u00e9nom\u00e8ne ne se limite pas \u00e0 l'infrastructure des entreprises. Dell repositionne la m\u00e9moire \u00e0 haute capacit\u00e9 comme un niveau de fonctionnalit\u00e9 sup\u00e9rieur. HP a r\u00e9duit les configurations de m\u00e9moire sur certains appareils pour maintenir ses prix. Nintendo fait des remises sur les achats de jeux num\u00e9riques afin de r\u00e9duire la demande de stockage de cartouches. Sony a stock\u00e9 de la m\u00e9moire vive pour se pr\u00e9parer \u00e0 ce sc\u00e9nario, mais il continue d'augmenter le prix de ses consoles de jeux vid\u00e9o de $100 ou plus, selon le mod\u00e8le.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Lorsque Sony et Nintendo jouent la carte de la m\u00e9moire strat\u00e9gique, la p\u00e9nurie a largement d\u00e9pass\u00e9 le cadre de l'informatique d'entreprise pour s'\u00e9tendre \u00e0 l'ensemble de l'\u00e9conomie.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Qui est le plus touch\u00e9 ?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">La priorit\u00e9 des fabricants de m\u00e9moire est tout simplement \u00e9conomique : il est plus efficace d'honorer une commande de 1 000 unit\u00e9s que 1 000 commandes d'unit\u00e9s individuelles. Les entreprises et les clients \u00e0 tr\u00e8s grande \u00e9chelle qui ont des capitaux \u00e0 engager obtiennent une allocation. Tous les autres se font concurrence pour obtenir ce qui reste.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Cela signifie que les petites entreprises, les organisations dont les budgets informatiques sont limit\u00e9s et les consommateurs individuels ont besoin de l'aide de l'Union europ\u00e9enne. <a href=\"https:\/\/exittechnologies.com\/fr\/blog\/itad\/analyse-du-marche-des-composants-materiels-informatiques-en-2026\/\">ach\u00e8tent sur un march\u00e9 qui n'a pas \u00e9t\u00e9 structur\u00e9 pour eux<\/a>. Si vous ne pouvez pas n\u00e9gocier un accord \u00e0 long terme et verser un capital \u00e0 l'avance, vous \u00eates sur le march\u00e9 au comptant. Vous payez plus cher, vous attendez plus longtemps et vous \u00eates moins pr\u00e9visible.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">V\u00e9hicules modernes, smartphones, tablettes, \u00e9quipements industriels, appareils m\u00e9dicaux : tout ce qui est \u00e9quip\u00e9 d'un processeur et d'une m\u00e9moire embarqu\u00e9e consomme de la m\u00e9moire. La pression sur les prix ne se limite pas \u00e0 la salle des serveurs. Elle se manifeste dans des cat\u00e9gories d'achat que vous n'avez peut-\u00eatre pas identifi\u00e9es comme \u00e9tant du mat\u00e9riel informatique.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si vous ne pouvez pas acheter de nouveau mat\u00e9riel, <a href=\"https:\/\/exittechnologies.com\/fr\/blog\/gpu\/gpu-doccasion-ou-neuf-pour-vos-serveurs-comment-choisir\/\">les composants usag\u00e9s et remis \u00e0 neuf constituent une option l\u00e9gitime \u00e0 court terme<\/a>. La capacit\u00e9 ne correspondra pas aux sp\u00e9cifications de la g\u00e9n\u00e9ration actuelle. Pour les charges de travail qui ne l'exigent pas, le compromis de performance est g\u00e9rable et la diff\u00e9rence de co\u00fbt est r\u00e9elle.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Pourquoi les gains d'efficacit\u00e9 ne r\u00e9soudront pas le probl\u00e8me<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">L'hypoth\u00e8se intuitive est que la technologie des m\u00e9moires s'am\u00e9liorera, que les co\u00fbts baisseront et que la p\u00e9nurie se r\u00e9sorbera d'elle-m\u00eame. Le paradoxe de Jevons sugg\u00e8re le contraire.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Lorsqu'une ressource devient plus efficace, la demande augmente au lieu de diminuer. Une m\u00e9moire plus efficace permet d'utiliser des mod\u00e8les plus grands, qui n\u00e9cessitent plus de m\u00e9moire. La baisse du co\u00fbt par gigaoctet signifie que les entreprises qui ne pouvaient pas se permettre de d\u00e9ployer de grandes quantit\u00e9s de m\u00e9moire peuvent d\u00e9sormais les justifier. Chaque am\u00e9lioration de l'efficacit\u00e9 \u00e9largit le march\u00e9 accessible pour la prochaine g\u00e9n\u00e9ration d'applications gourmandes en m\u00e9moire.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Par exemple, l'algorithme de compression TurboQuant de Google r\u00e9duit consid\u00e9rablement la quantit\u00e9 de m\u00e9moire n\u00e9cessaire au fonctionnement des LLM tout en augmentant la vitesse. La mise en production de cet algorithme r\u00e9duira l'utilisation de la m\u00e9moire de 6 fois, ce qui vous permettra de r\u00e9affecter la m\u00e9moire des charges de travail d'inf\u00e9rence LLM tout en conservant le m\u00eame niveau de performance.<br><br>Les entreprises ne se contenteront pas de vendre la m\u00e9moire r\u00e9affect\u00e9e. Elles la r\u00e9affecteront \u00e0 la formation \u00e0 l'IA, qui est encore plus gourmande en m\u00e9moire que l'inf\u00e9rence, ou elles augmenteront encore davantage leurs charges de travail d'inf\u00e9rence. Le mat\u00e9riel plus efficace incite \u00e0 l'augmentation de l'\u00e9chelle, et non \u00e0 la stagnation.&nbsp;<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Il en a \u00e9t\u00e9 ainsi pour toutes les ressources informatiques importantes : stockage, bande passante, calcul. Il n'y a aucune raison structurelle pour que la m\u00e9moire soit diff\u00e9rente.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">M\u00eame si les entreprises r\u00e9duisent leur utilisation de la m\u00e9moire dans les charges de travail d'IA, il existe une demande massive de m\u00e9moire dans d'autres secteurs. Les fabricants de PC et d'ordinateurs portables, les fournisseurs d'informatique en nuage, les fabricants de smartphones, les constructeurs automobiles et d'innombrables autres entreprises ont un besoin urgent de m\u00e9moire. Il n'y a pas moyen d'y \u00e9chapper.&nbsp;<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Ce que vous pouvez faire maintenant<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">La p\u00e9nurie ne se r\u00e9sorbera pas au prochain trimestre. Planifiez en cons\u00e9quence.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si vous avez des capitaux \u00e0 engager, les accords \u00e0 long terme avec les fabricants sont le moyen le plus direct d'obtenir une allocation. Vous \u00eates en concurrence avec des acheteurs beaucoup plus importants, mais une commande engag\u00e9e sur un volume est plus int\u00e9ressante qu'un achat au comptant.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Si vous ne disposez pas de ce capital, \u00e9tablissez des priorit\u00e9s. Identifiez les syst\u00e8mes d\u00e9pendant de la m\u00e9moire qui sont essentiels \u00e0 vos op\u00e9rations et prot\u00e9gez d'abord ces lignes d'approvisionnement. Acceptez que le mat\u00e9riel non critique puisse avoir des cycles de rafra\u00eechissement plus longs que pr\u00e9vu.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Le march\u00e9 s'est d\u00e9j\u00e0 restructur\u00e9 autour des acheteurs qui ont agi t\u00f4t. La question est maintenant de savoir si votre horizon de planification est suffisamment long pour saisir la prochaine fen\u00eatre d'allocation, ou si vous r\u00e9agissez encore \u00e0 celle que vous avez manqu\u00e9e.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><\/p>","protected":false},"excerpt":{"rendered":"<p><span class=\"span-reading-time rt-reading-time\" style=\"display: block;\"><span class=\"rt-label rt-prefix\">Reading Time: <\/span> <span class=\"rt-time\"> 4<\/span> <span class=\"rt-label rt-postfix\">minutes<\/span><\/span>A mid-size manufacturer in Ohio budgets $180,000 for a server refresh using the same configuration they&#8217;ve purchased for three years running. The quote comes back $240,000. Lead time: 34 weeks.&nbsp; The memory modules they need are allocated. Not discontinued.&nbsp; They are spoken for by someone who placed an order six months ago with more capital [&hellip;]<\/p>\n","protected":false},"author":9,"featured_media":77787,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"_acf_changed":false,"episode_type":"","audio_file":"","podmotor_file_id":"","podmotor_episode_id":"","cover_image":"","cover_image_id":"","duration":"","filesize":"","filesize_raw":"","date_recorded":"","explicit":"","block":"","itunes_episode_number":"","itunes_title":"","itunes_season_number":"","itunes_episode_type":"","footnotes":""},"categories":[118],"tags":[],"class_list":["post-77786","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-memory"],"acf":[],"_links":{"self":[{"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/posts\/77786","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/users\/9"}],"replies":[{"embeddable":true,"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/comments?post=77786"}],"version-history":[{"count":0,"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/posts\/77786\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/media\/77787"}],"wp:attachment":[{"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/media?parent=77786"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/categories?post=77786"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/exittechnologies.com\/fr\/wp-json\/wp\/v2\/tags?post=77786"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}