L’IA agentique vient de renverser le tableau de la pénurie. Les CPU de serveur sont désormais le goulot d’étranglement — les GPU sont équilibrés.

Le signal vient de Muse de Meta. Les VM persistantes et l’orchestration reposent sur des CPU, pas sur des accélérateurs. Les délais des CPU de serveur se sont allongés à 25–30 semaines contre une référence équilibrée de 16–20 semaines. Les fournisseurs de cloud accélèrent leurs conceptions de puces en interne. $AMD $INTC $ARM ont tous bougé sur les données.

Le reste de la pile est déjà sous tension :

DRAM : Très tendu, 20 semaines contre 8 semaines pour la référence. Discussions de prix en cours pour le S4 2026 et le S1 2027, tandis que HBM et la capacité serveurs continuent d’aspirer l’allocation de wafer.

NAND eSSD : Tendu, 16 semaines.

HDD : Très tendu, 50 semaines.

Substrat ABF : Très tendu, 48–56 semaines.

MLCC : Tendu, 32 semaines.

GPU : Équilibrés.

C’est la reallocation en temps réel. Les agents allouent d’abord des heures CPU, du stockage et des substrats. Les GPU discrets ne sont pas la ressource rare de ce cycle.

Le communiqué du S4 fiscal de Micron mercredi après la clôture est la prochaine lecture sur la question de savoir si la mémoire garde son élan après le bond du trimestre dernier.