Si vous voulez un aperçu clair de la demande de calcul liée à l’IA, oubliez l’hype autour du H100 un instant — regardez l’A100.

Cette puce est sortie en mai 2020. Elle est « ancienne » selon les standards des GPU. Pourtant, elle est encore louée à presque pleine capacité (CoreWeave l’a confirmé lors de sa conférence sur ses résultats). Aujourd’hui, elle exécute surtout des charges de travail d’inférence.

Voici l’indice : les tarifs de location de l’A100 ont à peine bougé, même lorsque des GPU plus récents, bien plus puissants, inondent le marché. Ce n’est pas de la nostalgie : c’est une demande structurelle. L’inférence ne ralentit pas. Elle s’accélère.

Quand une puce de 4 ans conserve son pouvoir de fixation des prix dans un marché saturé de nouvelles offres, vous ne regardez pas une bulle. Vous observez une pénurie de capacité qui va durer.