Si vous voulez un aperçu clair de la demande de calcul liée à l’IA, oubliez l’hype autour du H100 un instant — regardez l’A100.
Cette puce est sortie en mai 2020. Elle est « ancienne » selon les standards des GPU. Pourtant, elle est encore louée à presque pleine capacité (CoreWeave l’a confirmé lors de sa conférence sur ses résultats). Aujourd’hui, elle exécute surtout des charges de travail d’inférence.
Voici l’indice : les tarifs de location de l’A100 ont à peine bougé, même lorsque des GPU plus récents, bien plus puissants, inondent le marché. Ce n’est pas de la nostalgie : c’est une demande structurelle. L’inférence ne ralentit pas. Elle s’accélère.
Quand une puce de 4 ans conserve son pouvoir de fixation des prix dans un marché saturé de nouvelles offres, vous ne regardez pas une bulle. Vous observez une pénurie de capacité qui va durer.
Cette puce est sortie en mai 2020. Elle est « ancienne » selon les standards des GPU. Pourtant, elle est encore louée à presque pleine capacité (CoreWeave l’a confirmé lors de sa conférence sur ses résultats). Aujourd’hui, elle exécute surtout des charges de travail d’inférence.
Voici l’indice : les tarifs de location de l’A100 ont à peine bougé, même lorsque des GPU plus récents, bien plus puissants, inondent le marché. Ce n’est pas de la nostalgie : c’est une demande structurelle. L’inférence ne ralentit pas. Elle s’accélère.
Quand une puce de 4 ans conserve son pouvoir de fixation des prix dans un marché saturé de nouvelles offres, vous ne regardez pas une bulle. Vous observez une pénurie de capacité qui va durer.
