NVIDIA est entrée dans la levée de 2023 avec Google, Amazon, AMD, Intel, Qualcomm, IBM et Salesforce.

Depuis, elle a mis en place des services d’entraînement sur DGX Cloud sur le site, puis ses conteneurs d’inférence, puis un cluster d’entraînement en tant que service au-dessus de la place de marché Lepton qu’elle a achetée en avril 2025.
À la mi-2025, Nvidia détenait l’infrastructure de calcul sous-jacente chez Hugging Face ainsi que les conteneurs qui y tournent. Elle ne détenait pas Hugging Face.
Hugging Face fait environ 150 M$ par an, et donc, à 12,9 Md$, Nvidia paie 86 fois le chiffre d’affaires.
— la levée de 2023 représentait 129x le chiffre d’affaires, alors que les estimations étaient d’environ 35 M$ pour cette année.
-- s’ils étaient proches de 100 M$ quand ils ont dit non, nvidia a proposé 70 fois les revenus pour une participation minoritaire, et paie maintenant 86 fois pour l’ensemble de l’entreprise.
-- donc elle paie 23 % de plus par dollar pour le posséder entièrement que ce qu’elle avait proposé pour une participation sans aucun pouvoir de décision.
je ne pense pas que quelqu’un d’autre faisait une offre.

hugging face fait tourner un routeur appelé inference providers.
-- chaque requête va vers l’un des 18 partenaires, et par défaut elle va à celui qui est le plus rapide, c’est-à-dire qui fournit le plus de jetons par seconde.
-- cerebras, groq et sambanova figurent sur cette liste, et aucun d’eux n’utilise de puces nvidia. donc lorsque l’un d’eux est le plus rapide pour un modèle, c’est là que la requête est envoyée.
-- hugging face écrit aussi optimum-amd et optimum-neuron, donc les mêmes modèles tournent sur amd et trainium sans cuda, et amd et amazon figurent au tableau de capitalisation.
-- hugging face appelle ça une absence totale de verrouillage fournisseur, et un actionnaire minoritaire de 500 M$ (ce que nvidia proposait à la fin de 2025) ne peut pas modifier un paramètre de routage par défaut.
les modèles chinois représentaient 41 % des téléchargements sur Hugging Face l’an dernier, plus que les modèles américains. il y a plus de 113 000 modèles construits à partir de qwen sur le site, et qwen avait dépassé un milliard de téléchargements en mars. nvidia ne peut pas vendre ses puces les plus performantes en chine.
les revenus sont passés d’environ 100 M$ par an en juin à 150 M$ en août, et cela finance le calcul, le stockage et les abonnements.
je surveillerais si AMD, Amazon et Google prennent leur multiplicateur x3 et s’en vont, et si le choix par défaut le plus rapide est toujours là une fois l’accord conclu.
et si qwen et deepseek continuent de publier sur un site détenu par l’entreprise dont ils ne peuvent pas acheter les meilleures puces.


