OpenAI, Anthropic entrent dans une phase de baisse durable des prix, faisant chuter de 40 à 50 % les coûts d’inférence des charges de travail principales.
Les modèles deviennent moins chers, ce qui va stimuler des appels à grande échelle de la part des entreprises, en particulier dans des scénarios à forte consommation de tokens comme les Agent. Les serveurs d’inférence, le refroidissement liquide et les interconnexions haut débit devraient en bénéficier.
D’un autre angle, les fabricants de grands modèles se retrouvent directement entraînés dans une guerre des prix, et leurs marges bénéficiaires sont également sous pression.
Une baisse de prix marquée vise à conquérir des parts de marché et ne signifie pas forcément que le matériel connaîtra immédiatement une montée en volume ; au final, tout dépend de la capacité réelle des appels de tokens à se concrétiser.#openai
Les modèles deviennent moins chers, ce qui va stimuler des appels à grande échelle de la part des entreprises, en particulier dans des scénarios à forte consommation de tokens comme les Agent. Les serveurs d’inférence, le refroidissement liquide et les interconnexions haut débit devraient en bénéficier.
D’un autre angle, les fabricants de grands modèles se retrouvent directement entraînés dans une guerre des prix, et leurs marges bénéficiaires sont également sous pression.
Une baisse de prix marquée vise à conquérir des parts de marché et ne signifie pas forcément que le matériel connaîtra immédiatement une montée en volume ; au final, tout dépend de la capacité réelle des appels de tokens à se concrétiser.#openai