Les 12 prochains mois vont être fous :

1/ De nouvelles architectures IA apparaissent, sans être basées sur des modèles de type LLM. Tout le monde se met à déployer des agents Hermes qui pointent vers celles-ci plutôt que vers des wrappers GPT.

2/ Acheter 10 à 50 k$ de DGX Sparks et exécuter GLM 5.3 en interne devient la démarche évidente pour les entreprises. Vous économisez de l’argent sur le long terme, vous possédez votre pile IP comme un véritable actif et vous gardez tout en privé.

Le passage de la location de capacité de calcul à la possession d’une infrastructure d’inférence s’accélère plus vite que ce que les gens pensent.