Lundi soir, je me suis accroupi sur le balcon pour fumer. En faisant défiler mon fil, je suis tombé sur une publication disant qu’OpenAI, une fois de plus, avait fermé en bloc des comptes à cause d’exigences de régulation dans une région. Dans les commentaires, tout le monde s’est mis à insulter. J’ai écrasé la cigarette jusqu’à l’éteindre, puis je suis rentré ouvrir OpenGradient Chat, et j’ai relancé exactement le même prompt : la réponse est restée normale. La longue chaîne de mots en vert pour l’attestation hash était toujours affichée à côté des enregistrements d’appel. J’ai fixé l’écran et je me suis un peu reculé.
Au début, je pensais que des termes comme « souveraineté de la puissance de calcul » n’étaient que des slogans d’un cercle décentralisé, une forme de rhétorique. En pratique, ça ne me concernait pas vraiment. Après tout, ChatGPT n’avait jamais coupé mon service. Mais en relisant la deuxième partie de la documentation d’OpenGradient, ce passage sur la topologie des nœuds m’a fait admettre que j’avais pensé trop légèrement. Une IA centralisée enferme toute la puissance de calcul de raisonnement dans ses propres salles serveurs : fermetures de comptes, blocage par région, censure de contenu, ajustements de prix — tout est décidé unilatéralement. Le pouvoir de négociation des utilisateurs tend vers zéro. Lors de l’épisode ChatGPT interdit pendant plus de vingt jours en 2023, en Italie (GDPR), dans ce pays, mes homologues n’avaient plus qu’à attendre. OpenGradient disperse la puissance de calcul de raisonnement dans des Inference Nodes à l’échelle mondiale : dès qu’un organisme de régulation coupe un nœud local dans un pays, les autres nœuds continuent de servir. Les opérateurs de nœuds n’ont pas besoin d’autorisation pour rejoindre ; personne ne peut tirer une seule fois sur un interrupteur pour tout couper. $BSB
@OpenGradient La clé pour que cette puissance de calcul décentralisée fonctionne, c’est que l’ingénierie soit suffisamment « bien emboîtée ». L’architecture HACA fait que les Inference Nodes, les Full Nodes et les Data Nodes se vérifient mutuellement au niveau matériel de l’attestation : mon prompt est acheminé vers tel nœud via le protocole x402, qui choisit automatiquement selon la disponibilité et le prix, sans dépendre d’un ordonnanceur central. $OPG Dans le protocole, le paiement est étroitement lié à l’attestation : pour « gruger » un nœud, il faut d’abord passer la vérification du hash de l’image TEE. Les nœuds malveillants sont éliminés à double titre par l’anti-sybil et le slash lié à la mise (collatéral). Dans cette structure, j’obtiens une capacité dont la trajectoire de routage du prompt, la partie facturée et le coût de sortie ne peuvent pas être contrôlés par un seul point. $PORTAL
Mais ce n’est pas encore parfait. Au début, la répartition des Inference Nodes sera probablement concentrée en Amérique du Nord et en Europe chez quelques hébergeurs. Si, en cas de coordination de régulation transfrontalière, on coupe une série d’IDC, la disponibilité du service va tout de même connaître des fluctuations. La partie où le LLM Proxy route vers des modèles de pointe externes : OpenAI et Anthropic sont eux-mêmes dans des datacenters centralisés, et OpenGradient ne peut pas résoudre cette couche de souveraineté de calcul à lui seul. Quand les variations de prix de l’OPG se heurtent au mécanisme de déblocage de 25 % au 13e mois, la pression à la vente peut se déclencher : les revenus des nœuds fluctuent, ce qui peut faire décrocher certains petits nœuds ; paradoxalement, la centralisation pourrait même augmenter à court terme.
J’ai poussé le cendrier un peu sur le côté, j’ai refermé la fenêtre à moitié, puis je suis retourné au bureau pour ouvrir une nouvelle session.
#opg
AI 属于每一个人
100%
AI 就该巨头垄断
0%
1 Votes • Vote fermé