Lass mich das erstmal klarstellen. Vor drei Jahren habe ich für ein Open-Source-Übersetzungsprojekt als Daten-Volunteer gearbeitet. Damals fehlten sie an parallelen Korpora für eine kleine Sprache, also habe ich ein paar Freunde eingesammelt und etwa zwanzigtausend Satzpaare zusammengestellt, jedes manuell überprüft. Das Projektteam hat gesagt, dass sie uns später danken werden, ich habe damals nicht viel darüber nachgedacht, hab gedacht, das ist einfach Karma sammeln.
Also, was soll ich sagen? Letzten Monat habe ich mir in einem App-Store ein Übersetzungs-Plugin für dreißig Dollar geholt. Nach zwei Tagen fand ich es echt gut, also habe ich mir deren technische Doku angeschaut. Wow, das Kernmodell basiert einfach auf diesem Open-Source-Projekt, das ich damals mitentwickelt habe, sogar die Datenquelle hat den Namen des Projekts angegeben. Mein Name steht da nicht, der meines Freundes auch nicht. Diese Sätze liegen einfach ruhig im Trainingsdatensatz und bringen der Firma Abo-Gebühren, während ich nicht mal eine E-Mail dafür bekommen habe.
Das fühlt sich an, als würdest du einem Freund Geld leihen, der damit ein Geschäft eröffnet und richtig viel verdient, und dann kommt er zurück und sagt: „Danke, dass du mir damals geholfen hast“, und ist dann verschwunden. Nicht mal ein Essen hast du daraus bekommen.
Deshalb, als ich @OpenLedger dieses Projekt gesehen habe, muss ich ehrlich sagen, war ich sowohl aufgeregt als auch wütend. Aufgeregt, weil endlich jemand diese Schulden angehen will, wütend, weil so etwas wirklich ein Blockchain-Projekt braucht, um geregelt zu werden.
Was die da machen, kann ich in einfachen Worten als „Daten-Beitragsystem“ beschreiben. Du trägst einen Datensatz bei, und jeder Modellzugriff darauf, wie oft und welchen Wert es dem Modell bringt, wird alles auf der Blockchain festgehalten. Das Geld kommt nicht durch das Gewissen des Projekts, sondern wird durch den Code erzwungen. Smart Contracts rechnen automatisch ab, wer mehr beiträgt, bekommt mehr Geld, da kann sich keiner drücken.
Dieses System namens Proof of Attribution habe ich mir ein paar Mal genau angeschaut. Technisch gesehen ist es, als würde man jedem Datensatz einen „Leistungsrechner“ verpassen. Wenn dein Satz bei der Modellausgabe eine korrekte Übersetzung zu drei Hundertstel Prozent beigetragen hat, dann bekommst du von den Einnahmen dieser Inferenz drei Hundertstel Prozent. Ist das viel Geld? Nö. Aber was, wenn deine Daten Millionen Mal aufgerufen werden? Dann hast du passives Einkommen.
Ich habe extra nach dem Modul namens OpenLoRA geschaut, das zu diesem Mechanismus gehört. Um ehrlich zu sein, das größte Problem kleiner Teams, die AI-Modelle entwickeln, ist nicht der Algorithmus, sondern die Rechnungen für die Rechenleistung. Du trainierst ein Modell, packst es auf einen Cloud-Server, und selbst wenn du es nur ein paar Mal im Monat laufen lässt, wird dir trotzdem Geld abgezogen, wie bei einem Fitnessstudio-Jahresabo. OpenLoRA hat eine Mitfahrgelegenheit geschaffen, bei der eine Grafikkarte gleichzeitig viele kleine Modelle laufen lässt, und du zahlst nur, wenn du es nutzt. Für Gelegenheitsnutzer wie mich, die ab und zu Experimente machen, ist das viel besser als das Jahresabo.
Aber ich bin jemand, der offen sagt, was Sache ist. Dieser Attribution-Algorithmus läuft momentan hauptsächlich auf speziellen kleinen Modellen, wie Übersetzungsmodellen, Code-Vervollständigungsmodellen und Kundenservice-Q&A-Modellen. Wenn du versuchst, das auf das Niveau von GPT zu heben, sind die Kosten für die Rechenleistung einfach zu hoch. Also weiß OpenLedger selbst, dass sie in der aktuellen Phase erst die spezifischen Modelle abarbeiten müssen. Dieses Stück Fleisch ist vielleicht nicht so fett wie das große Modell, aber es ist essbar. Außerdem sehen die Daten vom Testnetz wirklich stark aus, Millionen von Knoten und Tausende von Modellen, aber jeder, der schon mal in der Krypto-Szene war, weiß, wie viele davon nur für den Airdrop da sind. Wie viele nach dem Launch des Mainnets wirklich aktiv bleiben, werden wir sehen. Und für hochpreisige Daten wie juristische Texte braucht es jemanden, der Tokens staked, um die Datenauthentizität zu garantieren. Wenn die Staking-Rechte in den Händen von ein paar großen Anlegern konzentriert sind, wird die Überzeugungskraft dieses Notariatsystems in Frage gestellt.
$OPEN Die Token-Verteilung habe ich mal überflogen, über sechzig Prozent gehen an die Community und den Netzwerkaufbau, das Team und die Investoren sind für ein Jahr gesperrt und werden über drei Jahre freigegeben. In dieser schnellen Handelswelt wirkt das schon etwas geduldig. Aber mal ganz ehrlich, wie viele Brüder im Square, die jeden Tag den Trends nachjagen, sind bereit, vier Jahre auf die Freigabe zu warten? Das ist echt ein Thema.
Am Ende noch eine Bemerkung. Ich schaue mir auch den Kurs von Bitcoin und Ethereum an, schließlich sind das die Grundpfeiler unserer Szene. Aber ganz ehrlich, statt auf die K-Linien zu starren und auf Auf- oder Abwärtsbewegungen zu spekulieren, schaue ich mir lieber Projekte wie OpenLedger an, die wirklich praktische Probleme lösen. Jeder will schnelles Geld verdienen, aber das, was letztendlich bleibt, sind oft die Dinge, die die Schulden klar geregelt haben.
Die Daten, die ich übersetzt habe, sind jetzt noch auf irgendeinem Server und arbeiten still vor sich hin. Wenn das Buchhaltungssystem von OpenLedger wirklich funktioniert, hoffe ich, dass ich eines Tages meinen Anteil bekomme. Nicht, weil ich gierig nach dem Geld bin, sondern weil es mir zusteht.#OpenLedger