Originaltitel: „ChatGPT, das so beliebt ist, braucht dringend eine „Compliance-Bremse““ Originalautor: Das Rechtsteam von Xiao Sa Kerntipp: ChatGPT und andere Chat-KIs, die auf Technologie zur Verarbeitung natürlicher Sprache basieren, haben dringende Probleme mit der Einhaltung gesetzlicher Vorschriften Es gibt drei Hauptprobleme, die kurzfristig gelöst werden müssen: Erstens die Frage der Rechte an geistigem Eigentum in den von der Chat-KI bereitgestellten Antworten. Das wichtigste Compliance-Problem besteht darin, ob die von der Chat-KI generierten Antworten entsprechende Rechte an geistigem Eigentum generieren. Ist eine Genehmigung für geistiges Eigentum erforderlich? Zweitens: Erfordert der Prozess des Data Mining und des Trainings der Chat-KI auf riesigen Mengen an Texten zur Verarbeitung natürlicher Sprache (im Allgemeinen Korpus genannt) eine entsprechende Genehmigung für geistiges Eigentum? Drittens besteht einer der Mechanismen von Chat-KI wie ChatGPT darin, mathematische Statistiken für eine große Anzahl vorhandener natürlichsprachlicher Texte durchzuführen, um ein auf Statistiken basierendes Sprachmodell zu erhalten. Dieser Mechanismus macht Chat-KI wahrscheinlich „ernsthaft Unsinn“. Pfade“, was wiederum zu rechtlichen Risiken bei der Verbreitung falscher Informationen führt. Wie lässt sich vor diesem technischen Hintergrund das Risiko der Verbreitung falscher Informationen in der Chat-KI so weit wie möglich reduzieren? Im Allgemeinen befindet sich die Gesetzgebung zu künstlicher Intelligenz in meinem Land noch in der Vorforschungsphase, und die zuständigen Abteilungen sind bei der Überwachung des Bereichs der künstlichen Intelligenz besonders vorsichtig. Die entsprechenden Probleme bei der Einhaltung gesetzlicher Vorschriften nehmen immer mehr zu. 1. ChatGPT ist keine „zeitübergreifende Technologie für künstliche Intelligenz“. ChatGPT ist im Wesentlichen ein Produkt der Entwicklung der Technologie zur Verarbeitung natürlicher Sprache und im Wesentlichen immer noch nur ein Sprachmodell. Anfang 2023 machte die enorme Investition des globalen Technologieriesen Microsoft ChatGPT zur „Spitzenklasse“ im Technologiebereich und löste sich erfolgreich aus dem Kreis. Mit dem Aufschwung des ChatGPT-Konzepts auf dem Kapitalmarkt haben auch viele inländische Technologieunternehmen begonnen, sich in diesem Bereich zu engagieren. Während das Konzept von ChatGPT auf dem Kapitalmarkt begeistert ist, können wir als Juristen nicht umhin, die Rechtssicherheit zu bewerten Welche Risiken und rechtlichen Compliance-Pfade kann ChatGPT selbst mit sich bringen? Bevor wir die rechtlichen Risiken und Compliance-Pfade von ChatGPT diskutieren, sollten wir zunächst die technischen Prinzipien von ChatGPT untersuchen – kann ChatGPT, wie es in den Nachrichten heißt, dem Fragesteller jede gewünschte Frage stellen?Aus der Sicht von Sajies Team scheint ChatGPT weit weniger „magisch“ zu sein, als einige Nachrichten behaupten – in einem Satz ist es lediglich eine Integration natürlicher Sprachverarbeitungstechnologien wie Transformer und GPT und im Wesentlichen immer noch eine Sprache, die darauf basiert Neuronale Netze sind eher ein Modell als ein „generationeller KI-Fortschritt“. Wie bereits erwähnt, ist ChatGPT das Produkt der Entwicklung der Technologie zur Verarbeitung natürlicher Sprache. Aus der Entwicklungsgeschichte dieser Technologie geht hervor, dass sie grob drei Phasen durchlaufen hat: grammatikbasiertes Sprachmodell – statistikbasiertes Sprachmodell – basierend auf neuronalen Netzwerken Wenn Sie das Funktionsprinzip von ChatGPT und die rechtlichen Risiken, die dieses Prinzip mit sich bringen kann, genauer verstehen möchten, müssen Sie zunächst den Vorgänger des Sprachmodells klären Sprachmodell basierend auf neuronalen Netzen – Wie statistikbasierte Sprachmodelle funktionieren. In der auf Statistiken basierenden Sprachmodellphase führen KI-Ingenieure Statistiken über große Mengen natürlichsprachlicher Texte durch, um die Wahrscheinlichkeit aufeinanderfolgender Verbindungen zwischen Wörtern zu bestimmen. Wenn Menschen eine Frage stellen, beginnt die KI mit der Analyse der Sprachumgebung, die aus den Wörtern besteht, aus denen sie besteht Als nächstes wird die Frage gestellt, welche Wortkombinationen eine hohe Wahrscheinlichkeit haben, und dann werden diese Wörter mit hoher Wahrscheinlichkeit zusammengefügt, um eine Antwort basierend auf Statistiken zurückzugeben. Man kann sagen, dass dieses Prinzip die Entwicklung der Technologie zur Verarbeitung natürlicher Sprache seit ihrer Entstehung durchdrungen hat. In gewissem Sinne sind die nachfolgenden auf neuronalen Netzwerken basierenden Sprachmodelle auch Modifikationen der auf Statistik basierenden Sprachmodelle. Um ein leicht verständliches Beispiel zu geben, hat das Sajie-Team die Frage „Welche Touristenattraktionen gibt es in Dalian?“ in das ChatGPT-Chatfeld eingegeben, wie in der folgenden Abbildung dargestellt: Der erste Schritt der KI analysiert die grundlegenden Morpheme in Beantworten Sie die Frage „Dalian, was, Touristenattraktionen“, suchen Sie dann die Textsammlung natürlicher Sprache, in der sich diese Morpheme im vorhandenen Korpus befinden, finden Sie die Kollokation mit der höchsten Wahrscheinlichkeit des Auftretens in dieser Sammlung und kombinieren Sie diese Kollokationen dann, um das Finale zu bilden Antwort. Beispielsweise stellt die KI fest, dass das Wort „Zhongshan Park“ mit hoher Wahrscheinlichkeit im Korpus der drei Wörter „Dalian, Tourismus, Resort“ enthalten ist, und gibt daher „Zhongshan Park“ zurück ist, dass das Wort „Park“ mit Gärten assoziiert wird. Wörter wie „See“, „Brunnen“ und „Statue“ haben die höchste Übereinstimmungswahrscheinlichkeit, daher wird es weiter zu „Dies ist ein historischer Park mit wunderschönen Gärten, Seen, Brunnen und Statuen“ zurückkehren ."„ Mit anderen Worten, der gesamte Prozess basiert auf Wahrscheinlichkeitsstatistiken, die auf den vorhandenen Textinformationen (Korpus) natürlicher Sprache hinter der KI basieren, sodass die zurückgegebenen Antworten auch „statistische Ergebnisse“ sind, was dazu führt, dass ChatGPT in vielen Fragen „ernsthaft“ ist. Unsinn". Genauso wie die Antwort auf die Frage „Welche Touristenattraktionen gibt es in Dalian?“: Obwohl Dalian einen Zhongshan-Park hat, gibt es im Zhongshan-Park keine Seen, Brunnen oder Statuen. Dalian hatte in der Geschichte zwar einen „Stalin-Platz“, aber der Stalin-Platz war von Anfang bis Ende nie ein kommerzieller Platz und es gab keine Einkaufszentren, Restaurants oder Unterhaltungsmöglichkeiten. Anscheinend sind die von ChatGPT zurückgegebenen Informationen falsch. 2. ChatGPT ist derzeit das am besten geeignete Anwendungsszenario für Sprachmodelle. Obwohl wir im vorherigen Abschnitt die Nachteile statistikbasierter Sprachmodelle klar erläutert haben, handelt es sich bei ChatGPT schließlich um ein auf neuronalen Netzwerken basierendes Modell, das die Statistik erheblich verbessert hat ChatGPT ist ein Sprachmodell, dessen technische Grundlagen beide die neueste Generation von Sprachmodellen sind. ChatGPT kombiniert im Wesentlichen umfangreiche Daten mit dem äußerst ausdrucksstarken Transformer-Modell, um eine sehr detaillierte Modellierung natürlicher Sprache durchzuführen Die Sätze sind manchmal „Unsinn“, sie sehen auf den ersten Blick immer noch wie „menschliche Antworten“ aus. Daher hat diese Technologie ein breites Anwendungsspektrum in Szenarien, die eine massive Mensch-Computer-Interaktion erfordern. Derzeit gibt es drei solcher Szenarien: erstens Suchmaschinen; zweitens Mensch-Computer-Interaktionsmechanismen in Banken, Anwaltskanzleien, verschiedenen Vermittlern, Einkaufszentren, Krankenhäusern und staatlichen Dienstleistungsplattformen, wie zum Beispiel die oben genannten Kundenbeschwerdesysteme , medizinische Beratung und Navigation, staatliches Beratungssystem; drittens der Interaktionsmechanismus von intelligenten Autos, intelligenten Häusern (wie intelligenten Lautsprechern, intelligenten Lichtern) usw. Eine Suchmaschine, die KI-Chat-Technologien wie ChatGPT kombiniert, wird wahrscheinlich einen traditionellen suchmaschinenbasierten Ansatz verfolgen, der durch ein auf neuronalen Netzwerken basierendes Sprachmodell ergänzt wird. Derzeit verfügen traditionelle Suchgiganten wie Google und Baidu über umfassende Kenntnisse in der Sprachmodelltechnologie, die auf neuronalen Netzen basiert. Google verfügt beispielsweise über Sparrow und Lamda, die mit ChatGPT vergleichbar sind „Humanisieren“.Der Einsatz von KI-Chat-Technologien wie ChatGPT in Kundenbeschwerdesystemen, der Leitnavigation in Krankenhäusern und Einkaufszentren sowie Regierungsberatungssystemen von Regierungsbehörden wird die Personalkosten relevanter Einheiten erheblich senken und Kommunikationszeit sparen Auf Statistiken basierende Antworten können zu völlig falschen Inhaltsantworten führen. Die daraus resultierenden Risiken für die Risikokontrolle erfordern möglicherweise eine weitere Bewertung. Im Vergleich zu den beiden oben genannten Anwendungsszenarien ist das rechtliche Risiko, dass die ChatGPT-Anwendung zu einem Mensch-Computer-Interaktionsmechanismus für die oben genannten Geräte in Bereichen wie Smart Cars und Smart Homes wird, viel geringer, da die Anwendungsumgebung in solchen Bereichen relativ privat ist und der Fehlergehalt des KI-Feedbacks ist nicht groß. Da diese Art von Szenario große rechtliche Risiken mit sich bringt, werden keine hohen Anforderungen an die inhaltliche Genauigkeit gestellt und das Geschäftsmodell ist ausgereifter. 3. Eine vorläufige Untersuchung der rechtlichen Risiken und Compliance-Pfade von ChatGPT. Erstens ist die gesamte Regulierungslandschaft der künstlichen Intelligenz in meinem Land die gleiche wie bei vielen neuen Technologien. Auch die durch ChatGPT repräsentierte Technologie zur Verarbeitung natürlicher Sprache steht vor dem „Collingridge-Dilemma“. Dieses Dilemma umfasst das Informationsdilemma und das Kontrolldilemma. Das sogenannte Informationsdilemma bedeutet, dass die sozialen Folgen einer neuen Technologie nicht in den frühen Stadien der Technologie vorhergesehen werden können Über Wenn nachteilige soziale Folgen entdeckt werden, ist Technologie oft Teil der gesamten sozialen und wirtschaftlichen Struktur geworden, sodass es unmöglich ist, die nachteiligen sozialen Folgen wirksam zu kontrollieren. Derzeit befindet sich der Bereich der künstlichen Intelligenz, insbesondere der Technologie zur Verarbeitung natürlicher Sprache, in einer Phase rasanter Entwicklung. Diese Technologie dürfte in das sogenannte „Collingridge-Dilemma“ geraten, und es scheint keine entsprechende rechtliche Aufsicht zu geben „mit dem Tempo Schritt halten“. Derzeit gibt es in unserem Land keine Gesetzgebung für die Branche der künstlichen Intelligenz auf nationaler Ebene, es gab jedoch entsprechende lokale Gesetzgebungsversuche. Erst im vergangenen September verkündete Shenzhen die nationale Sondergesetzgebung für die Industrie der künstlichen Intelligenz, die „Shenzhen Special Economic Zone Artificial Intelligence Industry Promotion Regulations“, und dann verabschiedete Shanghai auch die „Shanghai Regulations on Promoting the Development of the Artificial Intelligence Industry I“. Ich gehe davon aus, dass bald verschiedene Orte ähnliche Gesetze für die Branche der künstlichen Intelligenz einführen werden. Im Hinblick auf die ethische Regulierung künstlicher Intelligenz veröffentlichte das National New Generation Artificial Intelligence Governance Professional Committee im Jahr 2021 auch den „New Generation Artificial Intelligence Ethics Code“, der vorschlägt, Ethik und Moral in den gesamten Lebenszyklus der Forschung und Entwicklung im Bereich künstlicher Intelligenz zu integrieren Anwendung Vielleicht in naher Zukunft. In Zukunft werden die „Drei Gesetze der Robotik“, ähnlich denen in Asimovs Romanen, zu den eisernen Gesetzen auf dem Gebiet der künstlichen Intelligenz.Zweitens haben die rechtlichen Risiken falscher Informationen, die ChatGPT mit sich bringt, den Fokus von der Makro- auf die Mikroebene verlagert. Abgesehen von der gesamten Regulierungslandschaft der Branche der künstlichen Intelligenz und der ethischen Regulierung der künstlichen Intelligenz werden die in der Grundlage bestehenden praktischen Compliance-Probleme außer Acht gelassen Auch die Entwicklung von KI-Chats wie ChatGPT muss dringend beachtet werden. Das problematischere Problem sind die falschen Informationen, die ChatGPT antwortet. Wie im zweiten Teil dieses Artikels erwähnt, kann es sein, dass die Antworten von ChatGPT völliger „schwerwiegender Unsinn“ sind Eigentlich äußerst irreführend. Natürlich können falsche Antworten auf Fragen wie „Welche Touristenattraktionen gibt es in Dalian?“ keine schwerwiegenden Folgen haben, aber wenn ChatGPT auf Suchmaschinen, Kundenbeschwerdesysteme usw. angewendet wird, können die falschen Informationen, die es beantwortet, äußerst schwerwiegende Folgen haben rechtliche Risiken. Tatsächlich sind solche rechtlichen Risiken bereits aufgetreten. Galactica, ein Sprachmodell für den wissenschaftlichen Forschungsbereich des Meta-Dienstes, der fast zeitgleich mit ChatGPT im November 2022 gestartet wurde, wurde von Nutzern nach nur drei Testtagen abgeschaltet aufgrund von Problemen mit gemischten wahren und falschen Antworten. Unter der Voraussetzung, dass technische Prinzipien nicht in kurzer Zeit durchbrochen werden können, müssen ChatGPT und ähnliche Sprachmodelle, wenn sie auf Suchmaschinen, Kundenbeschwerdesysteme und andere Bereiche angewendet werden, aus Compliance-Gründen transformiert werden. Wenn festgestellt wird, dass ein Benutzer möglicherweise eine professionelle Frage stellt, sollte der Benutzer dazu angeleitet werden, den entsprechenden Fachmann zu konsultieren, anstatt nach Antworten durch künstliche Intelligenz zu suchen. Gleichzeitig sollte der Benutzer deutlich daran erinnert werden, dass die Authentizität der Fragen zurückgegeben wird Durch die Chat-KI kann eine weitere Überprüfung erforderlich sein, um das Risiko entsprechender Compliance-Risiken zu minimieren. Drittens, die durch ChatGPT verursachten Probleme bei der Einhaltung von geistigem Eigentum. Wenn wir unsere Aufmerksamkeit vom Makro auf das Mikro richten, sollten neben der Authentizität von KI-Antwortnachrichten auch die Probleme des geistigen Eigentums von Chat-KI, insbesondere großen Sprachmodellen wie ChatGPT, berücksichtigt werden können auch zu Compliance-Problemen führen. Die erste Compliance-Frage besteht darin, ob für „Text Data Mining“ eine entsprechende Genehmigung für geistiges Eigentum erforderlich ist. Wie oben erwähnt, basiert das Arbeitsprinzip von ChatGPT auf einer großen Menge an Texten in natürlicher Sprache (oder Sprachkorpora). ChatGPT muss die Daten im Korpus auswerten und trainieren, um den Inhalt des Korpus in seine eigene Datenbank zu kopieren. Das entsprechende Verhalten wird im Bereich der Verarbeitung natürlicher Sprache üblicherweise als „Text Data Mining“ bezeichnet.Es ist immer noch umstritten, ob Text Data Mining das Vervielfältigungsrecht verletzt, wenn die entsprechenden Textdaten ein Werk darstellen können. Im Bereich der Rechtsvergleichung haben sowohl Japan als auch die Europäische Union den Umfang der fairen Nutzung in ihren Urheberrechtsgesetzen erweitert und „Text Data Mining“ in KI als neue Situation der fairen Nutzung hinzugefügt. Obwohl einige Wissenschaftler bei der Überarbeitung des Urheberrechtsgesetzes meines Landes im Jahr 2020 dafür plädierten, das Fair-Use-System meines Landes von „geschlossen“ auf „offen“ zu ändern, wurde diese Idee letztendlich nicht übernommen. Derzeit behält das Urheberrecht meines Landes die faire Nutzung bei Genauer gesagt können nur die dreizehn in Artikel 24 des Urheberrechtsgesetzes festgelegten Situationen als faire Nutzung anerkannt werden. Mit anderen Worten: Das Urheberrechtsgesetz meines Landes sieht derzeit kein „Text Data Mining“ im Rahmen einer angemessenen Anwendung vor. Für das Text-Data-Mining ist in meinem Land immer noch eine entsprechende Genehmigung für geistiges Eigentum erforderlich. Die zweite Compliance-Herausforderung besteht darin, dass die von ChatGPT generierten Antworten original sind. In Bezug auf die Frage, ob von KI generierte Werke originell sind, ist Sajies Team der Ansicht, dass sich die Beurteilungskriterien nicht von den bestehenden Beurteilungskriterien unterscheiden sollten. Mit anderen Worten: Ob eine bestimmte Antwort von KI oder von Menschen vervollständigt wird, sollte darauf basieren bestehende Standards für Originalität. Tatsächlich steckt hinter dieser Frage eine weitere kontroversere Frage: Wenn die von AI generierte Antwort original ist, kann dann AI der Urheberrechtsinhaber sein? Offensichtlich kann der Autor eines Werks nach den Gesetzen zum geistigen Eigentum der meisten Länder, einschließlich unseres Landes, nur eine natürliche Person sein, und KI kann nicht der Autor des Werks sein. Wenn ChatGPT schließlich Arbeiten Dritter in seine Antwort einbezieht, wie sollten dann seine Probleme mit dem geistigen Eigentum gehandhabt werden? Das Sajie-Team ist der Ansicht, dass, wenn die Antwort von ChatGPT urheberrechtlich geschützte Werke im Korpus enthält (obwohl die Wahrscheinlichkeit, dass dies geschieht, basierend auf dem Arbeitsprinzip von ChatGPT gering ist), dies gemäß dem aktuellen Urheberrechtsgesetz Chinas gilt, es sei denn, es handelt sich um eine faire Nutzung, andernfalls handelt es sich um eine Vervielfältigung ohne Genehmigung des Urheberrechtsinhabers nicht gestattet.