ChatGPT mange des cannibales
Le battage médiatique autour de ChatGPT commence à s'estomper, les recherches Google pour ChatGPT ayant chuté de 40 % par rapport à leur pic d'avril, tandis que le trafic Web vers le site Web ChatGPT d'OpenAI a diminué de près de 10 % au cours du mois dernier.
Il fallait s'y attendre, mais les utilisateurs de GPT-4 signalent également que le modèle semble considérablement plus stupide (mais plus rapide) qu'auparavant. Une théorie est qu'OpenAI l'a divisé en plusieurs modèles plus petits formés dans des domaines spécifiques qui peuvent agir en tandem, mais pas tout à fait au même niveau.
Mais une possibilité plus intrigante pourrait également jouer un rôle : le cannibalisme de l’IA.
Le Web est désormais inondé de textes et d’images générés par l’IA, et ces données synthétiques sont récupérées pour former les IA, ce qui provoque une boucle de rétroaction négative. Plus un modèle ingère de données d’IA, plus le résultat est mauvais en termes de cohérence et de qualité. C’est un peu comme ce qui se passe lorsque vous faites une photocopie d’une photocopie et que l’image se dégrade progressivement.
Bien que les données de formation officielles de GPT-4 se terminent en septembre 2021, il en sait clairement beaucoup plus que cela, et OpenAI a récemment fermé son plugin de navigation Web.
Une nouvelle étude réalisée par des scientifiques de l'université Rice et de Stanford a proposé un acronyme intéressant pour ce problème : trouble de l'autophagie modèle ou MAD.
« Notre principale conclusion dans tous les scénarios est que sans suffisamment de données réelles fraîches à chaque génération d'une boucle autophage, les futurs modèles génératifs sont voués à voir leur qualité (précision) ou leur diversité (rappel) diminuer progressivement », ont-ils déclaré.
Essentiellement, les modèles commencent à perdre les données les plus uniques mais les moins bien représentées, et renforcent leurs résultats sur des données moins variées, dans un processus continu. La bonne nouvelle est que cela signifie que les IA ont désormais une raison de garder les humains dans la boucle si nous pouvons trouver un moyen d'identifier et de hiérarchiser le contenu humain pour les modèles. C'est l'un des plans du patron d'OpenAI, Sam Altman, avec son projet de blockchain à balayage oculaire, Worldcoin.
Threads n’est-il qu’un produit d’appel pour former des modèles d’IA ?
Le clone de Twitter, Threads, est un geste un peu étrange de la part de Mark Zuckerberg, car il cannibalise les utilisateurs d’Instagram. La plateforme de partage de photos génère jusqu’à 50 milliards de dollars par an, mais elle pourrait en gagner environ un dixième avec Threads, même dans le scénario irréaliste où elle prendrait 100 % des parts de marché de Twitter. Alex Valaitis de Big Brain Dailys prédit qu’il sera fermé ou réintégré à Instagram dans les 12 mois, et soutient que la véritable raison pour laquelle il a été lancé maintenant était d’avoir plus de contenu textuel sur lequel entraîner les modèles d’IA de Metas.
ChatGPT a été formé sur d'énormes volumes de données provenant de Twitter, mais Elon Musk a pris diverses mesures impopulaires pour empêcher que cela ne se reproduise à l'avenir (facturation de l'accès à l'API, limitation du débit, etc.).
Zuck a déjà une certaine expérience dans ce domaine, puisque le logiciel d’IA de reconnaissance d’images SEER de Metas a été formé sur un milliard de photos publiées sur Instagram. Les utilisateurs ont accepté cela dans la politique de confidentialité, et plus d’un a remarqué que l’application Threads recueille des données sur tout ce qui est possible, des données de santé aux croyances religieuses et à la race. Ces données seront inévitablement utilisées pour former des modèles d’IA tels que LLaMA (Large Language Model Meta AI) de Facebook. Musk, quant à lui, vient de lancer un concurrent d’OpenAI appelé xAI qui exploitera les données de Twitter pour son propre LLM.
Qui aurait pu imaginer que former des IA à lire des textes religieux et à parler à la manière de Dieu serait une très mauvaise idée ? En Inde, des chatbots hindous se faisant passer pour Krishna n’ont cessé de conseiller à leurs utilisateurs de tuer des gens si c’est leur dharma, leur devoir.
Au moins cinq chatbots formés sur la Bhagavad Gita, un texte sacré de 700 versets, sont apparus au cours des derniers mois, mais le gouvernement indien n'a pas l'intention de réglementer cette technologie, malgré les préoccupations éthiques.
« C’est une mauvaise communication, une désinformation basée sur un texte religieux », a déclaré Lubna Yusuf, avocate basée à Mumbai et co-auteure du livre AI Book. « Un texte donne une grande valeur philosophique à ce qu’il essaie de dire, et que fait un robot ? Il vous donne une réponse littérale et c’est là le danger. »
Lire aussi Caractéristiques
Lushsux : une décennie de coups de pied au cul et de magouilles dans un seul NFT
Caractéristiques Au cœur du plan fou de la Corée du Sud pour dominer le métavers Les pessimistes de l'IA contre les optimistes de l'IA
Eliezer Yudkowsky, le plus grand destructeur de l’intelligence artificielle, le théoricien de la décision, a publié une conférence TED qui nous avertit que l’IA superintelligente nous tuera tous. Il ne sait pas exactement comment ni pourquoi, car il pense qu’une IA sera tellement plus intelligente que nous que nous ne comprendrons même pas comment et pourquoi elle nous tue comme un paysan médiéval essayant de comprendre le fonctionnement d’un climatiseur. Elle pourrait nous tuer comme un effet secondaire de la poursuite d’un autre objectif, ou parce qu’elle ne veut pas que nous créions d’autres superintelligences pour lui faire concurrence.
Il souligne que personne ne comprend comment les systèmes d’IA modernes font ce qu’ils font. Ce sont des matrices géantes et impénétrables de nombres à virgule flottante. Il ne s’attend pas à « des armées de robots en marche avec des yeux rouges brillants, mais croit qu’une entité plus intelligente et indifférente trouvera des stratégies et des technologies qui peuvent nous tuer rapidement et de manière fiable, puis nous tuer. » La seule chose qui pourrait empêcher ce scénario de se produire est un moratoire mondial sur la technologie soutenu par la menace d’une troisième guerre mondiale, mais il ne pense pas que cela se produira.
Dans son essai Pourquoi l’IA sauvera le monde, Marc Andreessen, professeur d’A16zs, soutient que ce type de position n’est pas scientifique : quelle est l’hypothèse testable ? Qu’est-ce qui falsifierait l’hypothèse ? Comment savons-nous que nous entrons dans une zone dangereuse ? Ces questions restent pour la plupart sans réponse, à l’exception de : « Vous ne pouvez pas prouver que cela n’arrivera pas ! »
Le patron de Microsoft, Bill Gates, a publié un essai intitulé « Les risques de l’IA sont réels mais gérables », dans lequel il affirme que des voitures à Internet, « les gens ont réussi à traverser d’autres moments de transformation et, malgré de nombreuses turbulences, en sont sortis mieux lotis au final. »
« C’est l’innovation la plus transformatrice que nous ayons jamais vue de notre vivant, et un débat public sain dépendra de la connaissance que chacun aura de cette technologie, de ses avantages et de ses risques. Les avantages seront énormes, et la meilleure raison de croire que nous pouvons gérer les risques est que nous l’avons déjà fait auparavant. »
Le scientifique des données Jeremy Howard a publié son propre article, affirmant que toute tentative d'interdire la technologie ou de la confiner à quelques grands modèles d'IA serait un désastre, comparant la réponse basée sur la peur à l'IA à l'époque pré-Lumières, lorsque l'humanité tentait de restreindre l'éducation et le pouvoir à l'élite.
A lire aussi Articles Faut-il donner la pilule orange aux enfants ? Plaidoyer pour le Bitcoin Livres pour enfants Articles Les dangers juridiques de l'implication dans les DAO
« Puis une nouvelle idée a fait son apparition. Et si nous faisions confiance au bien commun de la société dans son ensemble ? Et si tout le monde avait accès à l’éducation ? Au vote ? À la technologie ? C’était le siècle des Lumières. »
Sa contre-proposition est d’encourager le développement open source de l’IA et d’avoir confiance que la plupart des gens exploiteront cette technologie pour le bien.
« La plupart des gens utiliseront ces modèles pour créer et pour se protéger. Quelle meilleure façon de se protéger que de pouvoir compter sur la diversité et l’expertise considérables de la société humaine dans son ensemble, qui font de leur mieux pour identifier et répondre aux menaces, avec toute la puissance de l’IA à leur disposition ? »
Interpréteur de code OpenAIs
Le nouvel interpréteur de code de GPT-4 est une formidable mise à niveau qui permet à l'IA de générer du code à la demande et de l'exécuter. Ainsi, tout ce dont vous pouvez rêver, il peut générer le code et l'exécuter. Les utilisateurs ont proposé divers cas d'utilisation, notamment le téléchargement de rapports d'entreprise et la génération par l'IA de graphiques utiles des données clés, la conversion de fichiers d'un format à un autre, la création d'effets vidéo et la transformation d'images fixes en vidéo. Un utilisateur a téléchargé un fichier Excel de chaque emplacement de phare aux États-Unis et a demandé à GPT-4 de créer une carte animée des emplacements.
Des nouvelles sur l'IA, rien de plus, rien de plus
Une étude de l'Université du Montana a montré que l'intelligence artificielle se classe parmi les 1 % les plus performants à un test standardisé de créativité. Le Scholastic Testing Service a attribué aux réponses des GPT-4 les meilleures notes en créativité, fluidité (la capacité à générer beaucoup d'idées) et originalité.
La comédienne Sarah Silverman et les auteurs Christopher Golden et Richard Kadrey poursuivent OpenAI et Meta pour violation du droit d'auteur, pour avoir formé leurs modèles d'IA respectifs sur les livres des trios.
L'IA Copilot de Microsoft pour Windows finira par être incroyable, mais Windows Central a découvert que l'aperçu Insider n'est en réalité que Bing Chat exécuté via le navigateur Edge et qu'il peut à peu près activer Bluetooth.
Claude 2, le concurrent d'Anthropics ChatGPT, est désormais disponible gratuitement au Royaume-Uni et aux États-Unis, et sa fenêtre contextuelle peut gérer 75 000 mots de contenu contre 3 000 mots maximum pour ChatGPT. Cela le rend fantastique pour résumer de longs morceaux de texte, et il n'est pas mauvais pour écrire de la fiction.
Vidéo de la semaine
La chaîne d'information par satellite indienne OTV News a dévoilé sa présentatrice de nouvelles IA nommée Lisa, qui présentera les informations plusieurs fois par jour dans une variété de langues, dont l'anglais et l'odia, pour le réseau et ses plateformes numériques. Les nouvelles présentatrices IA sont des composites numériques créés à partir des images d'un hôte humain qui lit les informations à l'aide de voix synthétisées", a déclaré le directeur général d'OTV, Jagi Mangat Panda.
Abonnez-vous Les lectures les plus captivantes sur la blockchain. Diffusées une fois par semaine.
Adresse email
S'ABONNER
