في عصر الذكاء الاصطناعي، لا شك في أهمية البيانات. البيانات كأساس لنماذج الذكاء الاصطناعي الكبيرة، تحدد جودة مصادر بيانات التدريب قدرة الذكاء الاصطناعي وتجربة المستخدم للمنتج. تمتلك شركات التكنولوجيا الكبرى في الإنترنت بيانات تجارية كبيرة ومتعددة الأبعاد، مما يمنحها ميزة في المشهد، من خلال تراكم البيانات على مدى سنوات من تشغيل منصات الإنترنت الحالية، يمكن أن تنتج كمية كبيرة من البيانات الخاصة، مما يمنحها ميزة واضحة في تحسين تدريب النماذج.
بعد إطلاق منتجات الذكاء الاصطناعي في وقت مبكر، تعتمد على تفاعل المستخدمين مع المنتج لتعديل النموذج، مما يؤدي إلى تأثير دوامة البيانات، ويستمر في التحسين والتكرار، وفي النهاية ستصبح هذه ميزة تنافسية لمنتجات الذكاء الاصطناعي. بينما تعاني الشركات الناشئة في مجال الذكاء الاصطناعي من نقص عدد وكمية مصادر البيانات اللازمة لتدريب النماذج، ستعيق هذه العوائق في البيانات وتشكيل جزر البيانات تطوير الذكاء الاصطناعي.

VANA: كسر جزر البيانات، ومشاركة قيمة البيانات من قبل المستخدمين
ظهرت الإنترنت في بداياتها بمزيج من الابتكارات، حيث نشأت العديد من الشركات التي ثورت نماذج التشغيل التقليدي، ولكن مع تطور الصناعة، بدأت شركات التكنولوجيا الكبرى في احتكار السوق، حيث تتحكم المنصات الكبيرة في تدفق البيانات وتملك كمية كبيرة من بيانات المستخدمين. يمكن للمنصات الكبرى استخدام هذه البيانات لأغراض التوصيات الخوارزمية، وقروض الائتمان للحصول على قيمة تجارية، وقد حققت Reddit إيرادات تصل إلى 200 مليون دولار من بيع المحتوى الذي أنشأه المستخدمون كبيانات تدريب للذكاء الاصطناعي، لكن المستخدمين الذين أنتجوا البيانات لم يشاركوا في قيمة البيانات وعوائدها. ستكسر VANA جزر البيانات، مما يمنح المستخدمين ملكية البيانات، ومشاركة عوائد البيانات.
VANA هو بروتوكول سيادة بيانات مفتوح ولامركزي، كـ L1 متوافق مع EVM، يجعل VANA المستخدمين يمتلكون بياناتهم، ويساهمون ببياناتهم الشخصية لمشاركة عائدات الذكاء الاصطناعي.
VANA يحل مشكلة مصادر بيانات تدريب نماذج الذكاء الاصطناعي
من المعروف أن مصادر بيانات تدريب نماذج الذكاء الاصطناعي لشركات التكنولوجيا على الإنترنت تأتي بشكل أساسي من الزاحف، والشراء المدفوع، وتراكم الأعمال الخاصة بها. تتمثل ميزة بيانات الزاحف في سهولة الحصول عليها، لكنها تعاني من انخفاض الجودة وصعوبة التنظيف؛ البيانات المشتراة المدفوعة تعاني من تشابه شديد، بسبب المنافسة التجارية، فإن مصادر البيانات التجارية ذات القيمة الحقيقية قليلة، وهذه البيانات يصعب أن تجلب ميزة تفاضلية لنموذج الذكاء الاصطناعي؛ بينما قيمة البيانات المتراكمة في سيناريو الأعمال عالية، ولكن هذا الأسلوب غير ملائم للشركات الناشئة الصغيرة.
تأتي بيانات VANA من مساهمات المستخدمين في النظام البيئي، حيث يساهم المستخدمون المشاركون في VANA ببياناتهم من وسائل التواصل الاجتماعي مثل X وLinkedIn أو بيانات إنترنت الأشياء، وسيتم تخزين هذه البيانات بأمان خارج السلسلة. بعد التحقق من البيانات وتنظيفها وتحديدها، يتم استخدامها في تطوير نماذج الذكاء الاصطناعي. بعد مساهمة المستخدمين بالبيانات، يمكنهم الحصول على حقوق حوكمة DataDAO، وتحديد حقوق استخدام البيانات، ومشاركة قيمة البيانات الناتجة.
مزايا نموذج VANA
اعتماد أسلوب الحوكمة اللامركزي، مما يمنح المستخدمين ملكية البيانات، ويتيح لهم اتخاذ القرار بشأن كيفية استخدام البيانات؛
يمكن للمستخدمين تحويل VANA إلى أصول بيانات قابلة للتداول، للاستخدام في تطبيقات الذكاء الاصطناعي اللامركزي؛
يتم ضمان خصوصية وأمان البيانات من خلال استخدام إثبات المعرفة الصفرية (ZKP) وبيئة التنفيذ الموثوقة (TEE).
تكوين شبكة VANA
تشمل المشاركين في VANA بشكل رئيسي المساهمين في البيانات Data Contributors، والتحقق Validators، والمراهنين، ومستهلكي البيانات Data Consumers، بالإضافة إلى DLP (منشئ تجمع السيولة للبيانات) وهو DataDAO.

1، مساهمو البيانات
يمكن للمستخدمين المشاركين اختيار المساهمة ببياناتهم في DataDAO التي تم إنشاؤها ضمن شبكة VANA، ويتم تخزين البيانات المقدمة خارج السلسلة، وتخزين إثبات المساهمة على السلسلة. على سبيل المثال، في DataDAO الخاصة بـ ChatGPT، يطلب المستخدم عبر البريد الإلكتروني من OpenAI تصدير بيانات ChatGPT، وبعد تلقي رد عبر البريد الإلكتروني، يقوم برفع البيانات ورابط التنزيل عبر gptdatadao.org.

2، DataDAO
يمكن لمن يراهن على VANA بقيمة لا تقل عن 100 دولار إنشاء وتسجيل DataDAO، وبعد إكمال التسجيل، ستظهر DataDAO على DataHub لاختيار المساهمين في البيانات. لدعم التطور المستمر لـ DataDAO، ستوفر VANA مكافآت لـ DataDAO التي تحتل المراتب الـ 16 الأولى في تصنيف الرهانات، حيث تكون مكافأة الرهانات في السنوات الثلاث الأولى 15% من إجمالي عدد الرموز، مع دورة مكافأة كل 21 يومًا، ويتطلب فك الرهان 7 أيام. سيتم تحديد عدد مكافآت VANA بناءً على كمية الرهان، ومدة الرهان، وعدد المكافآت التي تحصل عليها DataDAO. يجب على DataDAO أن تراهن على ما لا يقل عن 10,000 VANA للحصول على فرصة للحصول على مكافآت. 50% من المكافآت ثابتة تعود إلى المراهنين، بينما يحدد الباقي من المكافآت من قبل DataDAO ما إذا كان سيتم استخدامها.
حتى الآن، تم تسجيل وإنشاء 17 DataDAO، والتي تشمل Volara، التي تركز على بيانات Twitter/X، وR/DataDAO الخاصة بـ Reddit، وDLP Labs الخاصة ببيانات السير الذاتية على LinkedIn، وقد انضم 140,000 مستخدم من Reddit إلى R/DataDAO، وقد تم تدريب أول نموذج ذكاء صناعي مملوك من قبل المستخدم.
3، Validators
يتولى المحققون مسؤولية أمان وموثوقية وظائف سلسلة الكتل Vana Layer 1، لضمان التحقق والتسجيل الصحيحين لتداول البيانات وإضافتها إلى سلسلة الكتل، ويشمل ذلك L1 Validators وSatya Validators.
يتولى L1 Validators مسؤولية أمان VANA والإجماع. يجب رهن 35,000 VANA على الأقل لتصبح L1 Validators، حيث يبلغ العدد الأولي لـ L1 Validators 64، ويخطط لتوسيع العدد إلى 128. يحصل كل كتلة على 5 VANA، وفي حالة التعطل سيواجه عقوبة بنسبة 10%، وستنخفض المكافآت بنسبة 10% سنويًا.
توفر Satya Validators بيئة تنفيذ موثوقة (TEE) للتحقق من البيانات التي يساهم بها المستخدمون، وضمان أمان وخصوصية البيانات خلال عملية التحقق. ومن ثم يحصلون على مكافآت VANA.
4، مستهلكي البيانات
يختار مطورو نماذج الذكاء الاصطناعي كمستهلكين للبيانات ويشترون الوصول إلى مجموعات البيانات المناسبة لاحتياجات تطوير نماذج الذكاء الاصطناعي، ويستخدمون البنية التحتية لـ Vana لتدريب الذكاء الاصطناعي وتحليل البيانات، ويتعاونون مع DataDAO لتحسين نماذج الذكاء الاصطناعي.

على سبيل المثال، في ChatGPT DataDAO، يتم نقل روابط التنزيل والملفات البيانات التي يرفعها المستخدمون عبر نقل مشفر إلى Satya Validators. يقوم Satya Validators بفك تشفير البيانات ثم حساب التحقق لضمان صحة البيانات التي يرفعها المستخدم، وعدم العبث بها.
سيناريوهات استخدام رموز VANA ونموذجها الاقتصادي
1، يقوم Validators برهن VANA لضمان أمان الشبكة والتحقق من البيانات للحصول على مكافآت VANA؛
2، VANA تعمل كغاز للعمليات على السلسلة مثل تنفيذ العقود والتفاعل مع DataDAO؛
3، يقوم المستخدمون برهن VANA في DataDAO، وبالتالي يحصلون على مكافآت رهان VANA؛
4، يتعين على مستهلكي البيانات استخدام VANA كإعداد افتراضي عند الوصول إلى البيانات؛
5، يشارك حاملو VANA في الحوكمة، ويصوتون على الاقتراحات، وتعتبر VANA كأزواج التداول الرئيسية لرموز DataDAO.

الحد الأقصى لإجمالي VANA هو 120 مليون، وتوزيع الرموز موضح في الرسم البياني أدناه.


المجتمع Community
تشمل بشكل رئيسي مكافآت المساهمات عالية الجودة لـ DataDAO، والإيردروب للمستخدمين الأوائل، والمطورين. يتم توفير 20.3% من VANA خلال TGE، وليس هناك فترة قفل.
النظام البيئي Ecosystem
تشمل بشكل رئيسي دعم الرموز التي تصدرها DataDAO، ومكافآت الكتل والشركاء، حيث يتم توفير 4.8% من VANA خلال TGE، وليس هناك فترة قفل.
المستثمرون Investors
حصلت Vana حتى الآن على تمويل إجمالي قدره 25 مليون دولار، بما في ذلك 5 ملايين دولار في جولة التمويل الاستراتيجي من Coinbase Ventures، و18 مليون دولار في الجولة A من Paradigm، و2 مليون دولار في جولة التمويل الأولي من Polychain.
فريق المطورين الأساسي Core Contributors
بناءً على ما سبق، فإن إجمالي كمية VANA المتداولة خلال TGE هو 30 مليون، بما في ذلك 4.8 مليون VANA من binance launchpool.

إذا كانت هناك مخاطر قانونية لنموذج VANA في الصين
مشروع بيانات نموذج الذكاء الصناعي اللامركزي VANA يحل مشكلة بيانات تدريب النماذج بتكاليف أقل، مما يمكّن رواد أعمال نماذج الذكاء الصناعي من الحصول على بيانات تدريب عالية الجودة، وكسر جزر البيانات التي أنشأتها الشركات الكبرى على الإنترنت، مما يجعل من الممكن لتينسنت الحصول على بيانات مستخدمي علي بابا لتدريب نماذج الذكاء الصناعي، مما يقلل من العوائق أمام الأفراد والشركات التي تهدف إلى تأسيس نماذج ذكاء صناعي، لكن قد يكون هناك خطر في نسخ هذا النموذج في الصين بسبب تصدير البيانات.
في الدليل المنشور من قبل إدارة الفضاء الإلكتروني الوطني (إرشادات تقديم طلب تقييم أمان تصدير البيانات (الإصدار الأول))، تم تحديد أن سلوكيات تصدير البيانات تشمل:
(1) سيتم نقل البيانات التي يجمعها المعالجون داخل البلاد وتخزينها إلى الخارج؛
(2) يتم تخزين البيانات التي يجمعها المعالجون في البلاد، ويمكن للجهات أو المنظمات أو الأفراد في الخارج الاستعلام عنها، وسحبها، وتنزيلها، وتصديرها؛
(3) سلوكيات تصدير البيانات الأخرى التي تحددها إدارة الفضاء الإلكتروني الوطنية.
(قانون إدارة الدخول والخروج لجمهورية الصين الشعبية) ينص في المادة 89 على أن الخروج يعني الانتقال من البر الرئيسي للصين إلى دول أو مناطق أخرى، ومن البر الرئيسي للصين إلى منطقة هونغ كونغ الإدارية الخاصة، ومن البر الرئيسي للصين إلى منطقة ماكاو الإدارية الخاصة، ومن البر الرئيسي للصين إلى منطقة تايوان. ومن هنا، يمكن أن نرى أن الحكم على ما إذا كان هناك خروج يعتمد على نطاق السلطة القضائية.
لا توجد أي قيود على إنشاء DataDAO ومساهمة المستخدمين في البيانات، حيث لا يحتاج مستهلكو البيانات إلى إجراء KYC، بل يكفي دفع VANA للوصول إلى البيانات المجمعة. في هذه الحالة، قد يتضمن مشاركة المستخدمين المحليين في DataDAO المختلفة مساهماتهم في وسائل التواصل الاجتماعي وبيانات السير الذاتية تصدير البيانات.
تعريف المعلومات الشخصية: وفقًا للمادة 76 من (قانون الأمن السيبراني لجمهورية الصين الشعبية): المعلومات الشخصية هي المعلومات التي يمكن أن تحدد هوية الشخص الطبيعي بشكل منفرد أو بالاشتراك مع معلومات أخرى، بما في ذلك على سبيل المثال لا الحصر، اسم الشخص الطبيعي، تاريخ الميلاد، رقم الهوية، معلومات التعرف البيولوجية الشخصية، العنوان، رقم الهاتف، إلخ.
تتضمن السير الذاتية وبيانات الصحة التي تجمعها DataDAO أسماء، تواريخ ميلاد، أرقام هواتف وغيرها من المعلومات الشخصية وحتى المعلومات الشخصية الحساسة. (قانون حماية المعلومات الشخصية لجمهورية الصين الشعبية) ينظم استخدام هذه البيانات والمعلومات والقيود على العبور عبر الحدود.