أشعلت OpenClaw النار، وGLM-5.2 أعطى الوقود
OpenClaw أعطت شركات النماذج المرة الأولى لتذوق حلاوة اقتصاد التوكنات - 10.4 تريليون استدعاء شهري، ومنحنى الإيرادات يرتفع بشكل عمودي.
في 17 يونيو، تم إصدار GLM-5.2 كمصدر مفتوح. هذه المرة مختلفة.
ترخيص MIT: يمكنك التعديل والبيع بحرية، حقوق الملكية الفكرية تم محوها. الشركات يمكنها دمجها في منتجاتها التجارية بدون الحاجة للإفصاح عن التعديلات. بالمقارنة مع ترخيص GPL المعدي، هذا يعني إزالة الحواجز.
الأهم من ذلك - دخول الذكاء الاصطناعي إلى عصر الاستدلال الطويل.
في الماضي كان الأمر كسباق سريع. كل نافذة مهمة كانت محدودة، التخطيط والتنفيذ كان ينتهي، وKV Cache كان تحت السيطرة، والضغط كان على قوة الحوسبة.
بعد GLM-5.2، أصبح الأمر ماراثون. 1M سياق بدون خسارة، مهمة واحدة تحتفظ بكل الكود، كل تاريخ القرارات، وكل قيود الشروط. التجارب أظهرت معالجة 880,000 توكن في مرة واحدة، والنافذة كانت ممتلئة تقريبًا.
الوكيل لم يعد آلة سؤال وجواب. إنه يقوم بتفكيك الهدف → تخطيط متعدد الجولات → التحقق المتكرر → تعديل الأدوات → كتابة الكود وتشغيله → إعادة التخطيط بناءً على الملاحظات. مهمة واحدة تثير مئات من حلقات الاستدلال، واستهلاك التوكنات يتحول من خطي إلى أسّي.
في كل حلقة، يتم تحميل السياق الكامل إلى الذاكرة وإعادة الحساب. حساب مستمر، تواصل مستمر، قراءة وكتابة مستمرة. هذه الثلاثة المستمرة تغيرت تمامًا منطق تسعير الأجهزة.
ما الفائدة من استدلال الوكيل طويل المدى؟
HBM
KV Cache يرتفع مع الجولات والسياق بشكل خطي، يمتلئ بسرعة HBM GPU. بمجرد مغادرة المحلية، عرض النطاق الترددي ينخفض من TB/s إلى مئات GB/s. المشكلة تتحول من قوة الحوسبة إلى عرض النطاق الترددي للذاكرة. قدرة الثلاثة عمالقة قد نفدت، الفجوة 50%-60%، السوق في 2026 ستصل إلى 54.6 مليار دولار.
شريحة ضوئية/InP
استدلال طويل المدى يعمل على مجموعات، حجم الاتصال بين البطاقات مرعب. وحدات الضوء ستنمو بمعدل 60% لتصل إلى 26 مليار دولار في 2026، وفجوة ركائز InP تتجاوز 70%، وسعر الإندي ارتفع بنسبة 90% مقارنة بالعام الماضي.
CPU
تتطلب الإدارة الطويلة المدى، تقسيم المهام، وإدارة KV Cache الاعتماد على CPU. نسبة GPU تتجه من 1:8 نحو 1:1. قال الرئيس التنفيذي لشركة إنتل أن العديد من رؤساء الشركات يتصلون لتسريع الشحنات.
تبريد سائل
التحميل المستمر الطويل المدى، نفس البطاقة تستهلك طاقة 3-5 مرات أكثر من الاستدلال القصير. استهلاك الطاقة للخزانة قفز من 36 كيلو واط إلى 200 كيلو واط. التبريد الهوائي لم يعد كافيًا.
مبدلات
مطلب عرض النطاق الترددي لمجموعات الاستدلال قفز من 100G إلى 400G، يجب جدولة مئات الآلاف من البطاقات، وIB وEthernet يستفيدان بشكل كامل.
لوحة ABF
المجموعات من ألف بطاقة إلى عشرة آلاف بطاقة، كل شريحة تحتاج إلى تغليف. شركة ميزو تسيطر على 90%+ من أفلام ABF، والفجوة في 2028 ستكون 42%. أسعار الدقيق ترتفع، والخبز سيصبح أغلى.
CCL M9
تتطلب اللوحات الأم جميعها مواد عالية السرعة. سعر M9 هو 10 أضعاف FR4، والسوق في 2027 سيصل إلى 18.7 مليار دولار، بمعدل نمو يتجاوز وحدات الضوء.
أشعلت OpenClaw النار، وGLM-5.2 أعطى الوقود. الأولى جعلت شركات النماذج تكسب أول كمية توكن، والثانية جعلت السوق ينتقل من المختبر إلى الصناعة.
قف في التخزين، وقف في الضوء، واستمتع بالفقاعة.
$MU
$SKHYNIX
$LITE
OpenClaw أعطت شركات النماذج المرة الأولى لتذوق حلاوة اقتصاد التوكنات - 10.4 تريليون استدعاء شهري، ومنحنى الإيرادات يرتفع بشكل عمودي.
في 17 يونيو، تم إصدار GLM-5.2 كمصدر مفتوح. هذه المرة مختلفة.
ترخيص MIT: يمكنك التعديل والبيع بحرية، حقوق الملكية الفكرية تم محوها. الشركات يمكنها دمجها في منتجاتها التجارية بدون الحاجة للإفصاح عن التعديلات. بالمقارنة مع ترخيص GPL المعدي، هذا يعني إزالة الحواجز.
الأهم من ذلك - دخول الذكاء الاصطناعي إلى عصر الاستدلال الطويل.
في الماضي كان الأمر كسباق سريع. كل نافذة مهمة كانت محدودة، التخطيط والتنفيذ كان ينتهي، وKV Cache كان تحت السيطرة، والضغط كان على قوة الحوسبة.
بعد GLM-5.2، أصبح الأمر ماراثون. 1M سياق بدون خسارة، مهمة واحدة تحتفظ بكل الكود، كل تاريخ القرارات، وكل قيود الشروط. التجارب أظهرت معالجة 880,000 توكن في مرة واحدة، والنافذة كانت ممتلئة تقريبًا.
الوكيل لم يعد آلة سؤال وجواب. إنه يقوم بتفكيك الهدف → تخطيط متعدد الجولات → التحقق المتكرر → تعديل الأدوات → كتابة الكود وتشغيله → إعادة التخطيط بناءً على الملاحظات. مهمة واحدة تثير مئات من حلقات الاستدلال، واستهلاك التوكنات يتحول من خطي إلى أسّي.
في كل حلقة، يتم تحميل السياق الكامل إلى الذاكرة وإعادة الحساب. حساب مستمر، تواصل مستمر، قراءة وكتابة مستمرة. هذه الثلاثة المستمرة تغيرت تمامًا منطق تسعير الأجهزة.
ما الفائدة من استدلال الوكيل طويل المدى؟
HBM
KV Cache يرتفع مع الجولات والسياق بشكل خطي، يمتلئ بسرعة HBM GPU. بمجرد مغادرة المحلية، عرض النطاق الترددي ينخفض من TB/s إلى مئات GB/s. المشكلة تتحول من قوة الحوسبة إلى عرض النطاق الترددي للذاكرة. قدرة الثلاثة عمالقة قد نفدت، الفجوة 50%-60%، السوق في 2026 ستصل إلى 54.6 مليار دولار.
شريحة ضوئية/InP
استدلال طويل المدى يعمل على مجموعات، حجم الاتصال بين البطاقات مرعب. وحدات الضوء ستنمو بمعدل 60% لتصل إلى 26 مليار دولار في 2026، وفجوة ركائز InP تتجاوز 70%، وسعر الإندي ارتفع بنسبة 90% مقارنة بالعام الماضي.
CPU
تتطلب الإدارة الطويلة المدى، تقسيم المهام، وإدارة KV Cache الاعتماد على CPU. نسبة GPU تتجه من 1:8 نحو 1:1. قال الرئيس التنفيذي لشركة إنتل أن العديد من رؤساء الشركات يتصلون لتسريع الشحنات.
تبريد سائل
التحميل المستمر الطويل المدى، نفس البطاقة تستهلك طاقة 3-5 مرات أكثر من الاستدلال القصير. استهلاك الطاقة للخزانة قفز من 36 كيلو واط إلى 200 كيلو واط. التبريد الهوائي لم يعد كافيًا.
مبدلات
مطلب عرض النطاق الترددي لمجموعات الاستدلال قفز من 100G إلى 400G، يجب جدولة مئات الآلاف من البطاقات، وIB وEthernet يستفيدان بشكل كامل.
لوحة ABF
المجموعات من ألف بطاقة إلى عشرة آلاف بطاقة، كل شريحة تحتاج إلى تغليف. شركة ميزو تسيطر على 90%+ من أفلام ABF، والفجوة في 2028 ستكون 42%. أسعار الدقيق ترتفع، والخبز سيصبح أغلى.
CCL M9
تتطلب اللوحات الأم جميعها مواد عالية السرعة. سعر M9 هو 10 أضعاف FR4، والسوق في 2027 سيصل إلى 18.7 مليار دولار، بمعدل نمو يتجاوز وحدات الضوء.
أشعلت OpenClaw النار، وGLM-5.2 أعطى الوقود. الأولى جعلت شركات النماذج تكسب أول كمية توكن، والثانية جعلت السوق ينتقل من المختبر إلى الصناعة.
قف في التخزين، وقف في الضوء، واستمتع بالفقاعة.
$MU
$SKHYNIX
$LITE
