تصدّر Grok 4.7 للتوّ المركز الأول في Harvey LAB-AA v1.1
متفوّقًا على Claude Opus 5.5 وGPT-6 Astra وMuse Spark 1.3 وغيرهم في لوحة الصدارة
المعيار صارم للغاية: هلوسة جوهرية واحدة تعني حصول المهمة بأكملها على صفر
الأمر لا يقتصر على تقديم إجابات صحيحة... بل يتعلق بإنجاز المهمة كاملةً على نحو صحيح، من دون الوقوع في هلوسات جوهرية
أصبح Grok 4.7 وحشًا حقيقيًا في الاستدلال عالي المخاطر
متفوّقًا على Claude Opus 5.5 وGPT-6 Astra وMuse Spark 1.3 وغيرهم في لوحة الصدارة
المعيار صارم للغاية: هلوسة جوهرية واحدة تعني حصول المهمة بأكملها على صفر
الأمر لا يقتصر على تقديم إجابات صحيحة... بل يتعلق بإنجاز المهمة كاملةً على نحو صحيح، من دون الوقوع في هلوسات جوهرية
أصبح Grok 4.7 وحشًا حقيقيًا في الاستدلال عالي المخاطر