AI Daily
العودة إلى الصفحة الرئيسية

· KrASIA

"زد إيه آي" تقول إن نموذجها مفتوح المصدر GLM-5.3 يتفوق بفارق ضئيل على Mythos 5 من "أنثروبيك" في اكتشاف الثغرات البرمجية

"زد إيه آي" تقول إن نموذجها مفتوح المصدر GLM-5.3 يتفوق بفارق ضئيل على Mythos 5 من "أنثروبيك" في اكتشاف الثغرات البرمجية

الصورة: Markus Spiske على Unsplash

نشرت شركة الذكاء الاصطناعي الصينية "زد إيه آي" نتائج اختبارات معيارية تزعم فيها أن نموذجها الجديد مفتوح المصدر GLM-5.3 يتفوق قليلاً على نموذج Mythos 5 المقيّد من "أنثروبيك" في تحديد الثغرات البرمجية. وقالت الشركة إنها ستؤجل الإصدار العام نحو أسبوعين لإجراء أعمال سلامة إضافية، وستقيّد أكثر وظائف الأمن السيبراني حساسية خلف برنامج للمستخدمين الموثّقين.

نشرت شركة الذكاء الاصطناعي الصينية "زد إيه آي" أرقام اختبارات معيارية لنموذج GLM-5.3، وهو نموذج رئيسي جديد تقول إنه قادر على مضاهاة الأنظمة الأمريكية الرائدة أو تجاوزها قليلاً في تحديد الثغرات البرمجية، مع تقليص الفجوة مع "أنثروبيك" في مهام البرمجة الطويلة الأمد. ويستخدم النموذج القاعدة نفسها التي استُخدمت في سابقه GLM-5.2، لكنه يسجّل نتائج أقوى في تقييمات البرمجة والأمن السيبراني. وعلى معيار CyberGym، الذي يختبر قدرة النموذج على فحص الشيفرة المصدرية وتحديد الثغرات والتحقق منها، قالت "زد إيه آي" إن GLM-5.3 سجّل 84.5%، متقدماً بفارق طفيف على Mythos 5 من "أنثروبيك" الذي سجّل 83.8%، وعلى GPT-5.6 Sol من "أوبن إيه آي" الذي سجّل 83.6%. وقد نشرت "زد إيه آي" هذه الأرقام بنفسها ولم يجرِ التحقق منها بشكل مستقل. وتتغير الصورة عندما تنتقل المهمة من اكتشاف الثغرة إلى تحويلها إلى سلاح. فقد أفادت "زد إيه آي" بأن GLM-5.3 سجّل 54.4% على ExploitBench مقابل 78.0% لـMythos 5. وفي الاختبارات الموقوتة، أنجز GLM-5.3 مئة وخمس مهام لتطوير الهجمات خلال ساعتين، و130 مهمة خلال ست ساعات، وهو ما يقل كثيراً عن Mythos 5. وقالت "زد إيه آي" أيضاً إن النموذج كشف عن 1097 ثغرة حرجة عبر قواعد شيفرة مفتوحة المصدر رئيسية من بينها "لينكس" و"ويب كِت" و"فري بي إس دي" أثناء الاختبار، وإن الاستدلال الخاص بسلاسل الاستغلال نشأ من التدريب اللاحق لا من تصميم متعمّد. وإشارةً إلى هذه القدرات، قالت "زد إيه آي" إنها ستؤجل الإصدار العام نحو أسبوعين لإجراء فحوص أمنية إضافية وتعزيز الضمانات، على أن تقتصر أكثر وظائف الأمن السيبراني حساسية في البداية على شركاء مختارين ومستخدمين موثّقين ضمن برنامج وصول موثوق. وقد سلكت "أنثروبيك" مساراً أكثر تقييداً مع Mythos، وهو نسخة من نموذجها Claude Fable 5 أُزيلت منها ضمانات الأمن السيبراني وتُتاح فقط لمؤسسات مدقّقة. ولم تتفاعل الأسواق كما فعلت مع الإصدارات السابقة. فقد أغلقت أسهم "زد إيه آي" المدرجة في هونغ كونغ منخفضة 3.6% في 14 أغسطس/آب، وهو اليوم الذي أُعلن فيه عن GLM-5.3، على النقيض من الحماس الذي قوبل به GLM-5.2 في وقت سابق من الصيف، حين كان السهم قد ارتفع بأكثر من 2000% عن سعر إدراجه في يناير/كانون الثاني بحلول أواخر يونيو/حزيران.

المصادر والاعتمادات

المصدر الأصلي: KrASIA

"زد إيه آي" تقول إن نموذجها مفتوح المصدر GLM-5.3 يتفوق بفارق ضئيل على Mythos 5 من "أنثروبيك" في اكتشاف الثغرات البرمجية — AI Daily