· KrASIA
Z.ai का कहना है कि ओपन-सोर्स GLM-5.3 सॉफ्टवेयर खामियाँ खोजने में Anthropic के Mythos 5 से थोड़ा आगे है
फोटो: Markus Spiske Unsplash पर
चीनी AI कंपनी Z.ai ने बेंचमार्क परिणाम प्रकाशित किए, जिनमें दावा किया गया कि उसका नया ओपन-सोर्स GLM-5.3 मॉडल सॉफ्टवेयर कमजोरियाँ पहचानने में Anthropic के प्रतिबंधित Mythos 5 से थोड़ा बेहतर प्रदर्शन करता है। कंपनी ने कहा कि वह अतिरिक्त सुरक्षा कार्य के लिए सार्वजनिक रिलीज़ को लगभग दो हफ्ते टालेगी और अपने सबसे संवेदनशील साइबर सुरक्षा कार्यों को एक सत्यापित-उपयोगकर्ता कार्यक्रम के पीछे सीमित रखेगी।
चीनी आर्टिफिशियल इंटेलिजेंस कंपनी Z.ai ने GLM-5.3 के लिए बेंचमार्क आँकड़े जारी किए हैं। यह एक नया फ्लैगशिप मॉडल है, जिसके बारे में कंपनी का कहना है कि यह सॉफ्टवेयर कमजोरियाँ पहचानने में अग्रणी अमेरिकी प्रणालियों की बराबरी कर सकता है या उनसे थोड़ा आगे निकल सकता है, साथ ही लंबे समय तक चलने वाले कोडिंग कार्यों में Anthropic के साथ अंतर कम कर रहा है। यह मॉडल अपने पूर्ववर्ती GLM-5.2 के समान आधार का उपयोग करता है, लेकिन कोडिंग और साइबर सुरक्षा मूल्यांकनों में मजबूत परिणाम दर्ज करता है।
CyberGym पर, जो यह जाँचता है कि कोई मॉडल सोर्स कोड की जाँच कर, कमजोरियाँ खोजकर उनकी पुष्टि कर सकता है या नहीं, Z.ai ने कहा कि GLM-5.3 ने 84.5% स्कोर किया, जो Anthropic के Mythos 5 के 83.8% और OpenAI के GPT-5.6 Sol के 83.6% से मामूली रूप से आगे है। ये आँकड़े स्वयं Z.ai द्वारा प्रकाशित किए गए हैं और स्वतंत्र रूप से सत्यापित नहीं किए गए हैं।
तस्वीर बदल जाती है जब कार्य खामी खोजने से आगे बढ़कर उसे हथियार बनाने का हो जाता है। Z.ai ने बताया कि GLM-5.3 ने ExploitBench पर 54.4% स्कोर किया, जबकि Mythos 5 का स्कोर 78.0% रहा। समयबद्ध परीक्षण में, GLM-5.3 ने दो घंटे में 105 और छह घंटे में 130 अटैक-डेवलपमेंट कार्य पूरे किए, जो Mythos 5 से काफी कम है। Z.ai ने यह भी कहा कि परीक्षण के दौरान मॉडल ने Linux, WebKit और FreeBSD सहित प्रमुख ओपन-सोर्स कोडबेस में 1,097 गंभीर कमजोरियाँ सामने लाईं, और यह कि एक्सप्लॉइट-चेन तर्कक्षमता जानबूझकर की गई डिज़ाइन के बजाय पोस्ट-ट्रेनिंग से उभरी।
इन क्षमताओं का हवाला देते हुए Z.ai ने कहा कि वह आगे की सुरक्षा जाँच करने और सुरक्षा उपाय मजबूत करने के लिए सार्वजनिक रिलीज़ लगभग दो हफ्ते टाल देगी, और सबसे संवेदनशील साइबर सुरक्षा कार्य शुरुआत में एक विश्वसनीय पहुँच कार्यक्रम के तहत चुनिंदा साझेदारों और सत्यापित उपयोगकर्ताओं तक सीमित रहेंगे। Anthropic ने Mythos के साथ अधिक प्रतिबंधात्मक रास्ता अपनाया है — यह उसके Claude Fable 5 मॉडल का एक संस्करण है जिसमें साइबर सुरक्षा सुरक्षा-उपाय हटा दिए गए हैं और जो केवल जाँची-परखी संस्थाओं को उपलब्ध कराया जाता है।
बाज़ारों ने पिछली रिलीज़ों जैसी प्रतिक्रिया नहीं दी। GLM-5.3 की घोषणा वाले दिन, 14 अगस्त को, Z.ai के हांगकांग-सूचीबद्ध शेयर 3.6% गिरकर बंद हुए, जो गर्मियों की शुरुआत में GLM-5.2 को मिले उत्साह के विपरीत है, जब जून के अंत तक शेयर जनवरी की लिस्टिंग से 2,000% से अधिक चढ़ चुका था।
स्रोत और क्रेडिट
मूल स्रोत: KrASIA