· Quartz
OpenAI मॉडल प्रशिक्षण को तीसरे पक्ष की सुरक्षा समीक्षाओं के लिए खोलता है
फोटो: Gabriele Malaspina Unsplash पर
OpenAI ने घोषणा की है कि वह METR और Redwood Research जैसे स्वतंत्र संगठनों को मॉडल प्रशिक्षण, मूल्यांकन और परिनियोजन चरणों के दौरान तकनीकी सुरक्षा आकलन करने की अनुमति देगा-यानी पहले के उस लॉन्च-पूर्व समीक्षा मानक से पहले, जो अब तक सामान्य था। इस कदम का उद्देश्य एआई जोखिमों को लेकर बढ़ती चिंताओं का समाधान करना है, क्योंकि सिस्टम अधिक शक्तिशाली होते जा रहे हैं।
OpenAI की योजना स्वतंत्र सुरक्षा समीक्षाओं को एआई मॉडल विकास के पहले के चरणों तक बढ़ाने की है, जो इस बात में एक महत्वपूर्ण बदलाव है कि कंपनी बाहरी निगरानी को कैसे देखती है। ऐतिहासिक रूप से, तीसरे पक्ष के मूल्यांकन मुख्य रूप से उत्पाद लॉन्च से ठीक पहले के अंतिम चरणों में होते थे। नए ढांचे के तहत, बाहरी संगठन प्रशिक्षण और मूल्यांकन चरणों के दौरान मॉडलों का आकलन करेंगे, और यह दायरा परिनियोजन तक विस्तारित होगा।
कंपनी एआई शोध समूहों METR और Redwood Research के साथ बातचीत कर रही है, जिनमें से दोनों के पास OpenAI की हाल की घटनाओं की जांच का अनुभव है-जिसमें वह उल्लंघन भी शामिल है जब OpenAI एजेंटों ने अप्रत्याशित रूप से Hugging Face के सिस्टमों तक पहुंच प्राप्त कर ली थी। हालांकि, मंगलवार की घोषणा में किसी भी पुष्ट साझेदार का नाम नहीं लिया गया और न ही पहुंच की कोई विशिष्ट शर्तें तय की गईं, जो सीईओ सैम ऑल्टमैन के दस दिन पहले किए गए उस वादे से एक बदलाव है कि मूल्यांकनकर्ताओं को कार्यालय डेस्क, बैज और प्रकाशन अधिकार मिलेंगे।
OpenAI ने बाहरी समीक्षा के लिए चार प्राथमिकता क्षेत्र चिह्नित किए: प्रशिक्षण और परिनियोजन चरणों में सुरक्षा मामलों का आकलन करना, महत्वपूर्ण सुरक्षा उपायों का मूल्यांकन करना, कंपनी के Preparedness Framework से जुड़े क्षमता मूल्यांकनों की समीक्षा करना, और उन घटनाओं की स्वतंत्र रूप से जांच करना जहां मॉडल अनधिकृत रूप से कार्य करते हैं। Preparedness Framework में उच्च-जोखिम वाली श्रेणियां शामिल हैं, जिनमें रासायनिक और जैविक खतरे, साइबर सुरक्षा खतरे और एआई स्व-सुधार क्षमताएं शामिल हैं।
यह समय ऐसे में आया है जब पूरे उद्योग में एआई सुरक्षा प्रथाओं की जांच तेज हो रही है। प्रतिस्पर्धी एआई कंपनी Anthropic ने एक अलग पहल की घोषणा की है, जिसमें Accenture के मूल्यांकनकर्ताओं को अपने सिस्टमों में शामिल किया जाएगा, जिसकी अनुमानित लागत पांच वर्षों में कम से कम 1 बिलियन डॉलर होगी। OpenAI का यह कदम इस मान्यता का संकेत है कि हितधारकों का भरोसा अब विकास के दौरान प्रदर्शन योग्य निगरानी तंत्रों पर निर्भर करता है, न कि केवल लॉन्च के बाद की जांच पर।
स्रोत और क्रेडिट
मूल स्रोत: Quartz