ओपनएआयने हगिंग फेस भंगानंतर नवीन सुरक्षा उपायांची स्थापना केली आहे
मंगळवारी, ओपनएआयने मॉडेल्सची चाचणी सुरू असताना सुरक्षा घटनांवर लक्ष केंद्रित केलेल्या सुरक्षा धोरणांच्या नवीन बॅचची घोषणा केली. नवीन सुरक्षा उपायांमध्ये विकास प्रक्रियेदरम्यान मॉडेल्सचे अधिक तपशीलवार निरीक्षण, तसेच प्रशिक्षणोत्तर प्रक्रियेदरम्यान संरेखन आणि सुरक्षिततेवर अधिक भर देणे समाविष्ट आहे.
“जशी मॉडेल्स अधिक सक्षम होतात, तसतसे ते विकसित करणे आणि त्यांची आंतरिक चाचणी करण्याशी संबंधित जोखीम देखील वाढतात,” कंपनी म्हणाली. ब्लॉग पोस्ट मध्ये. “निरीक्षण, संरेखन आणि सुरक्षिततेसाठी आमची मानके त्या जोखमींपेक्षा पुढे राहिली पाहिजेत.”
नवीन उपाय हे ओपनएआयच्या सुरक्षा पद्धतींमध्ये हगिंग फेस घटनेच्या तात्काळ नंतरच्या सार्वजनिक बदलांपैकी एक आहे, जे होते 21 जुलै रोजी खुलासा केला.
ओपनएआयच्या प्रतिनिधींनी सांगितले की हे उपाय हगिंग फेसच्या घटनेला थेट प्रतिसाद देत नाहीत परंतु आगामी ॲस्ट्रा मॉडेलच्या सायबरसुरक्षा क्षमता तसेच AI विकासातील प्रगतीच्या एकूण गतीमुळे देखील ते काही प्रमाणात भडकले होते.
त्याच पोस्टमध्ये, ओपनएआयने खुलासा केला की हगिंग फेसच्या घटनेनंतर त्याने दोन आठवड्यांसाठी रीइन्फोर्समेंट लर्निंग (RL) थांबवले होते परंतु त्यानंतर अनेक कमी-जोखमीची मॉडेल्स रीस्टार्ट केली होती.
“आम्ही मॉडेल वर्तनाचे मूल्यांकन करण्यासाठी, आमच्या सुरक्षिततेचे प्रमाणीकरण करण्यासाठी आणि पुढे जाण्यापूर्वी संरेखनाचे अधिक पुरावे स्थापित करण्यासाठी लहान-प्रशिक्षण आणि मूल्यमापन आयोजित करत असताना आमची सर्वात मोठी नियोजित सीमा RL रन थांबलेली आहे,” पोस्ट वाचते.
पत्रकारांशी बोलताना, ओपनएआयच्या संशोधनाचे व्हीपी, अमेलिया ग्लेस यांनी यावर जोर दिला की मॉडेल्स अधिक सक्षम झाल्यामुळे नियंत्रणांची कठोरता वाढेल, सर्वात मोठ्या मॉडेल्सना सर्वात जास्त छाननीचा सामना करावा लागेल.
“आम्ही सुरक्षित विकासासाठी आवश्यकता आणि अपेक्षा ठेवल्या आहेत,” ग्लेस यांनी पत्रकारांना सांगितले. “आम्ही पाहत असलेल्या जोखमीच्या पातळीनुसार त्या आवश्यकता आणि अपेक्षा बदलतात.”
या घटनेच्या पार्श्वभूमीवर ओपनएआयवर खराब नेटवर्क सुरक्षा पद्धतींबद्दल टीका करण्यात आली आहे, ज्यामध्ये मॉडेल्सने त्यांच्या नेटवर्कवरील इंटरनेटवर प्रवेश असलेल्या साधनाशी तडजोड करून त्यांच्या प्रशिक्षण वातावरणातून सुटका केली आहे. नवीन सुरक्षा उपायांमध्ये मजबूत नेटवर्क अलगाव पद्धतींचा समावेश आहे, जरी तपशील अस्पष्ट राहतात. नवीन प्रणाली अंतर्गत, पोस्ट म्हणते, “वर्कलोड किंवा सपोर्टिंग सेवेची एकच तडजोड, स्वतःच, इंटरनेट किंवा इतर अंतर्गत नेटवर्कवर अनधिकृत प्रवेशास परवानगी देत नाही.”
सर्वात मजबूत संरक्षण म्हणजे मॉनिटरिंग सिस्टम, जी विविध प्रकारच्या अनधिकृत वर्तनासाठी टूल कृती, उपलब्ध तर्काचे ट्रेस आणि क्रियाकलाप लॉगचे परीक्षण करेल. OpenAI म्हणते की संबंधित क्रियाकलापाच्या 30 मिनिटांच्या आत अलर्ट जारी करण्याचे त्यांचे उद्दिष्ट आहे.
ओपनएआयचा अंदाज आहे की त्या देखरेखीचा गणनेचा भार जे काही निरीक्षण केले जात आहे त्याच्या अंदाजे 20% असेल. कंपनीने आगामी ब्लॉग पोस्टमध्ये सिस्टमवर अधिक तपशील देण्याचे वचन दिले आहे. या घटनेचे कंपनीचे अधिकृत पोस्टमॉर्टम विश्लेषण देखील बाकी आहे.
तुम्ही आमच्या लेखांमधील लिंक्सद्वारे खरेदी करता तेव्हा, आम्ही एक लहान कमिशन मिळवू शकतो. याचा आमच्या संपादकीय स्वातंत्र्यावर परिणाम होत नाही.
Comments are closed.