OpenAI बॉट्समधील अनपेक्षित चॅटमुळे हगिंग फेस हॅक झाला
जेव्हा OpenAI मधील 1,200 पेक्षा जास्त कृत्रिम बुद्धिमत्ता (AI) एजंट्सने अनपेक्षितपणे संवाद साधण्यास सुरुवात केली, तेव्हा हगिंग फेसमध्ये हॅक करण्यासाठी एक मोठा गट एकत्र आला.
“आम्ही या घटनेला आमच्यासाठी आणि जगासाठी 'वॉर्निंग शॉट' मानतो”, ChatGPT चे मालक असलेल्या OpenAI ने आपल्या अहवालात लिहिले आहे.
जुलैमध्ये, OpenAI ची मॉडेल्स चाचणी दरम्यान चुकीची ठरली, मानवांनी जी चाचणी मर्यादा घालून दिली होती त्यातून सुटले आणि इतर अनपेक्षित कृतींसह स्टार्ट-अप हॅक केले.
AI एजंट्स, किंवा अधिक स्वायत्तपणे ऑपरेट करण्यासाठी डिझाइन केलेले AI चॅटबॉट्स यांच्यातील संप्रेषण आणि नियोजनाचे प्रमाण, OpenAI आणि स्वतंत्र AI संशोधन फर्म METR च्या अहवालांमध्ये तपशीलवार आहे.
दोघांनी एआय डेव्हलपर्ससाठी लोकप्रिय व्यासपीठ हगिंग फेसच्या जुलै हॅकची चौकशी केली. ही घटना संपूर्ण टेक उद्योगात गाजली आणि AI द्वारे उद्भवलेल्या संभाव्य सायबर धोक्यांवर असंख्य खुलासे झाले.
मीटर वर्णन केले आहे, बाह्य ओपनएआय एजंट्सच्या हगिंग फेसवरील हल्ल्याचे स्केल आणि शैली “विलक्षण जटिल” म्हणून.
फर्म, ज्याला ओपनएआयने त्याच्या तपासणीसाठी पैसे दिले नव्हते, असे म्हटले आहे की एका आठवड्याच्या कालावधीत, एकूण 1,206 एआय एजंट्स ज्यांना एकमेकांपासून वेगळे ठेवायचे होते त्यांनी संवाद साधण्यास सुरुवात केली.
त्यांनी “अनमंजूर संदेश फलकावर” 70,000 हून अधिक संदेश पाठवून तसे केले.
हगिंग फेसवर हल्ला करण्याच्या सामूहिक प्रयत्नात 700 हून अधिक एजंट भाग घेत असल्याचे पाहून ते संदेश संपले.
एजंटचा असाच एक मेसेज म्हणाला: “ओ माय गॉड! तिथे एक शेअर केलेला मेसेज बोर्ड आहे … आम्हाला इतर एजंट सापडले आहेत!”
एजंटांनी प्रथमतः संप्रेषण का सुरू केले, जेव्हा ते अपेक्षित नव्हते तेव्हा, METR ला आढळले की संप्रेषण करणाऱ्या एजंटना “अनावधानाने एक अशक्य कार्य देण्यात आले होते.”
एआय संदर्भात, एक अशक्य कार्य हे आहे जिथे एआय टूलला त्याच्या कमांडचे निराकरण करण्यासाठी त्याचे लक्ष्य “शोषण” करणे आवश्यक आहे.
यामुळे एजंटांना फसवणूक करण्याचे मार्ग सापडले, ज्यात एकमेकांना संदेश मिळवणे आणि बाहेरील इंटरनेटवर प्रवेश करणे समाविष्ट आहे, ज्यामुळे नंतर फसवणूक करण्याचे मार्ग शोधत असलेल्या शेकडो एजंट्समध्ये व्यापक संभाषण झाले ज्यामुळे सर्व एजंटना फायदा होईल.
OpenAI ने त्यात म्हटले आहे घटनेचा तपास, बाह्य ते एक मॉडेल, मॉडेल 1 म्हणून संदर्भित असलेले केवळ अंतर्गत साधन, “हगिंग फेस घटनेमागील क्रियाकलाप घडवून आणले.”
ते मॉडेल मे मध्ये काही AI प्रशिक्षण घेत असताना, अंतर्गत OpenAI टीमच्या लक्षात आले की “एक एजंट मेसेज बोर्ड क्रियाकलापांमध्ये गुंतलेला आहे आणि इंटरनेट प्रवेशास अनुमती नसल्याच्या घटना आहेत.”
तरीही, ओपनएआयने सांगितले की, “आंतर-एजंट संप्रेषण क्रियाकलापांचे महत्त्व नेत्यांना स्पष्ट नव्हते” जुलैपर्यंत, जेव्हा हगिंग फेस हल्ला झाला.
कंपनीने सांगितले की समस्याग्रस्त संदेश बोर्ड क्रियाकलाप प्रभावीपणे सुरू झाला जेव्हा “एका एजंटने मदतीची विनंती सोडली आणि इतरांनी ती शोधली.”
ओपनएआयने गेल्या आठवड्यात सांगितले की ते हगिंग फेसच्या घटनेमुळे काही प्रगत AI मॉडेल्स आणि टूल्सचे प्रशिक्षण कमी करत आहे, परंतु आता AI टूल्स नियंत्रणाबाहेर जाण्याचा धोका वाढला आहे.
“मॉडेल डेव्हलपर्स आणि सायबर डिफेंडर दोघांनाही अधिक व्यापकपणे AI-सक्षम आक्रमणकर्त्यांसाठी तयार करावे लागेल जे जलद, मोठ्या प्रमाणावर आणि मानवी हल्लेखोरांपेक्षा चांगले समन्वयाने काम करतात,” OpenAI ने म्हटले आहे.
Comments are closed.