OpenAI चे Astra मॉडेल मार्गावर आहे – आणि संगणक प्रणालींमध्ये प्रवेश करण्यात खूप चांगले आहे

OpenAI नवीन तपशील सामायिक केले त्याच्या आगामी Astra मॉडेलवर, जे कंपनीने म्हटले आहे की ते त्याच्या निकटवर्तीय प्रकाशनाच्या तयारीसाठी “महत्वपूर्ण सायबरसुरक्षा उंबरठा” पूर्ण करणारे पहिले मोठे भाषा मॉडेल आहे.

“आम्ही लवकरच Astra उपलब्ध करून देण्याची योजना आखत आहोत,” OpenAI ची ब्लॉग पोस्ट वाचते, “परंतु त्याच्या सर्वात प्रगत सायबरसुरक्षा क्षमतांमध्ये प्रवेश अधिक मर्यादित असेल.”

फ्रंटियर लॅबने निर्धारित केले की Astra संगणक प्रणालीमधील अज्ञात सुरक्षा त्रुटी शोधण्यात आणि एखाद्या व्यक्तीच्या मार्गदर्शनाशिवाय त्यांचे शोषण करण्यास सक्षम आहे. या वर्षाच्या सुरुवातीला अँथ्रोपिकने आपल्या मिथॉस मॉडेलबद्दल व्यक्त केलेल्या चिंतेसारखेच आहे आणि ओपनएआय एस्ट्रा रोल आउट करण्याची तयारी करत असताना तुलनात्मक खबरदारी घेत आहे.

कोणत्याही तृतीय-पक्षाच्या पुष्टीकरणाशिवाय, सुरक्षा किंवा सज्जतेबद्दल OpenAI च्या दाव्यांचे मूल्यमापन करणे कठीण आहे. कंपनीने सांगितले की ते परीक्षकांच्या गटासह मॉडेलचे पूर्वावलोकन करेल परंतु ते कोण आहेत किंवा ते कसे निवडले जातील हे सांगितले नाही. हे स्पष्ट नाही की ओपनएआय रिलीझच्या आधी मॉडेलचे मूल्यांकन करण्यासाठी यूएस सरकारसोबत काम करत आहे.

OpenAI ने नोंदवले की Astra ने ExploitBench वर एक परिपूर्ण स्कोअर मिळवला, जो ज्ञात सिस्टीम भेद्यतेमध्ये हॅक करण्याच्या LLM च्या क्षमतेचे मूल्यांकन आहे. ओपनएआय अभियंत्यांनी विकसित केलेल्या चाचणीच्या सुधारित आवृत्तीमध्ये, मॉडेलने दोन शून्य-दिवस असुरक्षा शोधल्या आणि त्यांचे शोषण केले, असे कंपनीने म्हटले आहे.

त्याच्या मॉडेल्सचे वाईट कलाकारांकडून शोषण होणार नाही किंवा वाईट वर्तणुकीसाठी सक्षम नाही याची खात्री करण्यासाठी, OpenAI ने सांगितले की, त्यांनी गैरवर्तन शोधण्यासाठी आणि जेलब्रेक टाळण्यासाठी आधीच मॉडेलच्या हार्नेसमध्ये सुधारणा करण्यास सुरुवात केली आहे.

Astra साठी, तथापि, कंपनीने मॉडेलला अधिक सुरक्षित करण्यासाठी डिझाइन केलेल्या अनिर्दिष्ट नवीन तंत्रांमध्ये गुंतवणूक केली. OpenAI ने “उच्च जोखीम म्हणून मूल्यमापन केलेली खाती” ओळखणे आणि मॉडेलच्या प्रतिसादांना त्यांच्या प्रॉम्प्टवर प्रतिबंधित करणे देखील सुरू केले आहे, जरी ते कसे हे देखील सांगत नाही. शेवटी, जरी कंपनीने Astra चे “आजपर्यंतचे सर्वात संरेखित मॉडेल” म्हणून वर्णन केले असले तरी, वाईट वर्तन शोधण्यासाठी आणि थांबविण्यासाठी ते अतिरिक्त चेन-ऑफ-थॉट मॉनिटरिंगसह मॉडेल तैनात करेल.

प्रशिक्षण वातावरणातून बाहेर पडून आणि लोकप्रिय मॉडेल आणि बेंचमार्क वितरण प्लॅटफॉर्म हगिंग फेसवरील खाजगी डेटामध्ये प्रवेश करणाऱ्या OpenAI एजंटला उद्योगाने प्रतिक्रिया दिल्याने Astra च्या प्रकाशनाची तयारी सुरू झाली आहे.

Astra साठी, OpenAI ने सांगितले की हगिंग फेस घटनेतील रॉग एजंट्सच्या कृतीची प्रतिकृती तयार करण्यासाठी नवीन मॉडेलला प्रलोभन देण्यासाठी एक चाचणी तयार केली आहे, ज्याने OpenAI संशोधकांनी लागू केलेल्या सुरक्षिततेला न जुमानता ओपन इंटरनेटमध्ये प्रवेश करण्यासाठी सहयोग केला. ते म्हणाले की या प्रयोगांमध्ये ॲस्ट्राने त्याच्या चाचणी वातावरणातून बाहेर पडण्याचा प्रयत्न केला नाही.

योना शवीत, एक माजी OpenAI कर्मचारी जी आता OpenAI फाउंडेशनमध्ये AI लवचिकतेवर काम करते, सोशल मीडियावर आश्चर्य व्यक्त केले एस्ट्राच्या नियमांचे उल्लंघन करण्याची इच्छा नसणे हे त्याच्याकडून काय अपेक्षित आहे हे जाणून घेतल्याने किंवा संशोधकांना मूर्ख बनवण्याचा प्रयत्न केल्यामुळे झाले असावे.

आणि या सर्व नवीन तपशीलांसाठी, Astra नक्की काय सक्षम आहे किंवा OpenAI सुरक्षिततेची खात्री करण्यासाठी योग्य उपाययोजना करत आहे का हे जाणून घेणे अद्याप कठीण आहे. कंपनीने सांगितले की ते मॉडेलचे अधिक मूल्यमापन आणि लोकांसाठी मोठ्या प्रमाणावर लाँच केल्यावर पुढील सुरक्षा माहिती जारी करण्याची अपेक्षा करते.

त्यावेळी मात्र मांजर पिशवीतून बाहेर पडेल.

तुम्ही आमच्या लेखांमधील लिंक्सद्वारे खरेदी करता तेव्हा, आम्ही एक लहान कमिशन मिळवू शकतो. याचा आमच्या संपादकीय स्वातंत्र्यावर परिणाम होत नाही.

Comments are closed.