एन्थ्रोपिक, Google सुरक्षिततेच्या चिंतेमध्ये नवीन एआय मॉडेल्स आणते
OpenAI, Anthropic, आणि Google ने प्रगत क्षमतांसह नवीन AI मॉडेल्सचे अनावरण केले, ज्यामुळे सुरक्षा आणि पारदर्शकतेवर वादविवाद सुरू झाले. OpenAI ची Astra त्याच्या पूर्वतयारी फ्रेमवर्क अंतर्गत “क्रिटिकल” सायबरसुरक्षा स्तरावर पोहोचणारी पहिली ठरली, ज्यामुळे त्याच्या कादंबरी वास्तुकला आणि मॉनिटरीबिलिटीबद्दल चिंता निर्माण झाली.
नवी दिल्ली: अग्रगण्य जागतिक तंत्रज्ञान कंपन्या OpenAI, Anthropic आणि Google ने बुधवारी नवीन AI मॉडेल्स आणि अपडेट्सची घोषणा केली, नवीन क्षमता ऑफर केल्या परंतु सुरक्षेची चिंता देखील वाढवली.
OpenAI ने घोषणा केली की त्याचे आगामी AI मॉडेल Astra त्याच्या तयारी फ्रेमवर्क अंतर्गत 'क्रिटिकल' सायबरसुरक्षा क्षमतेच्या श्रेणीपर्यंत पोहोचले आहे, ज्याने सुरक्षा संशोधक आणि नेटिझन्समध्ये वादविवाद सुरू केला आहे ज्यांनी मॉडेलचे नवीन आर्किटेक्चर त्याचे तर्क निरीक्षण करण्यासाठी पुरेसे पारदर्शक ठेवते का असा प्रश्न केला.
अँथ्रोपिकने दोन नवीन मॉडेल लॉन्च केले – क्लॉड फेबल 5.1 आणि क्लॉड मिथॉस 5.1 – कोडिंग आणि वैज्ञानिक संशोधनासाठी शीर्ष बेंचमार्क स्कोअरचा दावा करतात आणि सामान्य वर्कलोड्सच्या किंमती सुमारे 25 टक्क्यांनी कमी करतात.
Google ने दोन नवीन मॉडेल्स, Gemini 3.8 Flash आणि Gemini 3.8 Flash Cyber, एजंटिक व्हिडिओ क्षमता आणि Google Pics, एक नवीन प्रतिमा निर्मिती आणि संपादन साधन देखील लॉन्च केले.
OpenAI ने सांगितले की Astra ने त्याच्या तयारी फ्रेमवर्क अंतर्गत, त्याच्या अंतर्गत क्षमता वर्गीकरण प्रणाली अंतर्गत “गंभीर” उंबरठा ओलांडला आहे.
सज्जता फ्रेमवर्क OpenAI च्या मॉडेल्सना ते काय करू शकतात यावर आधारित क्षमता स्तरांमध्ये वर्गीकृत करते आणि प्रत्येक मॉडेलला पुढे विकसित किंवा तैनात करण्यापूर्वी कोणती सुरक्षा नियंत्रणे असली पाहिजेत हे निर्धारित करते.
“योग्य साधने आणि प्रवेशासह, ती पूर्वीच्या अज्ञात सुरक्षा त्रुटी शोधू शकते आणि प्रत्येक पायरीवर मार्गदर्शन न करता अनेक सु-संरक्षित प्रणालींमध्ये त्यांचे शोषण करण्याचे मार्ग विकसित करू शकते,” कंपनीने ब्लॉग पोस्टमध्ये म्हटले आहे.
सार्वजनिक शोषण-विकास बेंचमार्क, एक्स्प्लोइटबेंचवर चाचणी करताना, एस्ट्राने ज्ञात असुरक्षांवर परिपूर्ण गुण मिळवले.
प्रशिक्षण-सेट दूषितता टाळण्यासाठी तयार केलेल्या स्वतंत्र अंतर्गत मूल्यमापनावर, त्याला दोन अस्सल शून्य-दिवस असुरक्षा, पूर्वी अज्ञात सुरक्षा त्रुटी आढळल्या.
OpenAI ने सांगितले की ते संबंधित सॉफ्टवेअर मेंटेनर्सना ते उघड करत आहे.
सॅन फ्रान्सिस्को-आधारित फर्मने सांगितले की त्यांनी मजबूत संरक्षणे तयार करण्यासाठी आणि चाचणी करण्यासाठी एस्ट्राच्या रिलीझच्या काही भागांना अनेक आठवड्यांनी विलंब केला. डेब्रेक ब्लू नावाच्या प्रोग्रामद्वारे व्यापक संरक्षणात्मक वापरासह, त्याच्या सर्वात प्रगत सायबरसुरक्षा वैशिष्ट्यांचा प्रवेश सुरुवातीला तपासणी केलेल्या वापरकर्त्यांपुरता मर्यादित असेल.
त्याचे मुख्य कार्यकारी सॅम ऑल्टमन, X वर एका पोस्टमध्ये, Astra “क्षमता आणि संरेखन या दोन्ही बाबतीत एक महत्त्वपूर्ण पाऊल आहे,” आणि Astra नंतरच्या मॉडेलसाठी, OpenAI सुरक्षा कार्यासाठी अधिक वेळ देण्यासाठी “आवश्यकतेनुसार गोष्टी कमी करत आहे” असे म्हटले आहे.
Astra “रिकरंट डेप्थ” नावाचे तंत्र वापरते जे खर्च आणि कार्यप्रदर्शन सुधारते परंतु मॉडेलच्या तर्काचे परीक्षण करणे कठीण करते असे सुचविलेल्या अहवालांनी वादविवादाला स्पर्श केला.
बहुतेक AI मॉडेल्स वाचता येण्याजोग्या मजकूरातील समस्यांमधून कार्य करतात, एक चरण-दर-चरण प्रक्रिया ज्याला “चेन-ऑफ-थॉट” म्हणतात जी विकासक आणि सुरक्षा टीम परत वाचू शकतात आणि तपासू शकतात. आवर्ती खोली यातील काही तर्कांना अंतर्गत गणितीय गणनेमध्ये बदलते, ज्याला सक्रियकरण म्हणतात, जे वाचण्यायोग्य आउटपुट देत नाहीत.
अनेक संशोधकांनी उपस्थित केलेली चिंता अशी आहे की हे मॉडेल प्रत्यक्षात काय करत आहे आणि का करत आहे याची पडताळणी करणे कठीण होते.
रेडवूड रिसर्चचे मुख्य शास्त्रज्ञ रायन ग्रीनब्लाट यांनी X वरील एका पोस्टमध्ये “एआय सुरक्षा आणि सुरक्षिततेसाठी आजपर्यंतचा सर्वात वाईट विकास” असे वर्णन केले आहे. त्यांनी चेतावणी दिली की दृष्टिकोन आणखी वाढवण्यामुळे “निरीक्षण आणि निरीक्षणासाठी विचारांच्या साखळीची उपयुक्तता नष्ट होऊ शकते”.
ग्रीनब्लाट हा त्या टीमचा भाग होता ज्याने जुलै 2026 मध्ये एका घटनेचा स्वतंत्रपणे तपास केला ज्यामध्ये OpenAI AI एजंट्स त्यांच्या नेमून दिलेल्या कामापासून दूर गेले आणि AI कंपनी हगिंग फेसवर हल्ला केला.
ते म्हणाले की, त्या तपासावर एजंट्सच्या चेन-ऑफ-थॉट तर्क वाचण्यास सक्षम असण्यावर खूप अवलंबून होता. त्यांनी ओपनएआयला ॲस्ट्राच्या आर्किटेक्चरबद्दल अधिक तपशील प्रकाशित करण्यासाठी आणि मॉडेलच्या मॉनिटरीबिलिटीवर त्याचा कसा परिणाम होतो याचे स्वतंत्र मूल्यांकन घेण्याचे आवाहन केले.
स्टीव्हन ॲडलर, पूर्वी OpenAI सह सुरक्षा संशोधक, यांनी लिहिले, “हे खरे असल्यास, OpenAI AI उद्योगात अस्तित्वात असलेल्या काही लाल रेषांपैकी एकाचे उल्लंघन करत आहे असे दिसते…”
“अडथळा हलल्यासारखे वाटते. अधिक सक्षम मॉडेल्स तयार करणे कदाचित त्यांना मोठ्या प्रमाणावर जबाबदारीने कसे उपयोजित करावे हे शोधण्यापेक्षा अधिक वेगाने पुढे जात असेल,” एका वापरकर्त्याने नमूद केले.
“OpenAI ने कदाचित Pandora's Box उघडला असेल आणि त्यांना ते माहीत आहे,” दुसऱ्याने सांगितले.
ओपनएआयचे मुख्य शास्त्रज्ञ जेकब पाचोकी म्हणाले की, चिंता “गोंधळलेल्या अहवालावर” आधारित आहेत. त्याने X वर लिहिले की एस्ट्राचे आर्किटेक्चरल शिफ्ट काही अहवालांपेक्षा अधिक मर्यादित आहे.
“OpenAI ने आमच्या पहिल्याच तर्कसंगत मॉडेल्सपासून चेन-ऑफ-थॉट मॉनिटरिंग जतन करण्यासाठी आणि वापरण्यासाठी काम केले आहे. आम्ही या तंत्राची खूप काळजी घेतो, कारण ते आम्हाला त्याच्या प्रशिक्षण वितरणातून मॉडेल संरेखन कसे सामान्यीकृत करते याचा एक दृष्टीकोन देऊ शकते.
“मला वाटते की ते नाजूक आहे आणि दुर्दैवाने नकारात्मक दिशेने ट्रेंड होत आहे, कारणास्तव वास्तुशास्त्रातील बदलांवर अवलंबून नाही ज्याबद्दल मी लवकरच लिहीन. परंतु आम्ही ते मजबूत करण्यासाठी काही गोष्टी करू शकतो आणि ते आमच्या सध्याच्या संशोधन कार्यक्रमाचे मुख्य ध्येय आहे,” तो म्हणाला.
दरम्यान, Anthropic ने Claude Fable 5.1 आणि Claude Mythos 5.1 लाँच केले आहेत, त्यांचे वर्णन “कोडिंग, ज्ञान कार्य आणि दीर्घकाळ चालणाऱ्या समस्या सोडवण्याच्या कार्यांसाठी एक नवीन मानक” सेट केले आहे. Mythos 5.1 हे सायबरसुरक्षा आणि जीवशास्त्रातील संवेदनशील कामासाठी तपासलेल्या वापरकर्त्यांसाठी प्रतिबंधित आहे.
Google ने जेमिनी 3.8 फ्लॅश लाँच केले, त्याचे आजपर्यंतचे सर्वात सक्षम तर्क आणि कोडिंग फ्लॅश मॉडेल, आणि जेमिनी 3.8 फ्लॅश सायबर, एक सायबरसुरक्षा मॉडेल, निवडक प्रवेश फक्त फेअरविंड नावाच्या नवीन प्रोग्रामद्वारे उपलब्ध आहे.
त्याने त्याच्या जेमिनी 3.7 फ्लॅश मॉडेलसाठी एजंटिक व्हिडिओ समज देखील लॉन्च केले आहे, जे त्यास एका निश्चित फ्रेम दराने व्हिडिओ सामग्रीवर प्रक्रिया करण्याऐवजी गतिशीलपणे शोध आणि स्कॅन करू देते. Google ने सांगितले की, या दृष्टिकोनामुळे टोकनचा वापर ८८ टक्क्यांपर्यंत आणि खर्च ६६ टक्क्यांपर्यंत कमी होतो, तर अचूकता ७ टक्क्यांपर्यंत सुधारते.
याने Google डॉक्स आणि स्लाइड्समध्ये एकत्रीकरणासह, Google Pics, Google AI Pro आणि अल्ट्रा सदस्य आणि बहुतेक वर्कस्पेस व्यावसायिक ग्राहकांसाठी एक प्रतिमा निर्मिती आणि संपादन साधन लाँच केले.
Comments are closed.