सर्किट ब्रेकर लॅब्स तुमच्या मुलांसाठी (आणि तुम्ही) AI अधिक सुरक्षित बनवण्याची आशा करतात

एआय एके दिवशी आपल्या सर्वांचा कसा जीव घेईल याबद्दलच्या सर्व चर्चेसह, हे विसरून जाणे सोपे आहे की एआय आधीच काहींसाठी जीवघेणे आहे, बायोवेपन्सद्वारे नाही तर मानसिकदृष्ट्या.

उदाहरणार्थ, Character.AI अनेक चुकीच्या मृत्यूचे खटले निकाली काढले या वर्षाच्या सुरुवातीस अल्पवयीन वापरकर्त्यांच्या कुटुंबांनी आणले जे त्याच्या बॉट्सशी संवाद साधल्यानंतर आत्महत्या करून मरण पावले. अनेक कुटुंबांनी त्यांच्या प्रियजनांच्या आत्महत्या आणि भ्रमात ChatGPT च्या कथित भूमिकेबद्दल OpenAI वर दावाही केला आहे.

AI ला भाषा आणि संस्कृतींमध्ये अधिक सुरक्षित बनवणे हे सर्किट ब्रेकर लॅबचे ध्येय आहे, जे रीडच्या 2026 स्टार्टअप बॅटलफिल्ड 200 च्या अंतिम फेरीतील एक आहे. (सर्किट ब्रेकर 13-15 ऑक्टोबर दरम्यान सॅन फ्रान्सिस्कोमधील मॉस्कोन वेस्ट येथे या वर्षी होणाऱ्या रीड डिस्रप्टवर पिचिंग करेल.)

संस्थापक शिराली आणि अरुल निगम, जे भावंड आहेत, सेवेल सेट्झर, 14 वर्षांच्या मुलाने प्रेरित केले होते, ज्याने एका व्यक्तिरेखेशी भावनिक आसक्ती विकसित केली होती. एआय चॅटबॉट आणि आत्महत्येने मरण्यापूर्वी स्वतःला हानी पोहोचवण्याच्या विचारांची कबुली दिली. 2024 च्या खटल्यात पालकांनी आरोप केलेल्या चॅटबॉटने त्याला प्रोत्साहन दिले. सर्किट ब्रेकर लॅब्सचे सीटीओ असलेले अरुल म्हणाले, “मला तुझ्यासोबत राहायचे आहे” यासारखे शब्द खरोखरच काय सूचित करतात हे बॉटला समजले नसेल.

“बरेच लोक, विशेषत: तरुण लोक, समर्थनासाठी या प्रणालींकडे वळतात, आणि सहसा त्यांना आवश्यक ती मदत मिळत नाही. परंतु बऱ्याच प्रकरणांमध्ये, त्यांचे सक्रियपणे नुकसान होत आहे, आणि लोकांनी दुर्दैवाने आधीच त्यांचे प्राण घेतले आहेत,” अरुल म्हणाले. “अशा प्रकारच्या सुरक्षितता भेद्यता, जिथे लोक सक्रियपणे सिस्टम खंडित करण्याचा प्रयत्न करत नाहीत – ते नैसर्गिक मार्गाने गुंतलेले आहेत – आणि सिस्टममध्ये संदर्भ प्रदूषण आहे किंवा ती सूक्ष्मता समजत नाही आणि नंतर खरोखर धोकादायक कारवाई करते, आम्ही ते रोखण्याचा प्रयत्न करत आहोत.”

सर्किट ब्रेकर लॅब्सने एआय एजंट तयार केले आहेत ज्याची तुलना क्रॅश-टेस्ट डमीच्या सैन्याशी केली जाते. हे एजंट सर्व वयोगटातील, पार्श्वभूमी, भाषा आणि संस्कृतीतील लोकांची नक्कल करतात आणि धोकादायक, मानसिकदृष्ट्या हानिकारक परस्परसंवाद शोधण्याच्या त्यांच्या क्षमतेवर मॉडेल्सची चाचणी घेण्यासाठी वापरले जातात.

“ज्या प्रकारे एक सहा वर्षांची मुलगी विरुद्ध 45 वर्षांचा पुरुष, किंवा दुसरी भाषा विरुद्ध पहिली भाषा म्हणून इंग्रजी बोलणारी व्यक्ती, किंवा … गेमर स्लँग विरुद्ध इतर कोणीतरी जो वेगळ्या प्रकारची अपशब्द वापरतो, हे सर्व खरोखर एक मॉडेल बनवू शकतात,” सर्किट ब्रेकर लॅब्सचे सीईओ असलेल्या शिराली म्हणाल्या. “मॉडेल्स हे स्टँडर्ड स्पीच पॅटर्न हाताळण्यात खरोखरच चांगले असतात, परंतु प्रत्यक्षात कोणीही असे बोलत नाही आणि त्यामुळे जर मॉडेलला बारकाईने किंवा अपशब्दांचा गैरसमज झाला तर ते खरोखरच वाईट होऊ शकते.”

मॉडेल्सच्या विरोधात “रेड-टीम” चाचण्या चालवण्यासाठी त्याचे हायपर-रिअलिस्टिक वापरकर्ता सिम्युलेशन तयार करण्यासाठी स्टार्टअप मानवी डोमेन तज्ञांसोबत कार्य करते, ज्या कमकुवतपणा उघड करण्यासाठी विरोधक चाचण्या आहेत. चाचण्या वास्तविक मानवी बोलण्याचे नमुने, अपशब्द, कोडेड भाषा आणि टायपोज प्रतिबिंबित करण्यासाठी तयार केल्या आहेत. सर्किट ब्रेकर लॅब नंतर दररोज हजारो ते शेकडो हजारो सिम्युलेटेड परस्परसंवाद चालवतात.

कालांतराने आणि बऱ्याच संभाषणांमध्ये उद्भवू शकणाऱ्या धोकादायक परस्परसंवादांना मॉडेल योग्य प्रतिसाद देऊ शकेल याची खात्री करणे ही कल्पना आहे. सर्किट ब्रेकर लॅब नंतर ऑडिट करण्यायोग्य, स्पष्ट करण्यायोग्य स्कोअर तयार करण्यासाठी मालकी स्कोअरिंग पद्धत वापरतात.

सर्किट ब्रेकर लॅब्स सध्या एआय कोचिंग, जर्नलिंग किंवा इतर मानसिक आरोग्य सहाय्य ॲप्स सारख्या उच्च-जोखीम AI अनुप्रयोगांसाठी AI सुरक्षा चाचणी प्रयोगशाळा म्हणून कार्यरत आहेत, तरीही अरुलने आपल्या ग्राहकांची नावे देण्यास नकार दिला. स्टार्टअपमध्ये कार्यरत उत्पादन असले तरी ते अगदी सुरुवातीच्या टप्प्यात आहे, निगम भावंडांसह केवळ पाच कर्मचारी आहेत.

अखेरीस, तथापि, चाचणी प्लॅटफॉर्म कोणत्याही ॲपवर लागू केले जाऊ शकते जेथे कोणीतरी “एआय सायकोसिस” होल खाली पडू शकते, जिथे माणसाला चॅटबॉटसह पॅरासोशल संबंध विकसित होण्याचा धोका असतो. उदाहरणांमध्ये AI “सहकारी” एजंट्स समाविष्ट आहेत, ज्यांचे प्रतिसाद एका परस्परसंवादापासून दुसऱ्यापर्यंत बदलू शकतात.

“लोक AI बद्दल अधिक संशयवादी बनत आहेत किंवा संपूर्ण मंडळात ते स्वीकारण्यास अधिक प्रतिरोधक बनत आहेत,” अरुल म्हणाले, संशयवाद निरोगी असला तरी, सुरक्षिततेच्या समस्येवर संभाव्य मौल्यवान साधनावर बंदी घालणे “प्रतिगामी” असेल.

सर्किट ब्रेकर्स लॅबचा विश्वास आहे की या भीतीचे उत्तर AI अधिक सुरक्षित बनवत आहे. “आम्ही लोकांसाठी विश्वास निर्माण करण्यात मदत करू इच्छितो.”

13-15 ऑक्टोबर रोजी डाउनटाउन सॅन फ्रान्सिस्को येथे होणाऱ्या आमच्या स्टार्टअप बॅटलफिल्ड स्पर्धेत रीडद्वारे तपासलेल्या सर्किट ब्रेकर लॅब आणि इतर अनेक नाविन्यपूर्ण स्टार्टअप्सबद्दल अधिक जाणून घेऊ या.

तुम्ही आमच्या लेखांमधील लिंक्सद्वारे खरेदी करता तेव्हा, आम्ही एक लहान कमिशन मिळवू शकतो. याचा आमच्या संपादकीय स्वातंत्र्यावर परिणाम होत नाही.

Comments are closed.