Huawei Atlas 960E SuperPod पॅक 4,096 NPUs मोठ्या प्रमाणात AI साठी

Huawei ने शांघायमधील HUAWEI CONNECT 2026 येथे Atlas 960E सुपरपॉडचे अनावरण केले आहे, ज्याला कंपनीने जवळ-पॅकेज्ड ऑप्टिक्स (NPO) वर आधारित उद्योगातील पहिला सुपरपॉड म्हटले आहे. 10-ट्रिलियन-पॅरामीटर मार्ककडे जाणाऱ्या फाउंडेशन मॉडेल्ससाठी मोठ्या प्रमाणात एआय प्रशिक्षण आणि अनुमान काढण्यासाठी ही प्रणाली तयार केली गेली आहे. स्टँडअलोन AI प्रोसेसरच्या विपरीत, Atlas 960E सुपरपॉड संपूर्ण संगणकीय प्रणाली म्हणून तयार केला आहे.

तपशील

Huawei Atlas 960E SuperPod मोठ्या प्रमाणात AI संगणनाला एकाच उच्च घनतेच्या प्रणालीमध्ये आणण्यासाठी डिझाइन केले आहे. Huawei च्या मते, ते 4,096 NPUs पर्यंत स्केल करू शकते, FP8 च्या 8 EFLOPS पर्यंत आणि FP4 कार्यक्षमतेच्या 16 EFLOPS पर्यंत, HBM क्षमतेच्या 1PB पर्यंत वितरीत करते.

युनिफाइड मेमरी ॲड्रेसिंगसाठी सिस्टीम युनिफाइडबस वापरते आणि त्याला Huawei च्या Hi-ONE NPO ऑप्टिकल इंटरकनेक्ट तंत्रज्ञानासह एकत्रित करते, 5,500 Hi-ONE युनिट्स प्रति इंजिन 7.2 Tbit/s पर्यंत ट्रान्समिशन क्षमता प्रदान करते. पूर्णतः लिक्विड-कूल्ड SuperPoD 550 KW पेक्षा जास्त वीज वापर कमी करते आणि 99.8% सिस्टम उपलब्धता मिळवते असा दावा केला जातो.

प्रतिमा स्रोत: Huawei

मल्टी-रेल टोपोलॉजी वापरताना Huawei 512,000 NPU किंवा 1 दशलक्ष NPU पर्यंत स्केलिंगचे वर्णन करून, मल्टिपल Atlas 960E SuperPoDs मोठ्या सुपरक्लस्टरमध्ये देखील जोडले जाऊ शकतात.

ही कल्पना हजारो स्वतंत्र कामगारांना एका समन्वित संघात बदलण्यासारखी आहे. प्रत्येक सर्व्हरला एक वेगळे मशीन मानण्याऐवजी, सुपरपॉड आर्किटेक्चरचे उद्दिष्ट प्रोसेसर आणि मेमरी एका मोठ्या संगणकीय वातावरणासारखे वागणे हे आहे.

4,096 NPUs आणि FP8 Compute चे 8 EFLOPS

एका सुपरपॉडमध्ये 4,096 NPU आणण्याची क्षमता ही Huawei चे हेडलाइन आकृती आहे. कंपनी म्हणते की तिचे युनिफाइडबस आर्किटेक्चर युनिफाइड मेमरी ॲड्रेसिंग आणि क्रॉस-सर्व्हर मेमरी ऍक्सेस सक्षम करते, प्रोसेसरला पारंपारिक सर्व्हरच्या सीमांवर पूर्णपणे विसंबून न राहता संवाद साधण्यास मदत करते.

Huawei च्या मते, Atlas 960E FP8 वर 8 EFLOPS आणि FP4 वर 16EFLOPS पर्यंत पोहोचते. हे आकडे स्वतंत्रपणे सत्यापित वास्तविक-जागतिक कार्यप्रदर्शनापेक्षा सिस्टमच्या दावा केलेल्या सैद्धांतिक AI संगणन क्षमतेचे वर्णन करतात.

हा फरक महत्त्वाचा आहे कारण एक मोठी पीक-कंप्युट संख्या प्रत्येक AI वर्कलोडमध्ये समान पातळीच्या कामगिरीमध्ये स्वयंचलितपणे अनुवादित होत नाही. वास्तविक परिणाम मॉडेल, सॉफ्टवेअर, मेमरी ऍक्सेस, नेटवर्किंग आणि ऑप्टिमायझेशनवर अवलंबून असू शकतात.

हाय-स्पीड इंटरकनेक्टसाठी Huawei NPO आणि Hi-ONE वापरते

Huawei च्या डिझाइनचा सर्वात असामान्य भाग म्हणजे जवळ-पॅकेज केलेले ऑप्टिक्स किंवा NPO चा वापर.

Huawei चे Hi-ONE ऑप्टिकल इंजिन संगणकीय घटकांमध्ये मोठ्या प्रमाणात डेटा हलविण्यासाठी डिझाइन केलेले आहे. कंपनी म्हणते की प्रत्येक Hi-ONE इंजिन 7.2 Tbit/s ची ट्रान्समिशन क्षमता प्रदान करते आणि सध्या एकात्मिक प्रकाश स्रोतासह तिचे एकमेव NPO उत्पादन आहे.

Atlas 960E SuperPoD 5,500 Hi-ONE युनिट्स एकत्रित करते. Huawei म्हणते की हा दृष्टीकोन 48,000 800G ऑप्टिकल मॉड्यूल्सची गरज काढून टाकतो ज्यांना पारंपारिकपणे सर्व NPUS कनेक्ट करण्यासाठी आवश्यक असेल.

कंपनीचा दावा आहे की यामुळे 550 kW पेक्षा जास्त वीज वापर कमी होतो आणि सिस्टमचा दोष-मुक्त ऑपरेटिंग वेळ दुप्पट होतो, दावा केलेल्या 99.8% सिस्टम उपलब्धतेमध्ये योगदान देते.

हे Huawei चे नमूद केलेले आकडे आहेत आणि ते स्वतंत्रपणे सत्यापित बेंचमार्क म्हणून मानले जाऊ नये.

युनिफाइडबस Huawei च्या AI पायाभूत सुविधांना स्केल करण्यात मदत करते

युनिफाइडबस ही प्रणालीचा आणखी एक महत्त्वाचा भाग आहे. Huawei त्याचे वर्णन सर्व-ऑप्टिकल नेटवर्किंग आर्किटेक्चर म्हणून करते जे युनिफाइड मेमरी ॲड्रेसिंग प्रदान करताना घटक कनेक्ट करण्यासाठी डिझाइन केलेले आहे.

कंपनीने AI प्रवेगकांच्या पलीकडे आपला SuperPoD दृष्टिकोन देखील वाढवला आहे. त्याचे अपग्रेड केलेले TaiShan 950 SuperPoD आर्किटेक्चरला सामान्य-उद्देशीय संगणनावर लागू करते, 4,096 नोड्सपर्यंत आणि 256 TB पर्यंत युनिफाइड मेमरी पूलचे समर्थन करते, Huawei नुसार.

Huawei ने OceanStor M900 देखील सादर केला, जो युनिफाइडबस-संचालित संदर्भ-मेमरी स्टोरेज क्लस्टर आहे जो त्याच्या L3.5 आर्किटेक्चरसाठी थेट वन-हॉप प्रवेश प्रदान करण्यासाठी आणि थेट वन-हॉप प्रवेश आणि पेटाबाईट-स्केल केव्ही कॅशे प्रदान करण्यासाठी डिझाइन केलेला आहे.

Huawei स्मार्ट चष्मा
प्रतिमा क्रेडिट: Chinaimages/Depositphotos

4,096 NPUS ते दशलक्ष-प्रोसेसर प्रणाली

Huawei च्या स्केलिंग महत्वाकांक्षा एकाच Atlas 960E SuperPod च्या पलीकडे जातात.

कंपनीचे म्हणणे आहे की मोठे सुपरक्लस्टर तयार करण्यासाठी अनेक Atlas 960E सुपरपॉड्स युनिफाइडबस किंवा RoCE द्वारे कनेक्ट केले जाऊ शकतात. त्याची सुरुवातीची आर्किटेक्चर 512,000 NPUs पर्यंत कनेक्ट करू शकते, तर मल्टी-रेल टोपोलॉजी सिस्टीमला 10 लाख NPU पर्यंत स्केल करू शकते.

तथापि, दशलक्ष-NPU आकृती Huawei च्या मोठ्या सुपरक्लस्टर स्केलिंग क्षमतेचा संदर्भ देते, सध्या तैनात केलेले एकही Atlas 960E SuperPoD नाही.

मोठ्या एआय मॉडेल्ससाठी याचा अर्थ काय आहे

जसजसे एआय मॉडेल्स मोठे होत जातात, तसतसे इन्फ्रास्ट्रक्चर डिझाइन वैयक्तिक प्रोसेसरच्या कच्च्या कार्यक्षमतेपेक्षा अधिक अवलंबून असते. मेमरी क्षमता, इंटरकनेक्ट बँडविड्थ, वीज वापर आणि हजारो प्रोसेसर समन्वयित करण्याची क्षमता तितकीच महत्त्वाची ठरू शकते.

Huawei चे Atlas 960E SuperPoD Ascend NPUs आणि UniifiedBus, Hi-ONE NPO तंत्रज्ञान आणि SuperPoD आर्किटेक्चरला एकाच सिस्टीममध्ये एकत्रित करून आव्हान पूर्ण करते.

ही घोषणा Huawei च्या ओपन कंप्युटिंग इकोसिस्टमच्या व्यापक पुशलाही बसते. HUAWEI CONNECT 2026 दरम्यान, कंपनीने सांगितले की त्यांचे CANN प्लॅटफॉर्म शाश्वत, समुदाय-चालित मुक्त-स्रोत विकासाकडे वळले आहे.

(स्त्रोत)

Comments are closed.