
मैले विगत बाह्र वर्षदेखि एआईमा काम गरिरहेको छु किनभने मलाई विश्वास छ कि यसले मानव जीवनको गुणस्तर नाटकीय रूपमा बढाउन सक्छ । मैले यी अविश्वसनीय फाइदाहरूको बारेमा बारम्बार लेखेको छु: मलाई विश्वास छ कि एआईले आगामी ५-१० वर्षमा धेरैजसो प्रमुख रोगहरू निको पार्न सक्छ, आर्थिक वृद्धि दरलाई तीव्र गति दिन सक्छ, प्रशस्तता र सशक्तिकरणको संसार सिर्जना गर्न सक्छ, र लोकतन्त्र र स्वतन्त्रताको पुनर्जागरणको सुरुवात गर्न सक्छ । म व्यक्तिगत रूपमा यो जरुरी महसुस गर्छु । मेरो आफ्नै बुबाको मृत्यु उनको मृत्युको केही वर्ष पछि मात्र निको भएको रोगबाट भयो, र म आफैं पनि प्रारम्भिक चरणको क्यान्सरबाट बचेँ जुन पचास वर्ष पहिले पनि उपचार गर्न सकिँदैनथ्यो । सावधानीपूर्वक प्रयोग गरिएको, एआई मानवतालाई उत्थान र सम्मानित गर्ने प्राविधिक चमत्कारहरूको लामो लाइनमा नवीनतम हुन सक्छ ।

तर यसभन्दा पहिलेका धेरै प्रविधिहरू जस्तै, एआईले जोखिमहरू ल्याउछ, र किनभने यो यति शक्तिशाली प्रविधि हो, यी जोखिमहरू गम्भीर छन् । मैले तिनीहरूको बारेमा पनि धेरै लेखेको छु । तिनीहरूमा एआई प्रणालीहरूको नियन्त्रण गुमाउने जोखिम, साइबर आक्रमण र जैविक आतंकवादको लागि एआईको दुरुपयोग, र गम्भीर आर्थिक अवरोध समावेश छ । व्यावसायिक प्रोत्साहनले गर्दा हुने तलतिरको दौडले यी जोखिमहरूलाई अझ तीव्र बनाउन सक्छ ।
मेरा सह-संस्थापकहरू र कर्मचारीहरूसँग मिलेर, मैले एन्थ्रोपिकको सुरुवातदेखि नै जोखिम र लाभको यो द्वैधतासँग जुधिरहेको छु । प्रविधि निर्माण नगर्दा मानवतालाई फाइदाबाट वञ्चित गरिन्छ वा केवल एआईलाई अधिनायकवादी शक्तिहरूको हातमा राखिन्छ, जबकि यसलाई धेरै छिटो निर्माण गर्नु लापरवाही हो । हामीले मध्यम बाटो खोजेका छौं: सावधानीपूर्वक निर्माण गर्न र व्यावसायिक रूपमा सफल हुन सम्भव छ भनेर देखाउन, र सुरक्षालाई त्यस्तो चीज बनाउन जसमा एआई कम्पनीहरूले प्रतिस्पर्धा गर्छन् । अर्को शब्दमा, शीर्षमा दौड सिर्जना गर्न । हामीले सधैं हाम्रा प्रयासहरूको एक महत्त्वपूर्ण अंश यी एआई जोखिमहरूको बारेमा अध्ययन, सम्बोधन र जनतालाई जानकारी गराउन समर्पित गरेका छौं, साथै एआईको राम्रोसँग विचार गरिएको नियमनको लागि वकालत गर्दै आएका छौं, जब यसले हामीलाई प्रचार, ‘डूमरिज्म’, वा नियामक कब्जाको आरोप लगाउछ । हामीले गति भन्दा सावधानी र नाफा भन्दा विवेकलाई प्राथमिकता दिने प्रयास गरेका छौं ।


तर पछिल्ला केही महिनाहरूमा, म विश्वस्त भएको छु कि जोखिमहरूलाई पूर्ण रूपमा सम्बोधन गर्न अझ बढी विवेक आवश्यक छ, केवल जोखिम रोकथाममा लगानी गर्नु मात्र होइन, तर क्षमता विकासको दरलाई गति दिनु ताकि जोखिम रोकथामलाई निरन्तरता दिन समय मिलोस् । हामीले एआई मोडेलहरूको क्षमताहरू सुधार गर्ने गतिलाई ढिलो गर्नुपर्छ । प्रगति अझै पनि छिटो देखिनेछ, र हामीले प्राप्त गरेको समयको बुद्धिमानीपूर्वक उपयोग गर्नुपर्छ । दुई कुराले मलाई विश्वस्त बनाएको छ ।

मेरो पहिलो चिन्ता यो हो कि, लगभग यस गर्मीदेखि, एआई एकदमै छिटो अगाडि बढिरहेको छ, मुख्यतया एआईको अर्को पुस्ताको एआई निर्माण गर्ने बढ्दो क्षमताद्वारा संचालित । यो गतिशीलतालाई पुनरावर्ती आत्म-सुधार भनिन्छ, र यो एन्थ्रोपिक सहित उद्योगभरि हुन थालेको छ, जसरी हामी र अरूले वर्णन गरेका छौं । जाँच नगरिएको खण्डमा, यसले यी प्रणालीहरू बुझ्ने र नियन्त्रण गर्ने हाम्रो क्षमतालाई उछिन्न सक्छ, र त्यसैले धेरै सावधानीपूर्वक पछ्याउनुपर्छ, यदि हो भने ।
मेरो दोस्रो चिन्ताको विषय ओपनएआई-हगिङ फेस घटना (ओएआई-एचएफ) हो, जसमा एजेन्टहरूको झुण्डले अनिवार्य रूपमा कट्टरपन्थी रूपमा समर्पित समूहको रूपमा काम गर्यो, आक्रमण गर्न भनिएको थिएन र जुन हातमा रहेको कार्यसँग सम्बन्धित थिएनन्, समूहको सफलताको लागि आफूलाई बलिदान गर्यो, र उनीहरूको प्रदर्शन मूल्याङ्कन गर्ने जिम्मेवार ‘ग्रेडर’ मा ह्याक गर्ने प्रयास गर्यो । यो घटनालाई खारेज गर्न सजिलो छ किनभने कसैलाई चोट लागेको थिएन र आर्थिक क्षति न्यूनतम थियो, तर मेरो विचारमा, ठूलो क्षमता भएको तर समान स्तरको गलत संरेखण भएको झुण्डले विनाशकारी क्षति निम्त्याउन सक्छ । एआई क्षमता विकासको द्रुत गतिलाई ध्यानमा राख्दै, यो मेरो चिन्ता हो कि ६-१२ महिनामा यस्तो झुण्डले निरन्तर बोटनेट (सम्भावित रूपमा सयौं अर्ब डलरको क्षति निम्त्याउने) मार्फत सम्पूर्ण इन्टरनेट कब्जा गर्न सक्षम हुन सक्छ, र आवश्यक रेलिङ बिना एआई अझ शक्तिशाली भयो भने त्यहाँबाट क्षतिको मात्रा बढ्दै जानेछ । ओएआई-एचएफलाई एउटा कम्पनीको असफलताको रूपमा खारेज गर्न पनि सजिलो छ, तर मलाई विश्वास छ कि त्यो गल्ती हुनेछ । एन्थ्रोपिक लगायत उद्योगभरि यस्तै, कम गम्भीर घटनाहरू भएका छन्, र मलाई विश्वास छ कि प्रत्येक सीमावर्ती एआई कम्पनीले OAI-HF सँग भएको जस्तो व्यवहार गर्नु अनिवार्य छ ।

त्यसैले म सीमालाई गति दिने लक्ष्यका साथ तीन-चरणीय योजना प्रस्ताव गर्दैछु: सन्तुलित दरमा एआई निर्माण गर्ने जसले यसको सुरक्षा सुनिश्चित गर्ने लक्ष्य राख्छ जबकि यसको फाइदाहरू प्राप्त गर्दै र महत्त्वपूर्ण भूराजनीतिक दुविधाहरूसँग जुधिरहेको छ । स्पष्ट हुनको लागि, गतिको अर्थ मोडेल प्रशिक्षण वा प्राविधिक प्रगति रोक्नु होइन, तर कम्पनीहरूले आफ्ना मोडेलहरूलाई पङ्क्तिबद्ध गर्न र सुरक्षित गर्न पर्याप्त समय लिन्छन् र तेस्रो पक्ष मूल्याङ्कनकर्ताहरूले यसलाई पुष्टि गर्छन् भन्ने कुरा सुनिश्चित गर्नु हो । हाम्रो गतिको रूपरेखा सुरक्षाप्रतिको हाम्रो प्रतिबद्धतालाई अझ बलियो बनाउने र शीर्षमा दौडलाई प्रोत्साहन गर्ने प्रयास हो । पहिलो चरण भनेको एन्थ्रोपिकले एकतर्फी रूपमा प्रतिबद्ध रहेको कुरा हो (र सरकारहरूलाई अन्य सीमान्त कम्पनीहरूलाई मिलाउन आवश्यक छ) । दोस्रो चरणको लागि उद्योग-व्यापी समन्वय आवश्यक छ । तेस्रो चरणको लागि विश्वव्यापी समन्वय आवश्यक छ । चरणहरू कडाइका साथ क्रमबद्ध रूपमा लिनु आवश्यक छैन, र तिनीहरूमध्ये केही अरू भन्दा हासिल गर्न धेरै गाह्रो हुन सक्छ, तर मैले तिनीहरूलाई के हासिल गर्न आवश्यक छ भन्ने बारे सोच्न उपयोगी रूपरेखा पाएको छु। चरणहरू हुन्: एम्बेडेड मूल्याङ्कनकर्ताहरू । प्रत्येक फ्रन्टियर एआई कम्पनीले एम्बेडेड तेस्रो-पक्ष मूल्याङ्कनकर्ताहरू (जस्तै METR) को टोलीलाई निरन्तर, कर्मचारी-जस्तै पहुँच दिन प्रतिबद्ध छ, जसको भूमिका सुरक्षा अभ्यासहरू र प्रतिबद्धताहरूको पालना प्रमाणित गर्नु, घटनाहरू रिपोर्ट गर्नु, र पूरा भएका एआई मोडेलहरू मात्र नभई प्रशिक्षण पाइपलाइनहरू र प्रक्रियाहरूको पङ्क्तिबद्धताको मूल्याङ्कन गर्न मद्दत गर्नु हो । यो कुनै पनि गति प्रतिबद्धताको प्रमाणीकरणको लागि प्रमुख चरण हो, र बैंकिङ उद्योगमा यसको उदाहरण छ, जसमा कहिलेकाहीं कर्मचारीहरूसँग एम्बेडेड नियामक ‘पर्यवेक्षकहरू’ समावेश हुन्छन् । एन्थ्रोपिक अब एकतर्फी रूपमा यो चरणमा प्रतिबद्ध छ । हामी यो हाम्रो सुरक्षा र पङ्क्तिबद्धता कार्यमा प्रयासहरूलाई दोब्बर बनाउन व्यापक धक्काको हिस्सा बन्न चाहन्छौं ।
लोकतान्त्रिक समन्वय
लोकतान्त्रिक देशहरू भित्र फ्रन्टियर एआई कम्पनीहरूले सामान्य सुरक्षा मापदण्डहरू साथै अनियन्त्रित एआई प्रगतिको दरमा सीमाहरू स्थापित गर्न समन्वय गर्छन् । गतिको लागि प्रभावकारी हुने समन्वयका केही रूपहरू कानुनी रूपमा चुनौतीपूर्ण छन्, र सरकारी समर्थन आवश्यक पर्नेछ ।
विश्वव्यापी समन्वय

अमेरिका र अन्य लोकतान्त्रिक सरकारहरूले अनुपालन प्रमाणित गर्ने चुनौतीहरूलाई गम्भीरतापूर्वक लिँदै, सम्भव भएसम्म अधिनायकवादी सरकारहरूसँग समन्वय गर्ने प्रयास गर्छन् । म यी प्रत्येक चरणहरू पालैपालो वर्णन गर्छु, तर पहिले, मलाई लाग्छ कि गतिले हामीलाई एआई विकास प्रक्रियालाई कसरी सुरक्षित बनाउन अनुमति दिनेछ भनेर विशेष रूपमा भन्नु महत्त्वपूर्ण छ । हामीले यसले हामीलाई दिने समयलाई बुद्धिमानीपूर्वक प्रयोग गर्न आवश्यक छ ।
गति किन रोक्ने ?
एआईलाई रोक्ने वा ढिलो गर्ने विचार २०२३ देखि नै चर्चामा आएको थियो, र मलाई लाग्छ कि त्यतिबेला यसको खासै अर्थ थिएन । प्रश्न सधैं थियो: तपाईं अतिरिक्त समयको साथ के गर्नुहुन्छ ? ती दिनहरूका एआई मोडेलहरू कुनै पनि सुसंगत तरिकाले संसारमा एजेन्टको रूपमा काम गर्न पर्याप्त शक्तिशाली थिएनन्, र महत्त्वपूर्ण छल, हेरफेर, ठगी, वा साइबर आक्रमण गर्न सक्षम थिएनन् । तिनीहरूको पङ्क्तिबद्धता जोखिमहरूलाई सम्बोधन गर्न ढिलो गर्नु ब्याक्टेरियामा प्रयोग गरेर मानिसहरूको मनोविज्ञान अध्ययन गर्ने प्रयास गर्नु जस्तै महसुस भयो । आज, तथापि, तस्वीर पूर्ण रूपमा फरक छ । हालका मोडेलहरू एआई कसरी राम्रोसँग निर्माण गर्ने र कहिलेकाहीं यो राम्रोसँग निर्माण नगरिएमा के गलत हुन सक्छ भन्ने बारे अन्तर्दृष्टिको लगभग अनन्त सुन खानी हुन् । मलाई विश्वास छ कि यदि गति घटाउनाले हामीलाई मोडेलहरूको क्षमताको महत्वपूर्ण स्तरमा पुग्न एक वा दुई वर्ष थप्न मद्दत गर्यो, र हामीले त्यो समयलाई पङ्क्तिबद्धतालाई अगाडि बढाउन प्रयोग गर्यौं भने, हामी केहि गम्भीर रूपमा गलत हुने जोखिमलाई धेरै हदसम्म कम गर्न सक्छौं । एक समन्वित गति रणनीतिले फ्रन्टियर एआई विकासकर्ताहरूलाई व्यावसायिक लाभ वा एआईमा संयुक्त राज्य अमेरिकाको नेतृत्वलाई त्याग नगरी यो महत्त्वपूर्ण काम गर्न समय दिनेछ । सामान्यतया, यो प्रविधि कसरी प्रयोग गरिन्छ भन्ने कुरामा समाजको भनाइ हुनुपर्छ, र आवश्यक सार्वजनिक छलफलको लागि थप समय – जुन सीमा गतिले हामीलाई ल्याउनेछ – पक्कै पनि राम्रो कुरा हो ।


विशेष गरी, ढिलो गतिले कम्पनीहरूलाई निम्न क्षेत्रहरूमा ध्यान केन्द्रित गर्न र अझ बढी स्रोतहरू समर्पित गर्न अनुमति दिनेछ (जुन सबै पहिले नै एन्थ्रोपिकमा प्रमुख प्राथमिकताहरू हुन्):
सञ्चालन उत्कृष्टता- आजको एआई मोडेलहरूलाई प्रशिक्षण र तैनाथ गर्नु एक विशाल परिचालन चुनौती हो, जसमा हजारौं मानिसहरू, लाखौं चिप्स, र पूर्वाधारहरू समावेश छन् जुन प्राविधिक इतिहासमा सबैभन्दा जटिल छ । धेरै कुराहरू गलत हुन्छन् किनभने कम्पनीहरूले केही महत्त्वपूर्ण सिद्धान्त वा अन्तर्दृष्टि गुमाएको छैन, तर कार्यान्वयनमा समस्याहरूको कारणले । उदाहरणका लागि, हामीसँग प्रमाण छ कि हामीले रिपोर्ट गरेका हालैका पङ्क्तिबद्धता घटनाहरू आंशिक रूपमा अपूर्ण फिल्टरिङको कारणले भएको थियो । यो हामीले र हाम्रा विक्रेताहरूले उचित रूपमा लगनशीलतापूर्वक कार्यान्वयन गरेको प्रयास थियो, तर पर्याप्त राम्रोसँग होइन । अनुगमन, स्यान्डबक्सिङ, प्रशिक्षण वातावरण स्वच्छता, र डेटा समस्याहरू अत्यन्तै जटिल क्षेत्रहरू हुन् जहाँ सञ्चालन समस्याहरू बारम्बार देखा पर्छन् । हामीसँग यी कार्यहरूमा संसारका सबैभन्दा सक्षम टोलीहरू छन्, तर एकैचोटि सबै गर्न धेरै छ । थप मापन गरिएको गतिमा काम गरेर, हामी धेरै ठूलो परिचालन उत्कृष्टता प्राप्त गर्न सक्छौं । प्राविधिक रूपमा जटिल, सुरक्षा-महत्वपूर्ण प्रणालीहरू लाखौं पटक केही गल्ती नगरी सञ्चालन गर्ने उदाहरण छ- उदाहरणका लागि, व्यावसायिक हवाईजहाजहरू – तर यसलाई सही बनाउन समय लाग्छ ।
पङ्क्तिबद्धता- हामीले पङ्क्तिबद्धतामा स्पष्ट प्रगति गरेका छौं, प्रशिक्षण मोडेलहरू ताकि तिनीहरू सुरक्षित, नैतिक, हाम्रा दिशानिर्देशहरूसँग अनुरूप र साँच्चै सहयोगी रहन सकून् (क्लाउडको संविधानमा सम्मिलित सिद्धान्तहरू) । तर हाम्रो पङ्क्तिबद्धता प्रशिक्षणले मोडेल क्षमताहरूमा वृद्धिसँगै रहन्छ भनी सुनिश्चित गर्न धेरै कुराहरू छन् । अवांछनीय व्यवहारका दुर्लभ र अप्रत्याशित उदाहरणहरू अझै पनि कहिलेकाहीं देखा पर्छन्; गतिशील सीमाबाट अतिरिक्त समयले हाम्रा अनुसन्धानकर्ताहरूलाई यी समस्याहरूको कारण के हो भन्ने बारे हाम्रो बुझाइ सुधार गर्न र तिनीहरूलाई रोक्नको लागि राम्रो प्रविधिहरू विकास गर्न मद्दत गर्नेछ ।
व्याख्यात्मकता– त्यस्तै गरी, व्याख्यात्मकता, एआई मोडेलहरू भित्र के हुन्छ भनेर बुझ्ने विज्ञानले विगत केही वर्षहरूमा ठूलो प्रगति गरेको छ, र रिलीज हुनु अघि हाम्रा मोडेलहरूको लेखापरीक्षणमा बढ्दो रूपमा महत्त्वपूर्ण भूमिका खेल्छ । यो लगभग fMRI स्क्यान जस्तै प्रयोग गर्न सकिन्छ, तर एआईको “मस्तिष्क” को लागि, हामीलाई दिइएको व्यवहारको लागि अन्तर्निहित कारणहरू हेर्न मद्दत गर्दछ । उदाहरणका लागि, हामीले हालै अनुसन्धान गरिरहेका पङ्क्तिबद्ध घटनाहरूमा अव्यवस्थित प्रेरणाहरूको जाँच गर्न व्याख्यायोग्यता विधिहरू प्रयोग गर्यौं । तर यी विधिहरूले सधैं स्पष्ट र भरपर्दो परिणामहरू उत्पादन गर्दैनन् । सबै प्रगतिको बावजुद, हामी अझै पनि यी मोडेलहरू भित्र के भइरहेको छ भन्ने कुराको सानो अंश मात्र बुझ्छौं । हाम्रो व्याख्यायोग्यता प्रविधिहरू सुधार गर्न केन्द्रित प्रयास, हामी हाल भन्दा पनि छिटो, १-२ वर्षमा गहिरो प्रगति गर्न सक्छ, र पहिले नै भएका घटनाहरूमा आधारित पर्याप्त प्रयोगात्मक सामग्री हुनेछ ।
परीक्षण र मूल्याङ्कन- एआई मोडेलहरूको परीक्षण र मूल्याङ्कन क्षमताहरूमा वृद्धि हुँदै जाँदा अझ गाह्रो हुन्छ । अधिक बुद्धिमान मोडेलहरू परीक्षणहरूलाई धोका दिन बढी सक्षम हुन्छन्, र यसरी गम्भीर समस्याहरू पत्ता नलागेको बेला पङ्क्तिबद्ध देखिन सक्छन् । तिनीहरूलाई क्रस-चेक गर्न व्याख्यायोग्यता विश्लेषणको साथ, धेरै फराकिलो र अधिक सरल स्थिर मूल्याङ्कन निर्माण गर्नु अत्यन्तै मूल्यवान हुनेछ, र १-२ वर्षमा यसमा धेरै प्रगति गर्न सकिन्छ ।
इम्बेडेड मूल्याङ्कनकर्ताहरू:
तीन-चरण योजनाको पहिलो चरण, र जसमा एन्थ्रोपिक एकतर्फी रूपमा प्रतिबद्ध छ, एम्बेडेड मूल्याङ्कनकर्ताहरू हुन् जससँग सुरक्षा अभ्यासहरू प्रमाणित गर्न र घटनाहरू रिपोर्ट गर्न कर्मचारी जस्तै पहुँच छ । इम्बेडेड मूल्याङ्कनकर्ताहरू सानो वा अप्रत्याशित चरण जस्तो लाग्न सक्छ, तर प्रायः सबैभन्दा बोरिंग वा प्रक्रियागत सुनिने कुराहरू वास्तवमा सबैभन्दा आवश्यक हुन्छन् । इम्बेडेड मूल्याङ्कनकर्ताहरू वास्तवमा एक धेरै कट्टरपन्थी अभ्यास हुन् जुन आज कुनै पनि एआई कम्पनीले गरिरहेको भन्दा धेरै टाढा जान्छ, र निम्न फाइदाहरू छन् :
प्रमाणीकरण योग्यता- इम्बेडेड मूल्याङ्कनकर्ताहरूले नट र बोल्टको स्तरमा जाँच गर्न सक्छन् कि एआई कम्पनीले वास्तवमा उनीहरूले पालना गरेको दाबी गर्ने प्रशिक्षण, तैनाती, सञ्चालन, र सुरक्षा अभ्यासहरू पालना गरिरहेको छ कि छैन । कुनै पनि गति प्रतिबद्धताहरूमा अनिवार्य रूपमा धेरै अस्पष्टता, निर्णय कलहरू, र ‘कानूनको पत्र बनाम कानूनको भावना’ समावेश हुनेछ, र वास्तवमा विवरणहरू हेर्न सक्ने तटस्थ तेस्रो पक्ष हुनु महत्त्वपूर्ण देखिन्छ ।
पारदर्शिता- हामीले जुनसुकै प्रतिबद्धता गरे पनि, जनताले के भइरहेको छ भनेर जान्न योग्य छन् । एन्थ्रोपिक लामो समयदेखि पारदर्शिताको समर्थक रहँदै आएको छ: हामीले पारदर्शिता कानूनलाई समर्थन गर्यौं जब धेरैजसो उद्योग कुनै पनि नियमनको विरुद्धमा थिए, र हाम्रा मोडेल कार्डहरू र जोखिम रिपोर्टहरू सयौं पृष्ठहरूमा चल्छन् । तर हामी अझै पनि के समावेश गर्ने र के छोड्ने भनेर छनौट गर्नेहरू हौं । एम्बेडेड मूल्याङ्कनकर्ताहरूले यो गतिशीलतालाई परिवर्तन गर्नेछन् ।
दोस्रो राय, औपचारिक प्रतिबद्धताहरू प्रमाणित गर्ने र जनतालाई जानकारी गराउने बाहेक, एम्बेडेड मूल्याङ्कनकर्ताहरूले व्यावसायिक प्रोत्साहनहरू बिना दोस्रो राय प्रदान गर्न सक्छन्। धेरै सुरक्षा लाभहरू केवल मूल्याङ्कनकर्ताहरूले कर्मचारीहरूले विचार नगरेको कुरा औंल्याउँदा मात्र आउन सक्छन्, तर उनीहरू सचेत भएपछि समाधान गर्न खुसी हुन्छन् ।

यी फाइदाहरूको कारणले गर्दा, कुनै पनि गति प्रस्ताव एम्बेडेड मूल्याङ्कनकर्ताहरूसँग सुरु भएमा धेरै राम्रो काम गर्ने सम्भावना हुन्छ । यी एम्बेडेड मूल्याङ्कनकर्ताहरूसँग तुलनात्मक जोखिम मूल्याङ्कन गर्ने आन्तरिक कर्मचारीहरूको जस्तै अनुमतिहरू र उपकरणहरूमा निरन्तर पहुँच हुनुपर्छ । विशेष गरी, एन्थ्रोपिकले निकट भविष्यमा निम्न सबैले सुसज्जित एम्बेडेड बाह्य समीक्षा टोलीलाई आमन्त्रित गर्ने इरादा राखेको छ:
हाम्रा कार्यालयहरूमा डेस्कहरू, पहुँच ब्याजहरू, र कम्पनी ल्यापटपहरू । कार्यस्थान, उपकरणहरू र अनुमतिहरूमा पहुँच जुन प्रायः आन्तरिक जोखिम मूल्याङ्कन टोलीहरूसँग भएको जस्तै हुन्छ । हामी केही अपवादहरू बनाउनेछौं, जस्तै कानून वा हाम्रा सम्झौताहरूले यसलाई आवश्यक पर्ने ठाउँमा, वा ग्राहकहरू र साझेदारहरूको निजी जानकारीको सुरक्षा गर्न । हामी कर्मचारीहरूसँग प्रत्यक्ष कुराकानी मार्फत सहित, सान्दर्भिक जानकारीमा समीक्षकहरूको पहुँचलाई सुदृढ पार्ने बलियो आन्तरिक मापदण्डहरू पनि स्थापना गर्नेछौं ।
माथि उल्लेख गरिएका जटिलताहरूलाई सन्तुलन गर्ने सम्झौता । बाह्य समीक्षकहरूसँग एन्थ्रोपिकद्वारा सम्पादकीय नियन्त्रण बिना जोखिम स्तर, घटनाहरू, अभ्यासहरू, र उनीहरूले प्राप्त गरेको वा प्राप्त नगरेको पहुँचको बारेमा प्रमुख निष्कर्षहरू प्रकाशित गर्ने अधिकार हुनुपर्छ । हामीसँग सुरक्षा-संवेदनशील, कानुनी रूपमा विशेषाधिकार प्राप्त, व्यावसायिक रूपमा संवेदनशील, वा तेस्रो-पक्ष गोप्य जानकारी सम्पादन गर्ने संकीर्ण क्षमता हुनेछ, तर हामी निष्कर्षहरू प्रतिकूल भएको कारणले मात्र सम्पादन गर्न सक्दैनौं । समीक्षकहरूले सार्वजनिक रूपमा भन्न सक्छन् कि यदि सम्पादनले उनीहरूको निष्कर्षमा महत्त्वपूर्ण कुरा हटायो भने ।
यो कम्पनीको लागि असामान्य कदम हो, तर हामीलाई लाग्छ कि एम्बेडेड बाह्य समीक्षकहरूको अवधारणा प्रमाणित गर्नु महत्त्वपूर्ण छ । फेरि एक पटक, हामी अन्य सीमान्त कम्पनीहरूलाई पनि यो कुरा पछ्याउन आग्रह गर्दछौं ।
एक पटक एम्बेडेड मूल्याङ्कनकर्ताहरू अमेरिकी एआई कम्पनीहरूको एक महत्वपूर्ण समूह भित्र सञ्चालन भएपछि, प्रमाणित गति बढी व्यवहार्य हुन्छ। विशेष गरी, मोडेल वा प्रशिक्षण पाइपलाइनहरूको विस्तृत गुणहरूको आधारमा गति सम्भव हुन्छ ।
गतिको सबैभन्दा प्रभावकारी विधि भनेको सबै अमेरिकी फ्रन्टियर एआई कम्पनीहरूलाई लक्षित गर्ने नियमन मार्फत हो, किनकि यसले स्वेच्छाले सहयोग गर्न इच्छुकहरूलाई पनि समेट्छ । एन्थ्रोपिकले लामो समयदेखि समझदार र लक्षित एआई नियमनलाई समर्थन गरेको छ, विशेष गरी पारदर्शिता र तेस्रो-पक्ष लेखा परीक्षणमा केन्द्रित बिलहरू । मलाई विश्वास छ कि सबै फ्रन्टियर प्रयोगशालाहरूले स्थायी एम्बेडेड मूल्याङ्कनकर्ताहरूको विचारलाई औपचारिक बनाउन सरकारसँग साझेदारी गर्नुपर्छ ताकि पछिल्ला केही महिनाहरूमा भएका जस्ता आन्तरिक पङ्क्तिबद्धता घटनाहरूलाई राम्रोसँग रोक्न र दस्तावेजीकरण गर्न सकियोस्, र क्षमताहरूलाई सुरक्षासँग सन्तुलनमा राख्नमा केन्द्रित नियमन लागू गर्न सकियोस् ।
दुर्भाग्यवश, कानून पारित गर्न समय लाग्न सक्छ, र एआई धेरै छिटो अगाडि बढिरहेको छ । त्यसकारण, नियामक मार्गसँग समानान्तरमा, एआई कम्पनीहरूले स्वेच्छिक रूपमा मापदण्डहरू सेट गर्न सँगै काम गर्न सक्छन् र गर्नुपर्छ – एक प्रक्रिया जुन मलाई विश्वास छ कि स्थायी रूपमा एम्बेडेड मूल्याङ्कनकर्ताहरू द्वारा प्रदान गरिएको प्रमाणीकरणको साथ राम्रो हुनेछ। अविश्वास कारणहरूका लागि, अमेरिकी सरकारको लागि यी छलफलहरूमा मध्यस्थता गर्नु वा कम्तिमा सक्षम गर्नु उपयोगी छ, तिनीहरूलाई भाग लिन आवश्यक छैन, तर निश्चित प्रकारका सुरक्षा कुराकानीहरूको लागि एक संकीर्ण छूट जारी गर्न आवश्यक छ । यो संवाद सरकारसँग केही सम्बन्ध भएका उद्योग समूहहरू मार्फत पनि हुन सक्छ – उदाहरणका लागि, डेमिस हसाबिसले सुझाव दिएको संयन्त्र। जे भए पनि, त्यस्ता छलफलहरू छिटो अगाडि बढ्नु पर्छ ।
व्यापक रूपमा भन्नुपर्दा, दिइएको सीमा एआई प्रणालीले के गर्न सक्छ र हामी यसलाई कति सुरक्षित मान्छौं भन्ने आधारमा गति बढाउन म सबैभन्दा उत्साहित छु । उदाहरणका लागि, एउटा सम्भावित योजना ‘चेकपोइन्टहरू’ को श्रृंखला हुन सक्छ: यदि मोडेलहरूमा क्षमता X छ भने, तिनीहरूलाई पङ्क्तिबद्धता गुणहरू Y र Z को प्रमाणीकरणहरूसँगै राख्नुपर्छ – जस्तै मूल्याङ्कन, व्याख्यात्मकता विश्लेषण, र प्रशिक्षण वातावरणको अडिटहरूको केही संयोजन – जसले तिनीहरूको पङ्क्तिबद्धता गुणहरू प्रदर्शन गर्दछ। यस उदाहरणमा, X ‘मोडेल सबैभन्दा सामान्य स्यान्डबक्सिङ विधिहरूबाट भाग्न वा पराजित गर्न सक्षम छ’ हुन सक्छ र Y जे पनि हुन सक्छ जुन मोडेलमा यसको वातावरणबाट बाहिर निस्कने र ठूलो संख्यामा कम्प्युटरहरू कब्जा गर्ने प्रवृत्ति छ भन्ने कुरा धेरै असम्भव बनाउन आवश्यक छ ।
हामीले फ्रन्टियर मोडेलहरूमा जाने सामग्रीहरू सीमित गर्ने आधारमा गतिलाई पनि विचार गर्नुपर्छ, जस्तै प्रशिक्षण गणना, प्रशिक्षण रनको प्रकृति, वा AI सुधार गर्न AI को आन्तरिक प्रयोग। मलाई चिन्ता छ कि यी मध्ये केही उपायहरू बाह्य व्यवहार भन्दा बढी “खेलयोग्य” हुन सक्छन्, तर यो एम्बेडेड मूल्याङ्कनकर्ताहरूसँग छलफल गर्न लायक विषय हो ।
लोकतन्त्र भित्र गति अमेरिकी कम्पनीहरूले अधिनायकवादी शासनहरू, मुख्यतया चिनियाँ कम्युनिष्ट पार्टीमाथि गरेको नेतृत्वले सीमित हुनेछ । यदि हामीले यो रकमभन्दा बढी ढिलो गर्यौं भने, (अप्रत्याशित) CCP-सम्बद्ध परियोजनाहरू अगाडि बढ्नेछन्, जसले गर्दा राष्ट्रिय सुरक्षामा ठूलो जोखिम सिर्जना हुनेछ । म सचिव बेसेन्टसँग सहमत छु कि AI मा चिनियाँ नेतृत्वले संयुक्त राज्य अमेरिका र विश्वको लागि गम्भीर खतरा निम्त्याउनेछ । CCP-सम्बद्ध परियोजनाहरूले अमेरिकी कम्पनीहरूले सावधानीपूर्वक रोकिरहेका पङ्क्तिबद्ध जोखिमहरू चलाउनेछन्, र यदि तिनीहरूले ती जोखिमहरू बेवास्ता गरे पनि, तिनीहरू सैन्य रूपमा लोकतन्त्रहरूमा प्रभुत्व जमाउने स्थितिमा हुनेछन् (उदाहरणका लागि AI-संचालित ड्रोनहरूसँग)। यसरी, लोकतन्त्र भित्र गतिको एक प्रमुख भाग भनेको लोकतन्त्रहरूको AI नेतृत्वलाई निरंकुशतामाथि सकेसम्म ठूलो राख्नु हो, जसले गर्दा हामीलाई प्रभावकारी रूपमा गति लिन आवश्यक पर्ने सास फेर्न सक्ने ठाउँ मिलोस् ।
यो खाडलको रक्षा गर्न हामीले चाल्न सक्ने मुख्य कदमहरू हुन्:
-चीनलाई शक्तिशाली AI चिप्स वा अर्धचालक उत्पादन उपकरणहरू बेच्ने काम नगर्नुहोस्, र चिप तस्करी सञ्चालन र चीन बाहिर डेटा केन्द्रहरूमा टाढाको पहुँचलाई नियन्त्रण गर्नुहोस् । चिप्स चीनको AI शक्तिको मुख्य निर्धारक हुनेछन् ।
-अधिनायकवादी देशहरूमा कम्पनीहरूद्वारा अनधिकृत आसवनमाथि कारबाही गर्नुहोस् । फ्रन्टियर मोडेलहरूको आसवनले पछि परेका कम्पनीहरूलाई स्वतन्त्र रूपमा आफ्नै एआई विकास गर्न लाग्ने लागतको एक अंश प्रयोग गरेर खाडल कम गर्न अनुमति दिन्छ ।
– एआई कम्पनीहरूमा सुरक्षा बलियो बनाउनुहोस् र मोडेल तौल चोरी रोक्नुहोस् ।
-कम्पनीहरू र अमेरिकी सरकारले यी कदमहरूलाई सकेसम्म प्रभावकारी बनाउन सहयोग गर्नुपर्छ । एन्थ्रोपिकले यी सबै उपायहरूको लागि निरन्तर वकालत गरेको छ, किनकि हामीले सधैं बुझेका छौं कि तिनीहरू कुनै पनि गतिको लागि आवश्यक हुनेछन् ।
– यदि हामीले यी उपायहरू राम्रोसँग कार्यान्वयन गर्यौं भने, मलाई विश्वास छ कि तिनीहरूले अर्को ३-५ वर्षमा अमेरिकाको नेतृत्वलाई उल्लेखनीय रूपमा फराकिलो बनाउन चीनको प्रगतिलाई ढिलो गर्नेछन् – एआई भूराजनीतिक रूपमा सबैभन्दा महत्त्वपूर्ण हुने विन्डो ।
कसै-कसैले यी उपायहरूले चीनसँग सहकार्य गर्न अझ गाह्रो बनाउँछन् भन्ने विश्वास गर्न सक्छन्, तर मलाई विश्वास छ कि यसको विपरीत सत्य हो: यी उपायहरूले लोकतन्त्रहरूद्वारा राखिएको लाभ बढाउँछन् र भविष्यमा सम्झौताको सम्भावना बढी बनाउछन् ।
विश्वव्यापी गति
लोकतन्त्र भित्र गतिको समानान्तरमा, हामीले सीमाको विश्वव्यापी गतिको लागि पनि लक्ष्य राख्नुपर्छ, यद्यपि यो प्राप्त गर्न धेरै गाह्रो हुनेछ । विश्वव्यापी गतिको लागि चीनसँग सहकार्य आवश्यक पर्नेछ, जुन अहिलेसम्मकै सबैभन्दा उन्नत एआई क्षमताहरू भएको निरंकुश देश हो । हामी यहाँ भोली हुनुहुँदैन: भूराजनीतिक दांव यति उच्च छ कि के हासिल गर्न सकिन्छ भन्ने कुरामा कडा सीमाहरू हुनेछन्, विशेष गरी सुरुमा। यदि हामीले चीनले पनि त्यस्तै गर्नेछ भन्ने विश्वासमा हाम्रो एआई क्षमताहरूलाई धेरै मात्रामा रोक लगायौं, र त्यसपछि चीनले त्रुटि गर्छ भने, एआई यति शक्तिशाली हुन सक्छ कि यस्तो त्रुटिले उनीहरूको भूराजनीतिक प्रभुत्व निम्त्याउन सक्छ । त्यसकारण कुनै पनि सम्झौतामा या त फलामको प्रमाणीकरण हुनुपर्छ, वा यति सीमित हुनुपर्छ कि पक्ष परिवर्तन सैन्य रूपमा अस्तित्वमा नहुने हो । मलाई शंका छ कि अमेरिका मात्र होइन तर चीनलाई पनि यी चिन्ता र चिन्ताहरू हुनेछन् । हामीले कुनै पनि विश्वव्यापी गति निर्णयलाई, विशेष गरी निकट अवधिमा, अमेरिका र यसका सहयोगीहरूको नेतृत्वलाई सुरक्षित गर्ने तरिकाले हेर्नुपर्छ ।
सम्भावित सम्झौताका धेरै स्तरहरू छन्, जसमध्ये केही मलाई लाग्छ कि एकदमै सम्भव छन् (जस्तै मैले पहिले सुझाव दिएको छु), र जसमध्ये केही म धेरै शंकास्पद छु- यद्यपि हामीले प्रयास गर्नुपर्छ। बढ्दो कठिनाइको क्रममा:
स्तर १. जैविक हतियारको उत्पादनको लागि एआई प्रयोग गर्ने वा प्रयोगकर्ताहरूलाई त्यसो गर्न अनुमति दिने जस्ता एआईको केही साँघुरो र स्पष्ट रूपमा खतरनाक प्रयोगहरूलाई निषेध गर्ने सम्झौता। जैविक आतंकवादी आक्रमणहरू सबैका लागि खराब छन्, अमेरिका र अमेरिकी विरोधीहरू दुवै सहित, त्यसैले यहाँ सम्झौता सम्भव छ ।
स्तर २. साइबर सुरक्षा, जीवविज्ञान, र पङ्क्तिबद्धता जस्ता क्षेत्रहरूमा तीव्र जोखिमहरूको लागि रिलीज हुनु अघि आफ्ना मोडेलहरू परीक्षण गर्न दुवै पक्षहरूद्वारा सम्झौता । माथि उल्लेख गरिएझैं, यो विश्वव्यापी मापदण्ड निकाय मार्फत गर्न सकिन्छ । मलाई वास्तवमा लाग्छ कि यस्तो निकाय सिर्जना गर्नु सम्भव छ, तर यसलाई वास्तविक दाँत दिनु चुनौतीपूर्ण हुनेछ, र कठिनाई प्रमाणीकरणमा हुनेछ कि दुबै पक्षहरूसँग गोप्य मोडेलहरू छैनन् जुन तिनीहरूले परीक्षण गर्दैनन् तर गोप्य रूपमा तैनाथ गर्न सक्छन् (जस्तै, सैन्य अनुप्रयोगहरूको लागि) ।
स्तर ३. पुनरावर्ती आत्म-सुधार (RSI) को दरमा कुनै प्रकारको ‘गति सीमा’ । मोडेलहरूले भविष्यका मोडेलहरू निर्माण गर्दा, सुधारको दर अचम्मलाग्दो रूपमा छिटो हुन सक्छ। ‘अत्यन्तै छिटो’ बाट ‘केवल केही हदसम्म छिटो’ मा दर घटाउँदा अपेक्षाकृत थोरै रणनीतिक फाइदा हुन्छ, जबकि सम्भावित रूपमा सुरक्षामा धेरै सुधार हुन्छ । यो SALT सन्धिहरूसँग मिल्दोजुल्दो रूपमा देख्न सकिन्छ – क्षेप्यास्त्रहरूको संख्या सीमित गर्नाले प्रत्येक देशको निवारक संरक्षण गर्दै विनाशको सम्भावना सीमित हुन्छ । मलाई लाग्छ कि यस्तो सम्झौता गाह्रो हुनेछ तर सम्भव हुने छेउमा ।
स्तर ४. पूर्ण गति, वा “पज” पनि, जसमा सहभागी सरकारहरू AI विकासको समग्र दरलाई पर्याप्त रूपमा सीमित गर्न सहमत छन्। म यसलाई तैरने समर्थन गर्छु, तर मलाई लाग्छ कि यो वास्तवमा चाँडै हुने सम्भावना छैन: अनुगमनबाट बच्न यस्तो सम्झौताबाट अलग हुनुले विश्वव्यापी शक्तिको सन्तुलनलाई मौलिक रूपमा परिवर्तन गर्न सक्छ, त्यसैले म त्यसो गर्न प्रोत्साहनहरू विशाल हुने र प्रमाणीकरणमा हामीलाई आवश्यक पर्ने विश्वासको स्तर धेरै उच्च हुने अपेक्षा गर्दछु ।
चीनसँग हामीले प्राप्त गर्न सक्ने कुनै पनि सहकार्यले प्रजातान्त्रिक राष्ट्रहरू भित्र सीमाना गति बढाउन हामीले खर्च गर्नुपर्ने समयको मात्रा बढाउनेछ । हामीले तल्लो स्तरहरूलाई धेरै सम्भावित र यथार्थपरक रूपमा हेर्दै उच्च स्तरहरूको लागि लक्ष्य राख्नुपर्छ ।
अन्तमा, यो कुरा ध्यान दिनु महत्त्वपूर्ण छ कि यदि हामीले औपचारिक सम्झौताहरू प्राप्त गर्न सक्दैनौं भने पनि, अनौपचारिक मानदण्डहरू परिवर्तन गर्नाले केही मूल्य हुन सक्छ । पुनरावर्ती आत्म-सुधार र मोडेलहरूको गलत संरेखणको बारेमा जानकारी साझा गर्नाले सबैलाई यो कुरामा विश्वस्त पार्न मद्दत गर्न सक्छ कि लापरवाह हुनु उनीहरूको हितमा छैन ।
निष्कर्ष
म विश्वास गर्छु कि एआईले मानव जीवनको गुणस्तरमा ठूलो सुधार गर्न सक्छ । यी फाइदाहरू प्राप्त गर्ने मेरो इच्छा अक्षुण्ण छ । तर फाइदाहरू तब मात्र प्राप्त हुनेछन् जब हामी प्रविधिलाई सही तरिकाले निर्माण गर्छौं, र जबसम्म हामी राम्रोसँग प्राप्त गर्ने समय प्रयोग गर्छौं, यसलाई सही बनाउन असामान्य रूपमा जानाजानी हेरचाह गर्न लायक छ । प्रगति अझै पनि अपेक्षाकृत छिटो हुनेछ, र हामी यो समयलाई व्याख्यायोग्यताको विज्ञानलाई अगाडि बढाउन, सीमावर्ती एआई कम्पनीहरूमा सञ्चालन सुरक्षा र कठोरता सुधार गर्न, र मोडेलहरू निर्माण गर्न प्रयोग गर्न सक्छौं, जसको पङ्क्तिबद्धतामा हामीलाई धेरै विश्वास छ । सीमालाई सुरक्षित गतिमा अगाडि बढाउन मैले प्रस्ताव गरेको उपायहरू सजिलो हुनेछैनन् । तर मलाई विश्वास छ कि हामी मानवतालाई प्रयास गर्न ऋणी छौं ।
(एन्थ्रोपिकका प्रमुख डारियो अमोडेईले लेखेको एआईको विकासको गति कम गर्नुपर्ने धारणासहितको चर्चित लेख, आफ्नो निजी वेभसाइट https://darioamodei.com/ बाट भावानुवाद)




