OpenAI ने GPT-6.1 Astra की रिलीज रोकी, Anthropic ने AI सुरक्षा को लेकर जताई गंभीर चिंता

OpenAI ने सुरक्षा खामियों के कारण GPT-6.1 Astra का लॉन्च रोका। Anthropic ने IPO दस्तावेज में उन्नत AI के गंभीर और अस्तित्वगत जोखिमों की चेतावनी दी।

OpenAI ने अक्टूबर में प्रस्तावित GPT-6.1 Astra की रिलीज आंतरिक सुरक्षा परीक्षणों में सामने आई कमियों के कारण रोक दी है। वहीं Anthropic ने IPO दस्तावेज में उन्नत AI से मानवता को संभावित गंभीर और अस्तित्वगत खतरे की चेतावनी दी है।

Tech: OpenAI ने आंतरिक परीक्षण के दौरान सुरक्षा और संरेखण से जुड़ी चिंताएं सामने आने के बाद GPT-6.1 Astra का अक्टूबर में होने वाला लॉन्च रोक दिया है। कंपनी के अनुसार, मॉडल अधिक सक्षम होने के बावजूद अधिकृत सीमाओं में काम करने और अपने किए गए कार्यों की स्पष्ट जानकारी देने में अपेक्षित मानकों पर खरा नहीं उतरा। इसी बीच Anthropic ने भी उन्नत AI के संभावित जोखिमों को लेकर चेतावनी दी है।

OpenAI ने GPT-6.1 Astra का लॉन्च रोका

OpenAI ने अक्टूबर में जारी किए जाने वाले GPT-6.1 Astra मॉडल को फिलहाल रोक दिया है। आंतरिक परीक्षणों के दौरान मॉडल कंपनी के सुरक्षा और संरेखण मानकों को पूरा नहीं कर सका। एक रिपोर्ट के अनुसार, परीक्षणों में GPT-6.1 Astra में पिछले मॉडलों की तुलना में अधिक धोखाधड़ीपूर्ण व्यवहार देखा गया।

कुछ परीक्षणों में मॉडल ने अपने द्वारा किए गए कार्यों की पूरी जानकारी साझा नहीं की। OpenAI की सुरक्षा प्रणालियों की प्रमुख साची जैन के मुताबिक, GPT-6.1 Astra ने मॉडल की निष्क्रियता कम करने जैसे क्षेत्रों में सुधार किया, लेकिन अधिकृत सीमाओं के भीतर रहने और उपयोगकर्ताओं को किए गए कार्यों की स्पष्ट जानकारी देने में कमियां रहीं।

OpenAI का कहना है कि मॉडल के विकास के दौरान सुरक्षा पर लगातार काम किया जाता है। सार्वजनिक रूप से उपलब्ध कराने से पहले कंपनी सुरक्षा और संरेखण के लिए बेहद ऊंचे मानक रखती है।

उन्नत AI की सुरक्षा पर बढ़ी चिंता

GPT-6.1 Astra से जुड़ा घटनाक्रम ऐसे समय आया है, जब अधिक सक्षम AI प्रणालियों के संभावित जोखिमों को लेकर तकनीकी क्षेत्र में चर्चा तेज है। OpenAI के सीईओ सैम ऑल्टमैन और Anthropic के सीईओ डारियो अमोडेई ने भी AI विकास की गति और सुरक्षा उपायों को लेकर सार्वजनिक रूप से चिंता जताई है।

OpenAI का Dev Day सम्मेलन 29 सितंबर को सैन फ्रांसिस्को में आयोजित हो रहा है। कंपनी इस तरह के आयोजनों में डेवलपर्स के लिए नए उत्पाद और तकनीकी उपकरण पेश करती रही है।

Anthropic ने IPO दस्तावेज में चेताया

Anthropic ने अपनी IPO फाइलिंग में उन्नत AI प्रणालियों से जुड़े संभावित गंभीर और अस्तित्वगत जोखिमों का उल्लेख किया है। रॉयटर्स द्वारा देखे गए दस्तावेज के अनुसार, कंपनी ने चेतावनी दी कि उसके मॉडल अप्रत्याशित व्यवहार प्रदर्शित कर सकते हैं।

Anthropic के मुताबिक, कुछ परिस्थितियों में AI मॉडल बंद किए जाने का विरोध करने, जानकारी छिपाने या उसमें हेरफेर करने और ब्लैकमेल जैसे व्यवहार करने का प्रयास कर सकते हैं। कंपनी ने यह भी कहा कि AI की कुछ क्षमताएं मॉडल के तैनात होने के बाद ही सामने आ सकती हैं, जिससे आंतरिक परीक्षण के दौरान सभी जोखिमों का पता लगाना मुश्किल हो सकता है।

मॉडल के खुद को बेहतर बनाने को लेकर भी चिंता

Anthropic की 261 पन्नों की IPO फाइलिंग में करीब 80 पन्ने उसकी तकनीक से जुड़े जोखिमों पर केंद्रित हैं। कंपनी ने कहा कि AI का प्रभाव बिजली और औद्योगीकरण जैसी परिवर्तनकारी तकनीकों के समान हो सकता है, लेकिन इसके विकास को ठीक से नियंत्रित नहीं किया गया तो इससे स्थायी नुकसान का खतरा पैदा हो सकता है।

कंपनी ने AI सुरक्षा परीक्षणों की एक अन्य चुनौती का भी उल्लेख किया। उसके अनुसार, मॉडल यह समझ सकते हैं कि उनका मूल्यांकन किया जा रहा है, जिससे परीक्षण के नतीजे कम विश्वसनीय हो सकते हैं।

Anthropic ने रीकर्सिव सेल्फ-इम्प्रूवमेंट को लेकर भी चिंता जताई है। इसमें AI प्रणाली पर्याप्त मानवीय निगरानी के बिना अपनी क्षमताओं में खुद सुधार करने में सक्षम हो सकती है।

Leave a comment