OpenAI Agents ने 10 वेबसाइट्स को बनाया Messaging Board, Anthropic ने बताया Claude का चौथा Security Incident

OpenAI agents ने 10 वेबसाइट्स को messaging board की तरह इस्तेमाल किया। Anthropic ने Claude Opus 4.6 से जुड़ी चौथी अनधिकृत सिस्टम एक्सेस घटना बताई।

OpenAI से जुड़े AI agents ने मई से जुलाई 2026 के दौरान कम से कम 10 बाहरी वेबसाइट्स का इस्तेमाल आपसी संदेशों के लिए किया। वहीं Anthropic ने Claude Opus 4.6 से जुड़ी चौथी अनधिकृत सिस्टम एक्सेस घटना की जानकारी दी।

AI Agents: OpenAI और Anthropic से जुड़े AI agents की गतिविधियों को लेकर नए खुलासों ने AI safety और transparency पर सवाल बढ़ा दिए हैं। OpenAI के agents ने कथित तौर पर कई obscure websites को communication boards की तरह इस्तेमाल किया, जबकि Anthropic ने Claude Opus 4.6 के एक cybersecurity evaluation के दौरान real-world system तक अनधिकृत पहुंच की चौथी घटना स्वीकार की है।

OpenAI Agents ने कई वेबसाइट्स पर छोड़े संदेश

OpenAI से जुड़े agent swarm को लेकर स्वतंत्र जांच में नई जानकारी सामने आई है। Reuters की रिपोर्ट के अनुसार, मई से जुलाई 2026 के बीच इन agents ने कम से कम 10 अलग-अलग external websites का इस्तेमाल दूसरे agents के साथ संदेश साझा करने के लिए किया।

इन वेबसाइट्स को agents ने किसी messaging board की तरह इस्तेमाल किया। हालांकि, उपलब्ध जानकारी के मुताबिक agents ने इन platforms को सीधे hack नहीं किया, बल्कि वहां दूसरे agents के लिए संदेश पोस्ट किए।

इससे पहले इसी agent swarm ने एक German-language wiki को भी अपने नियंत्रण में लेकर उसे communication platform में बदल दिया था। वहां agents ने moderators का रूप धारण किया और OpenAI की restrictions को bypass करने तथा tests में cheating से जुड़े तरीके साझा किए।

स्वतंत्र शोधकर्ताओं को इसी अवधि के दौरान अन्य obscure websites पर भी ऐसी गतिविधियों के traces मिले। इनमें Chemistry से जुड़ी एक wiki, cognitive games के लिए बनाई गई wiki, Polish tech workers की दो personal websites और text-editing software से जुड़ी एक वेबसाइट शामिल थी।

Agents ने restrictions को bypass करने की कोशिश की

Researchers के मुताबिक, OpenAI ने इन agents को complex research questions हल करने का काम दिया था। उन्हें answers के लिए web scan करने की अनुमति थी, लेकिन किसी website पर content post करने की अनुमति नहीं थी।

इसी restriction को bypass करने के प्रयास में agents ने ऐसी पुरानी wikis और दूसरी websites को चुना, जहां non-standard commands के जरिए edits किए जा सकते थे। इन platforms का इस्तेमाल उन्होंने आपसी communication के लिए किया।

OpenAI ने Reuters को बताया कि उसे अब तक Hugging Face incident जैसी severity या scale वाली दूसरी activity नहीं मिली है। कंपनी ने agents के misalignment से जुड़ी घटनाओं की reporting के लिए एक नया framework जल्द पेश करने की भी बात कही है।

Anthropic ने Claude Opus 4.6 से जुड़ा चौथा incident बताया

Anthropic ने बुधवार, 9 सितंबर को जारी अपने alignment assessment report में Claude Opus 4.6 से जुड़ी एक और security घटना का खुलासा किया। यह घटना जनवरी 2026 में एक CTF यानी Capture the Flag cybersecurity exercise के दौरान हुई थी।

यह exercise एक third-party evaluation environment में चल रही थी। शुरुआत में Claude Opus 4.6 ने target के लिए गलत IP address इस्तेमाल कर दिया, जिससे उसका निर्धारित task unsolvable हो गया।

Task से बाहर निकलने में असमर्थ मॉडल ने दूसरे रास्ते तलाशने शुरू किए। इस दौरान उसने एक third party की मशीन खोजी, वहां एक file में मौजूद password हासिल किया और administrator access प्राप्त कर लिया। इसके बाद model ने अतिरिक्त credentials हासिल किए और system settings में बदलाव किए।

Anthropic के अनुसार, model ने third party से जुड़े एक व्यक्ति की personal information भी पढ़ी।

AI Safety और Transparency पर बढ़े सवाल

यह Anthropic द्वारा disclosed किया गया चौथा ऐसा incident है। कंपनी के अनुसार, पहले सामने आई घटनाओं में Claude Opus 4.7, Claude Mythos 5 और एक internal research test model से जुड़े मामले शामिल थे।

Anthropic ने माना कि pre-release auditing इस स्तर के misalignment को detect नहीं कर सकी थी। कंपनी ने इसके बाद अपने pre-release testing में ऐसे evaluations शामिल किए हैं, जो इस तरह के behavior को सीधे target करते हैं। इनमें ऐसा misconfigured CTF task भी शामिल है जिसका कोई in-scope solution नहीं है।

OpenAI और Anthropic दोनों closed-model providers हैं। ऐसे में बाहरी researchers के लिए models के अंदर होने वाली गतिविधियों को सीधे जांचना मुश्किल रहता है। इसके चलते इन घटनाओं ने AI agents की monitoring, safety testing और companies की transparency को लेकर बहस को और तेज कर दिया है।

Leave a comment