कंपनी ने पहले से दर्ज न की गई घटनाओं का भी खुलासा किया जिसमें उसके एआई मॉडल ने गलत तरीके से व्यवहार किया, जिसमें बिना पूछे इंटरनेट पर फ़ाइलें अपलोड करना भी शामिल था।
ओपनएआई ने बुधवार को एक नए ढांचे की घोषणा की कि वह सार्वजनिक रूप से एआई मिसलिग्न्मेंट घटनाओं का खुलासा कैसे करता है, कंपनी का कहना है कि उसे उम्मीद है कि इससे पूरे उद्योग में समान मानकों को सूचित करने में मदद मिलेगी। कंपनी पिछले साल पहचाने गए एआई मॉडल मिसलिग्न्मेंट के कई उदाहरणों के बारे में नई जानकारी भी जारी कर रही है
ओपनएआई के संरेखण अनुसंधान के नवनियुक्त प्रमुख काई चेन ने WIRED को बताया, “जैसे-जैसे मॉडल आगे बढ़ते हैं और अधिक व्यापक रूप से तैनात होते हैं, एआई विकास के बारे में निर्णयों के लिए सबूत की आवश्यकता होती है, जिसकी जांच फ्रंटियर मॉडल बनाने वाली कंपनियों के बाहर के लोग कर सकते हैं।” “हमें विश्वास नहीं है कि एआई उद्योग ने अधिकतम गति पर जिम्मेदारीपूर्वक स्केलिंग जारी रखने के लिए संरेखण और निगरानी को पर्याप्त हद तक हल कर लिया है।”
WIRED के साथ एक ब्रीफिंग में, OpenAI के एक अधिकारी ने कहा कि कंपनी ने पहले बहुत कम ही गलत संरेखण की घटनाओं का खुलासा किया था। अधिकारी, जो नाम न छापने की शर्त पर ब्रीफिंग के लिए सहमत हुए, ने कहा कि नया ढांचा ओपनएआई के लिए जनता को तुरंत सूचित करना आसान बनाने के लिए डिज़ाइन किया गया है जब उसे पता चलता है कि उसके एआई मॉडल अप्रत्याशित तरीके से व्यवहार कर रहे हैं, इससे पहले कि वह पूरी तरह से जांच कर सके, समझा सके या व्यवहार को कम कर सके।
फ्रेमवर्क ओपनएआई कर्मचारियों के लिए कंपनी के वरिष्ठ सुरक्षा और संरेखण नेताओं को गलत संरेखण की घटनाओं की रिपोर्ट करने के तरीकों की रूपरेखा देता है, जो तब यह निर्धारित करेंगे कि आगे की जांच की आवश्यकता है या नहीं। ओपनएआई का कहना है कि वह अन्य एआई डेवलपर्स, बाहरी शोधकर्ताओं, उद्योग मानक निकायों और नियामकों के सहयोग से अधिक उद्देश्यपूर्ण प्रकटीकरण मानदंड विकसित करने की योजना बना रहा है। कंपनी का कहना है कि वह अमेरिकी संघीय सरकार को सुरक्षा, सुरक्षा और गलत संरेखण की घटनाओं का खुलासा करने के लिए प्रस्तावित रिपोर्टिंग तंत्र पर सक्रिय रूप से काम कर रही है।
ओपनएआई ने एक ब्लॉग पोस्ट में कहा, “फिलहाल, एआई डेवलपर्स को अपने मॉडलों में गलत संरेखण के उदाहरणों का खुलासा कैसे करना चाहिए, इसके लिए स्पष्ट मानकों के साथ कोई उद्योग-व्यापी ढांचा नहीं है।” “हमें उम्मीद है कि आज हम जिस ढांचे की रूपरेखा तैयार कर रहे हैं वह ऐसे मानकों को बनाने की दिशा में पहला कदम है, जो यह निर्धारित करेगा कि डेवलपर्स को कौन से गलत संरेखण उदाहरणों का खुलासा करना चाहिए और उनकी रिपोर्ट में क्या शामिल होना चाहिए।”
ओपनएआई एआई उद्योग के लिए एक महत्वपूर्ण मोड़ पर रूपरेखा जारी कर रहा है। पिछले सप्ताहांत, ओपनएआई के सीईओ सैम ऑल्टमैन ने धीमी एआई विकास पर समन्वय के लिए तकनीकी उद्योग के लिए एंथ्रोपिक सीईओ डारियो अमोदेई के प्रस्ताव के लिए समर्थन का संकेत दिया। कार्रवाई का आह्वान एआई शोधकर्ता जैकब कॉक्सन द्वारा एंथ्रोपिक से इस्तीफा देने और बाद में जनता को चेतावनी देने के लिए वायरल होने के कुछ ही दिनों बाद आया कि अग्रणी प्रयोगशालाओं के बीच तेजी से उन्नत एआई विकसित करने की दौड़ मानवता की सुरक्षा को खतरे में डाल रही है।
एआई मंदी के आह्वान को राष्ट्रपति ट्रम्प के प्रशासन द्वारा प्रतिरोध का सामना करना पड़ा है, जिसने तर्क दिया है कि उद्योग को यह सुनिश्चित करने के लिए नए कानूनों या विनियमों की आवश्यकता नहीं है कि इसकी तकनीक सुरक्षित है।
OpenAI द्वारा बुधवार को साझा किए गए दो गलत संरेखण उदाहरणों में कंपनी के आंतरिक, अप्रकाशित AI मॉडल शामिल थे, जिसके बारे में OpenAI का कहना है कि ऐसा करने का निर्देश न दिए जाने के बावजूद इंटरनेट पर फ़ाइलें अपलोड की गईं।
एक घटना अक्टूबर 2025 में हुई, जब ओपनएआई का कहना है कि वह अपने उत्तरों में सार्वजनिक रूप से उपलब्ध डेटा का हवाला देने की क्षमता पर अपने एक मॉडल का परीक्षण कर रहा था। लेकिन जब मॉडल को आवश्यक जानकारी नहीं मिल पाई, तो उसने एक अस्थायी फ़ाइल होस्टिंग सेवा पर एक फ़ाइल अपलोड की, जिसे बाद में उसने अपने उत्तर में उद्धृत करने का प्रयास किया। कंपनी का कहना है कि यह बेंचमार्क पर मॉडल की दक्षता का आकलन करने के लिए इस्तेमाल की जाने वाली स्वचालित ग्रेडिंग प्रणाली का फायदा उठाने का प्रयास प्रतीत होता है।
div
Source: WIRED







