2023 की शुरुआत से, फोटोग्राफर जिंगना झांग और स्वयंसेवकों के एक छोटे दल ने कारा नामक छवि-साझाकरण सोशल मीडिया और पोर्टफोलियो ऐप को बनाए रखने के लिए अथक प्रयास किया है। अब तक इसने लगभग 15 लाख कलाकारों को आकर्षित किया है। किस चीज़ ने उन्हें मंच तक खींचा? एआई मॉडल को प्रशिक्षित करने के लिए उनके काम के अनधिकृत उपयोग का साझा विरोध और बिग टेक द्वारा शोषण से बचते हुए अपनी कला को प्रचारित करने की इच्छा
लेकिन जबकि कैरा एआई छवियों को फ़िल्टर करता है और कुछ न्यूनतम सुरक्षात्मक सुविधाएँ प्रदान करता है, स्क्रैप्स को रोकना लगभग असंभव है। और इसी महीने, 13 अगस्त से शुरू होकर, कारा को तीन बड़े संकटों का सामना करना पड़ा, जिससे इसकी सर्वर फीस बढ़ गई और उन रचनाकारों को चिंता हुई जो इंस्टाग्राम जैसे प्लेटफार्मों से वहां चले गए थे, जहां सभी सामग्री स्पष्ट रूप से प्रशिक्षण डेटा के रूप में मेटा के लिए उपलब्ध है।
इनमें से पहली घटना तब सामने आई जब जिम्मेदार व्यक्ति ने सबरेडिट आर/डिफेंडिंगएआईआर्ट में यह घोषणा की कि उसने कैरा से 12 मिलियन कार्यों का 12-टेराबाइट संग्रह प्राप्त किया है – कमोबेश इसकी सार्वजनिक रूप से उपलब्ध छवियों की पूरी लाइब्रेरी। “यह एक मजेदार प्रोजेक्ट था,” उन्होंने अपने डिलीट किए गए पोस्ट में मंदारिनडॉनपॉपी994 हैंडल के तहत लिखा, यह कहते हुए कि इस प्रक्रिया में उनकी लागत $10 से भी कम थी।
झांग ने WIRED को बताया, “हमें वास्तव में इसके बारे में हमारे उपयोगकर्ताओं द्वारा हमें टैग करने के माध्यम से पता चला, क्योंकि स्क्रैपर” रेडिट पर डेटासेट के साथ कुछ करने के लिए अपने साथ शामिल होने के लिए अन्य लोगों की तलाश कर रहा था, “उसने जो किया था उसकी नैतिकता के बारे में एआई-संबंधित मंचों पर एक भयंकर बहस छिड़ गई। “मुझे लगता है कि यह लक्षित और बहुत हानिकारक है,” वह आगे कहती हैं, इस तरह के डेटा संग्रह के खिलाफ सुरक्षा के लिए “कानूनों को नहीं पकड़ा जाता है”, जिसका अर्थ है कि स्क्रैपर्स अक्सर इसे तकनीकी रूप से कानूनी ठहरा सकते हैं। (झांग दृश्य कलाकारों द्वारा लाई गई दो चल रही वर्ग कार्रवाइयों का अलग से हिस्सा है, एक स्टेबिलिटी एआई, मिडजर्नी और अन्य के खिलाफ और दूसरा Google के खिलाफ, जिसमें आरोप लगाया गया है कि कंपनियों के छवि जनरेटर टूल को उनके कॉपीराइट किए गए काम पर प्रशिक्षित किया गया था।)
हालाँकि, घटनाओं के एक आश्चर्यजनक मोड़ में, जिस व्यक्ति ने कारा से सारी कलाएँ छीन लीं, उसे अपने स्टंट पर पछतावा होगा और वह कलाकारों की सुरक्षा के लिए एक नए ओपन-सोर्स टूल पर झांग के साथ सहयोग करने के लिए सहमत होगा।
इस बीच, दुर्भाग्य से, अन्य स्क्रैपर्स कारा की कमजोरियों और न्यूनतम संसाधनों का फायदा उठाते रहे। जबकि कई एआई समर्थकों ने कारा के पीछे जाने पर आपत्ति जताई, कुछ को स्पष्ट रूप से मंदारिनडॉनपॉपी994 द्वारा ऐसा करने के लिए प्रोत्साहित किया गया, जिसे झांग “नकल” हमलों के रूप में देखता है।
एक दूसरे स्क्रैपर ने कारा से लगभग 8.5 मिलियन लिंक, साथ ही उपयोगकर्ता नाम, शीर्षक और टैग जैसे मेटाडेटा खींचे और इन्हें एआई डेवलपर प्लेटफॉर्म हगिंग फेस पर अपलोड कर दिया। हगिंग फेस पर निष्कासन अनुरोधों की बौछार होने के बाद, इसने एक बयान में जवाब दिया कि हालांकि यह व्यक्तिगत मेटाडेटा को हटाने के लिए उपयोगकर्ता, “कैप्टिवड्रीमर” को नोटिस जारी करेगा, यह यूआरएल के लिए ऐसा नहीं कर सकता, क्योंकि “कलाकृतियों की कोई प्रतियां यहां होस्ट नहीं की गई हैं,” और लिंक “कारा पर प्रकाशित कलाकारों की प्रतियों की ओर इशारा करते हैं।” कंपनी ने निष्कर्ष निकाला कि “उसी आधार पर आगे की कॉपीराइट रिपोर्ट इस परिणाम को नहीं बदलेगी।”
अंततः, 22 अगस्त को, एक तीसरे स्क्रेपर ने कारा से 123,000 छवियां प्राप्त कीं, साथ ही टेक्स्ट पोस्ट और उपयोगकर्ता बायोस जिसमें व्यक्तिगत जानकारी शामिल थी, इन सभी को अकादमिक टोरेंट नामक साइट पर साझा किया गया। फिर झांग ने $120,000 का लक्ष्य निर्धारित करते हुए कानूनी फीस के लिए एक GoFundMe लॉन्च किया, जिसमें बताया गया कि यह पैसा साइबर और कॉपीराइट कानूनों के माध्यम से कारा की रक्षा की किसी भी और सभी रणनीतियों की खोज में खर्च किया जाएगा। गुरुवार तक, उसने $100,000 से अधिक जुटा लिया है, और वह कहती है कि कारा सक्रिय रूप से किसी भी अतिरिक्त कानूनी सहायता की तलाश में है
झांग न केवल स्क्रैपिंग से निराश है, बल्कि इस भ्रम से भी कि वह और कारा टीम कलाकारों को दुर्भावनापूर्ण अभिनेताओं से बचाने के लिए वास्तविक रूप से क्या कर सकती है, यह कहते हुए कि कुछ उपयोगकर्ताओं ने पहले ही अपने पोर्टफोलियो हटा दिए हैं और साइट छोड़ दी है। झांग ऐप के वर्तमान सुरक्षा उपायों के बारे में कहती हैं, “हमने इसे उपयोग में भयानक बनाए बिना सीमा के भीतर सही काम किया है, जिसमें लॉगिन गेट्स जैसे कुछ नए अस्थायी उपाय शामिल हैं – जो, वह कहती हैं, वास्तव में चल रही, इंटरनेट-व्यापी समस्या का समाधान नहीं हैं
div
Source: WIRED

