Microsoft के कर्मचारियों ने AI Scraping को इतिहास की सबसे बड़ी श्रम चोरी बताया

NYT बनाम OpenAI मुकदमे के दस्तावेजों से पता चला है कि Microsoft के कर्मचारी AI द्वारा न्यूज़ कंटेंट के उपयोग को इतिहास की सबसे बड़ी श्रम चोरी मानते हैं।

Eliza Crichton-Stuart

Eliza Crichton-Stuart

अद्यतनित

Microsoft Staff Debated AI Scraping as Massive Labor Theft
विज्ञापन

"दुनिया भर के लाखों लोग जल्द ही यह मानने लगेंगे कि बड़े मॉडल्स का उनके पूरे काम को 'हूपर' (hoover) की तरह सोख लेना अभूतपूर्व स्तर की चोरी है।"

यह लाइन किसी बाहरी आलोचक ने नहीं कही थी। यह Microsoft के अंदर से आई है।

New York Times द्वारा OpenAI और Microsoft के खिलाफ कॉपीराइट मुकदमे में इस हफ्ते सार्वजनिक किए गए अदालती दस्तावेजों ने कुछ असहज आंतरिक बातचीत से पर्दा उठा दिया है। इन फाइलों से पता चलता है कि Microsoft के कर्मचारी सार्वजनिक बहस शुरू होने से सालों पहले ही AI ट्रेनिंग प्रैक्टिसेज पर कड़े सवाल उठा रहे थे, जिसमें यह भी शामिल था कि क्या यह पूरा ऑपरेशन इतिहास की सबसे बड़ी 'लेबर थेफ्ट' (श्रम चोरी) है।

विशेष ऑफर

कोड TRYHARD33 का उपयोग करें और ऑफर समाप्त होने से पहले इसका लाभ उठाएं।

GAMES+ सब्सक्रिप्शन पर 33% की छूट पाएं

अनसील किए गए दस्तावेजों में असल में क्या लिखा है

इस मुकदमे में, जिसे Times ने 2023 के अंत में फाइल किया था, अब ग्यारह अन्य पब्लिशर्स भी शामिल हो गए हैं। सदर्न डिस्ट्रिक्ट ऑफ न्यूयॉर्क के जज Sidney Stein फिलहाल समरी जजमेंट मोशन्स पर विचार कर रहे हैं, और उस प्रक्रिया के हिस्से के रूप में दस्तावेजों को अनसील किया जा रहा है।

सबसे चौंकाने वाली भाषा वाला मेमो Brent Hecht का था, जो Microsoft में एप्लाइड साइंस के डायरेक्टर हैं और Northwestern University में भी एक पद पर थे। 2023 के एक आंतरिक दस्तावेज में, Hecht ने लिखा कि बड़े AI मॉडल्स "एक ऐसा प्रोडक्ट हैं जो अपनी ही सप्लाई चेन को नष्ट कर देते हैं," और चेतावनी दी कि जनता अंततः उनके काम के बड़े पैमाने पर इस्तेमाल को अभूतपूर्व स्तर की चोरी मानेगी।

Microsoft ने इन शब्दों से खुद को दूर करने में देर नहीं की। कंपनी का कहना है कि Hecht को विशेष रूप से "अलग और असममित दृष्टिकोण पेश करने" के लिए रखा गया था और वे कोई निर्णय लेने वाले अधिकारी नहीं थे। Microsoft का तर्क है कि उनके मेमो कंपनी के विचारों का प्रतिनिधित्व नहीं करते हैं।

लेकिन बात यह है कि किसी को उन चिंताओं को उठाने के लिए भुगतान किया गया था, और उन चिंताओं को डॉक्यूमेंट किया गया था, यही वह सबूत है जो कोर्ट में मायने रखता है।

Nadella की गवाही और पेवॉल का सवाल

Microsoft के CEO Satya Nadella ने गवाही दी कि "जो कुछ भी पेवॉल के पीछे है, उसे इस्तेमाल करने के इच्छुक किसी भी व्यक्ति द्वारा लाइसेंस लिया जाना चाहिए।" उन्होंने आगे कहा कि अगर उन्हें पता होता कि OpenAI पेवॉल वाले कंटेंट पर ट्रेनिंग कर रहा है, तो वे मॉडल्स को दोबारा ट्रेन करने की मांग करने के अपने कॉन्ट्रैक्टुअल अधिकार का इस्तेमाल करते। कंपनी के एक प्रवक्ता ने बाद में कहा कि Nadella ने "व्यापक सिद्धांतों" के बारे में बात की थी कि लोग जानकारी कैसे ढूंढते और इस्तेमाल करते हैं, जिसे एक काफी बड़ा 'वॉक-बैक' (बयान से पलटना) माना जा रहा है।

Nadella ने शपथ के तहत जो कहा और कंपनी के प्रवक्ता ने बाद में जो स्पष्टीकरण दिया, उसके बीच के अंतर पर ध्यान देना जरूरी है क्योंकि यह केस आगे बढ़ रहा है।

OpenAI की आंतरिक बातचीत भी उतनी ही स्पष्ट थी

ये दस्तावेज OpenAI को भी नहीं बख्शते। एक OpenAI स्टाफ मेंबर ने प्रेसिडेंट Greg Brockman को ट्रेनिंग के दौरान Times के पेवॉल को बायपास करने के लिए एक वर्कअराउंड बनाने के बारे में बताया। Brockman का जवाब था: "ah nice."

ChatGPT प्रोडक्ट टीम चलाने वाले Nick Turley ने जून 2023 में लिखा कि AI पब्लिशर्स के लिए एक "अस्तित्व का खतरा" (existential threat) है। फरवरी 2024 तक, वे लिख रहे थे कि AI प्रोडक्ट्स "जैसे-जैसे बेहतर होंगे, वे और अधिक सब्स्टिट्यूटिव (विकल्प) बनते जाएंगे।" एक OpenAI इंजीनियर ने फरवरी 2023 में नोट किया कि "हम चाहे कितनी भी प्रमुखता से लिंक दिखाएं, यूजर्स सोर्स पर क्लिक नहीं करेंगे," जो सीधे तौर पर इस तर्क के खिलाफ जाता है कि चैटबॉट्स पब्लिशर्स को ट्रैफिक वापस भेजते हैं।

ज्यादातर प्लेयर्स यहाँ यह चूक रहे हैं कि ये किसी व्हिसलब्लोअर द्वारा लीक किए गए दस्तावेज नहीं हैं। ये आंतरिक संचार हैं जिन्हें OpenAI और Microsoft ने बनाया, स्टोर किया, और अब मुकदमेबाजी में उन्हें पेश करने के लिए कहा जा रहा है। कंपनियों को पता था कि वे उस समय क्या लिख रहे थे।

"डूम लूप" की चेतावनी

श्रम चोरी के फ्रेमिंग से परे, Hecht के 2023 के मेमो ने एक अलग चिंता उठाई जो अब AI रिसर्च सर्कल्स में एक लाइव डिबेट बन गई है। तर्क यह था कि AI-जनरेटेड कंटेंट पर ट्रेनिंग करने से एक फीडबैक लूप बनता है जो समय के साथ मॉडल की क्वालिटी को खराब कर देता है, क्योंकि मॉडल्स की एक पीढ़ी का आउटपुट अगली पीढ़ी के लिए ट्रेनिंग डेटा बन जाता है।

यह कोई मामूली चिंता नहीं है। रिसर्चर्स इस बात का अध्ययन कर रहे हैं कि जब सिंथेटिक डेटा ट्रेनिंग पूल को भर देता है तो मॉडल आउटपुट का क्या होता है, और परिणाम उत्साहजनक नहीं हैं। यहाँ मुख्य बात यह है कि Microsoft के अंदर कोई व्यक्ति इस जोखिम को आंतरिक रूप से फ्लैग कर रहा था, जबकि कंपनी सार्वजनिक रूप से AI की क्षमता को लेकर काफी उत्साहित थी।

फेयर यूज का तर्क और पब्लिशर्स का क्या कहना है

Microsoft और OpenAI दोनों तर्क दे रहे हैं कि पब्लिश किए गए कंटेंट पर ट्रेनिंग 'फेयर यूज' है, जो आर्टिकल्स को ओरिजिनल के विकल्प के बजाय कुछ नया बना देता है। उस तर्क का परीक्षण अभी ट्रायल में होना बाकी है।

Steven Lieberman, जो New York Daily News और सात अन्य वादी पब्लिशर्स का प्रतिनिधित्व करते हैं, ने अनसील किए गए दस्तावेजों पर वादियों के नजरिए को स्पष्ट रूप से संक्षेप में कहा: "दुनिया देख सकती है कि OpenAI और Microsoft अपने व्यवहार की निष्पक्षता के बारे में शुरू से क्या सोचते थे।"

OpenAI के तत्कालीन पॉलिसी डायरेक्टर Jack Clark के 2020 के एक मेमो ने चेतावनी दी थी कि कंपनी "ऐसे सिस्टम बना रही है जो समाज की संस्कृति को परिभाषित करने वाले लोगों के श्रम की जगह ले रहे हैं" और यह "इस बात का प्रतीक बन जाएगा कि कैसे सिलिकॉन वैली बिना सोचे-समझे जीवन के अन्य हिस्सों में कदम रख रही है और पीछे गंदगी छोड़ रही है।" Clark बाद में Anthropic की सह-स्थापना के लिए चले गए।

Times ने अपने केस में वादी होने के नाते टिप्पणी करने से इनकार कर दिया। OpenAI ने टिप्पणी के अनुरोधों का जवाब नहीं दिया।

व्यापक AI और गेमिंग इकोसिस्टम के लिए इसका क्या मतलब है

यह केस पब्लिशिंग इंडस्ट्री से कहीं आगे तक मायने रखता है। ट्रेनिंग डेटा, सहमति और मुआवजे के बारे में वही सवाल गेम डेवलपमेंट, कॉन्सेप्ट आर्ट, वॉयस एक्टिंग और नैरेटिव राइटिंग सहित सभी रचनात्मक क्षेत्रों में पूछे जा रहे हैं। यदि अदालतें अंततः यह फैसला सुनाती हैं कि मास AI स्क्रैपिंग 'फेयर यूज' नहीं है, तो AI टूल्स के निर्माण और लाइसेंसिंग के तरीके पर इसके परिणाम हर रचनात्मक उद्योग में दिखाई देंगे।

गेमर्स और डेवलपर्स के लिए जो AI टूल्स को प्रोडक्शन पाइपलाइन्स का स्टैंडर्ड हिस्सा बनते देख रहे हैं, इस केस का परिणाम यह तय कर सकता है कि वे टूल्स कैसे दिखेंगे और उनके इस्तेमाल पर किसे भुगतान मिलेगा। आप जज Stein के समरी जजमेंट रूलिंग पर नजर रखना चाहेंगे, जो यह संकेत देगा कि क्या यह मामला ट्रायल तक जाएगा या पूरा एविडेंस रिकॉर्ड टेस्ट होने से पहले ही सुलझ जाएगा।

गेम कैसे बनाए जाते हैं, इस पर असर डालने वाली इंडस्ट्री स्टोरीज की अधिक कवरेज के लिए, हमारे gaming guides देखें और इस स्पेस पर नजर बनाए रखें क्योंकि मुकदमा अदालतों में आगे बढ़ रहा है।

रिपोर्ट्स

अद्यतनित

September 18th 2026

पोस्ट किया गया

September 18th 2026

विज्ञापन

संबंधित समाचार