Thursday, June 5, 2025

Reddit Sues Anthropic Over Alleged AI Data Scraping

Reddit Sues Anthropic Over Alleged AI Data Scraping

Reddit Sues Anthropic Over Alleged AI Data Scraping

Reddit has initiated legal action against AI firm Anthropic, accusing it of unlawfully using user-generated content from its platform to train its AI assistant, Claude. 


The lawsuit, filed on Wednesday in California Superior Court, alleges breach of contract, asserting that Anthropic ignored Reddit's terms of service and scraped data without permission or proper licensing. 


This comes despite Reddit's explicit instructions against such practices and stands in contrast to its existing licensing agreements with other AI developers like OpenAI and Google.


According to Reddit's Chief Legal Officer, Ben Lee, the core of the complaint is that "AI companies should not be allowed to scrape information and content from people without clear limitations on how they can use that data." 


Lee emphasized Reddit's commitment to protecting its community and the vast public discourse generated daily on the platform. 


The social media giant, which went public last year, has highlighted that its partnerships with other AI firms allow for transparent and lawful data use, incorporating user protections such as content deletion and spam prevention—safeguards allegedly absent in Anthropic's conduct.


Anthropic, a company founded by former OpenAI executives in 2021 and significantly backed by Amazon, has denied the allegations.


 In a brief statement, the company declared, "We disagree with Reddit’s claims and will defend ourselves vigorously." 


This legal dispute diverges from typical AI-related lawsuits, as Reddit's filing focuses on breach of contract and unfair competition rather than copyright infringement, as seen in cases where music publishers have sued Claude for replicating song lyrics.


The lawsuit specifically references a 2021 research paper co-authored by Anthropic CEO Dario Amodei, which explicitly cited Reddit's subforums as high-quality sources for training AI systems. 


The paper noted that forums covering diverse topics like gardening, history, and personal advice were particularly valuable for modeling human language patterns.


 This direct mention suggests a deliberate and acknowledged use of Reddit's content for AI training.


Anthropic has previously argued that its methods of training Claude constitute lawful use, describing them as a form of statistical analysis rather than content reproduction, a stance articulated in a 2023 letter to the US Copyright Office. 


However, Reddit's lawsuit directly challenges this claim by asserting a clear violation of its terms of service and an unauthorized appropriation of its users' data, setting a precedent for how AI companies might be held accountable for their data acquisition practices.


Reddit ने कथित AI डेटा स्क्रैपिंग को लेकर एंथ्रोपिक पर मुकदमा दायर किया

Reddit ने AI फर्म एंथ्रोपिक के खिलाफ कानूनी कार्रवाई शुरू की है, जिसमें उस पर अपने AI सहायक, क्लाउड को प्रशिक्षित करने के लिए अपने प्लेटफ़ॉर्म से उपयोगकर्ता-जनित सामग्री का अवैध रूप से उपयोग करने का आरोप लगाया गया है।

कैलिफ़ोर्निया सुपीरियर कोर्ट में बुधवार को दायर किए गए मुकदमे में अनुबंध के उल्लंघन का आरोप लगाया गया है, जिसमें दावा किया गया है कि एंथ्रोपिक ने Reddit की सेवा की शर्तों की अनदेखी की और बिना अनुमति या उचित लाइसेंस के डेटा स्क्रैप किया।

यह Reddit के ऐसे व्यवहारों के खिलाफ़ स्पष्ट निर्देशों के बावजूद किया गया है और OpenAI और Google जैसे अन्य AI डेवलपर्स के साथ इसके मौजूदा लाइसेंसिंग समझौतों के विपरीत है।

Reddit के मुख्य कानूनी अधिकारी, बेन ली के अनुसार, शिकायत का मूल यह है कि "AI कंपनियों को लोगों से जानकारी और सामग्री को स्क्रैप करने की अनुमति नहीं दी जानी चाहिए, बिना इस बात पर स्पष्ट सीमाओं के कि वे उस डेटा का उपयोग कैसे कर सकते हैं।"

ली ने Reddit की अपने समुदाय और प्लेटफ़ॉर्म पर प्रतिदिन उत्पन्न होने वाले व्यापक सार्वजनिक प्रवचन की सुरक्षा के प्रति प्रतिबद्धता पर ज़ोर दिया।

 पिछले साल सार्वजनिक हुई सोशल मीडिया दिग्गज ने इस बात पर प्रकाश डाला है कि अन्य AI फर्मों के साथ इसकी साझेदारी पारदर्शी और वैध डेटा उपयोग की अनुमति देती है, जिसमें सामग्री हटाने और स्पैम रोकथाम जैसे उपयोगकर्ता सुरक्षा शामिल हैं - कथित तौर पर एंथ्रोपिक के आचरण में सुरक्षा उपाय अनुपस्थित हैं।

2021 में पूर्व OpenAI अधिकारियों द्वारा स्थापित और Amazon द्वारा समर्थित कंपनी एंथ्रोपिक ने आरोपों से इनकार किया है।

एक संक्षिप्त बयान में, कंपनी ने घोषणा की, "हम Reddit के दावों से असहमत हैं और अपना बचाव पूरी ताकत से करेंगे।"

यह कानूनी विवाद सामान्य AI-संबंधित मुकदमों से अलग है, क्योंकि Reddit की फाइलिंग कॉपीराइट उल्लंघन के बजाय अनुबंध के उल्लंघन और अनुचित प्रतिस्पर्धा पर केंद्रित है, जैसा कि उन मामलों में देखा गया है जहां संगीत प्रकाशकों ने गाने के बोलों की नकल करने के लिए क्लाउड पर मुकदमा दायर किया है।

मुकदमा विशेष रूप से एंथ्रोपिक के सीईओ डारियो एमोडी द्वारा सह-लिखित 2021 के शोध पत्र का संदर्भ देता है, जिसमें स्पष्ट रूप से Reddit के सबफ़ोरम को AI सिस्टम के प्रशिक्षण के लिए उच्च-गुणवत्ता वाले स्रोतों के रूप में उद्धृत किया गया है।

 पेपर में उल्लेख किया गया है कि बागवानी, इतिहास और व्यक्तिगत सलाह जैसे विविध विषयों को कवर करने वाले फ़ोरम मानव भाषा पैटर्न को मॉडलिंग करने के लिए विशेष रूप से मूल्यवान थे।

यह प्रत्यक्ष उल्लेख AI प्रशिक्षण के लिए Reddit की सामग्री के जानबूझकर और स्वीकृत उपयोग का सुझाव देता है।

एंथ्रोपिक ने पहले तर्क दिया है कि क्लाउड को प्रशिक्षित करने के उसके तरीके वैध उपयोग का गठन करते हैं, उन्हें सामग्री पुनरुत्पादन के बजाय सांख्यिकीय विश्लेषण के रूप में वर्णित करते हैं, एक ऐसा रुख जो यूएस कॉपीराइट कार्यालय को 2023 के पत्र में व्यक्त किया गया है।

हालांकि, Reddit का मुकदमा सीधे तौर पर इस दावे को चुनौती देता है, इसकी सेवा की शर्तों के स्पष्ट उल्लंघन और इसके उपयोगकर्ताओं के डेटा के अनधिकृत विनियोग का दावा करके, यह एक मिसाल कायम करता है कि कैसे AI कंपनियों को उनके डेटा अधिग्रहण प्रथाओं के लिए जवाबदेह ठहराया जा सकता है।

రెడ్డిట్ ఆరోపించిన AI డేటా స్క్రాపింగ్ పై ఆంత్రోపిక్ పై దావా వేసింది

Reddit AI సంస్థ ఆంత్రోపిక్ పై చట్టపరమైన చర్య తీసుకుంది, దాని AI అసిస్టెంట్ క్లాడ్ కు శిక్షణ ఇవ్వడానికి దాని ప్లాట్‌ఫామ్ నుండి వినియోగదారు రూపొందించిన కంటెంట్‌ను చట్టవిరుద్ధంగా ఉపయోగించిందని ఆరోపించింది. 

కాలిఫోర్నియా సుపీరియర్ కోర్టులో బుధవారం దాఖలు చేయబడిన వ్యాజ్యం, ఒప్పందాన్ని ఉల్లంఘించిందని ఆరోపించింది, ఆంత్రోపిక్ రెడ్డిట్ యొక్క సేవా నిబంధనలను విస్మరించిందని మరియు అనుమతి లేదా సరైన లైసెన్సింగ్ లేకుండా డేటాను స్క్రాప్ చేసిందని పేర్కొంది. 

అటువంటి పద్ధతులకు వ్యతిరేకంగా రెడ్డిట్ స్పష్టమైన సూచనలు ఉన్నప్పటికీ ఇది వస్తుంది మరియు OpenAI మరియు Google వంటి ఇతర AI డెవలపర్‌లతో దాని ప్రస్తుత లైసెన్సింగ్ ఒప్పందాలకు విరుద్ధంగా ఉంది.

రెడ్డిట్ యొక్క చీఫ్ లీగల్ ఆఫీసర్ బెన్ లీ ప్రకారం, ఫిర్యాదు యొక్క ప్రధాన అంశం ఏమిటంటే "AI కంపెనీలు ఆ డేటాను ఎలా ఉపయోగించవచ్చనే దానిపై స్పష్టమైన పరిమితులు లేకుండా ప్రజల నుండి సమాచారం మరియు కంటెంట్‌ను స్క్రాప్ చేయడానికి అనుమతించకూడదు." 

రెడ్డిట్ తన కమ్యూనిటీని మరియు ప్లాట్‌ఫామ్‌లో ప్రతిరోజూ ఉత్పన్నమయ్యే విస్తృత ప్రజా చర్చను రక్షించడంలో నిబద్ధతను లీ నొక్కి చెప్పాడు. 

 గత సంవత్సరం పబ్లిక్‌గా విడుదలైన సోషల్ మీడియా దిగ్గజం, ఇతర AI సంస్థలతో దాని భాగస్వామ్యాలు పారదర్శకంగా మరియు చట్టబద్ధమైన డేటా వినియోగాన్ని అనుమతిస్తాయని హైలైట్ చేసింది, కంటెంట్ తొలగింపు మరియు స్పామ్ నివారణ వంటి వినియోగదారు రక్షణలను ఆంత్రోపిక్ ప్రవర్తనలో లేవని ఆరోపించబడిన భద్రతా చర్యలు ఇందులో ఉన్నాయి.

2021లో మాజీ OpenAI కార్యనిర్వాహకులు స్థాపించిన మరియు Amazon ద్వారా గణనీయంగా మద్దతు ఇవ్వబడిన ఆంత్రోపిక్ అనే సంస్థ ఈ ఆరోపణలను ఖండించింది.

ఒక సంక్షిప్త ప్రకటనలో, కంపెనీ "మేము Reddit వాదనలతో విభేదిస్తున్నాము మరియు మమ్మల్ని తీవ్రంగా సమర్థించుకుంటాము" అని ప్రకటించింది.

ఈ చట్టపరమైన వివాదం సాధారణ AI-సంబంధిత వ్యాజ్యాల నుండి భిన్నంగా ఉంటుంది, ఎందుకంటే Reddit దాఖలు కాపీరైట్ ఉల్లంఘన కంటే ఒప్పంద ఉల్లంఘన మరియు అన్యాయమైన పోటీపై దృష్టి పెడుతుంది, సంగీత ప్రచురణకర్తలు పాటల సాహిత్యాన్ని ప్రతిరూపం చేసినందుకు క్లాడ్‌పై దావా వేసిన సందర్భాలలో ఇది కనిపిస్తుంది.

ఈ దావా ప్రత్యేకంగా ఆంత్రోపిక్ CEO డారియో అమోడీ సహ రచయితగా 2021 పరిశోధనా పత్రాన్ని ప్రస్తావిస్తుంది, ఇది Reddit యొక్క ఉప ఫోరమ్‌లను AI వ్యవస్థలకు శిక్షణ ఇవ్వడానికి అధిక-నాణ్యత మూలాలుగా స్పష్టంగా ఉదహరించింది.

 తోటపని, చరిత్ర మరియు వ్యక్తిగత సలహా వంటి విభిన్న అంశాలను కవర్ చేసే ఫోరమ్‌లు మానవ భాషా నమూనాలను మోడలింగ్ చేయడానికి చాలా విలువైనవని ఆ పత్రిక పేర్కొంది.

ఈ ప్రత్యక్ష ప్రస్తావన AI శిక్షణ కోసం రెడ్డిట్ కంటెంట్‌ను ఉద్దేశపూర్వకంగా మరియు అంగీకరించిన విధంగా ఉపయోగించడాన్ని సూచిస్తుంది.

ఆంత్రోపిక్ గతంలో క్లాడ్ శిక్షణా పద్ధతులు చట్టబద్ధమైన ఉపయోగాన్ని కలిగి ఉన్నాయని వాదించింది, వాటిని కంటెంట్ పునరుత్పత్తి కంటే గణాంక విశ్లేషణ యొక్క ఒక రూపంగా అభివర్ణించింది, ఈ వైఖరిని US కాపీరైట్ కార్యాలయానికి 2023లో రాసిన లేఖలో వ్యక్తీకరించారు. 

అయితే, రెడ్డిట్ వ్యాజ్యం దాని సేవా నిబంధనలను స్పష్టంగా ఉల్లంఘించిందని మరియు దాని వినియోగదారుల డేటాను అనధికారికంగా స్వాధీనం చేసుకున్నారని నొక్కి చెప్పడం ద్వారా ఈ వాదనను నేరుగా సవాలు చేస్తుంది, AI కంపెనీలు వారి డేటా సముపార్జన పద్ధతులకు ఎలా జవాబుదారీగా ఉండవచ్చో ఒక ఉదాహరణగా నిలుస్తుంది.

No comments:

Post a Comment

Please Dont Leave Me