پرپلکسیتی در تلاش برای رد دعوای ردیت بر سر استخراج دادهها ناکام ماند
به نقل از رویترز، یک قاضی دادگاه فدرال در منهتن روز جمعه ۳۱ ژوئیه، بخش عمده درخواست شرکت Perplexity AI برای رد دعوای حقوقی مطرحشده از سوی Reddit را نپذیرفت. ردیت در این پرونده، پرپلکسیتی را متهم کرده است که با استخراج یا اصطلاحاً خزش (Scraping) دادههای این پلتفرم گفتوگوی آنلاین، قوانین کپیرایت ایالات متحده را نقض کرده و از این دادهها برای آموزش موتور جستوجوی مبتنی بر هوش مصنوعی خود استفاده کرده است.
ادامه رسیدگی به ادعاهای ردیت علیه پرپلکسیتی
«پل انگلمایر»، قاضی دادگاه منطقهای ایالات متحده در رأی خود اعلام کرد که ردیت میتواند همچنان ادعاهایش را مبنی بر اینکه پرپلکسیتی و سه شرکت فعال در حوزه استخراج داده، با دورزدن سازوکارهای حفاظتی این پلتفرم بهصورت غیرقانونی محتوا را برای آموزش مدلهای هوش مصنوعی سرقت کردهاند، پیگیری کند. انگلمایر همچنین تصریح کرد که ردیت از نظر حقوقی صلاحیت اقامه دعوی درباره سوءاستفاده ادعایی پرپلکسیتی از محتوای تولیدشده توسط کاربران خود را دارد.
واکنش پرپلکسیتی به رأی دادگاه
سخنگوی پرپلکسیتی در واکنش به این رأی گفت: «دعوی ردیت در واقع ادعا میکند که این شرکت حق دارد دسترسی به صفحات عمومی وبی که مالک آنها نیست را کنترل کند؛ آن هم با استفاده از یک ابزار امنیتی که خود توسعه نداده و از جانب کاربرانی که حتی از آنها اجازه نگرفته است. ما از اینترنت آزاد دفاع خواهیم کرد و در نهایت پیروز خواهیم شد.»
پاسخ ردیت به تصمیم قاضی
در مقابل، سخنگوی ردیت اظهار داشت: «رأی امروز ما را یک گام به پاسخگو کردن بازیگران متخلف نزدیکتر میکند. ردیت از دسترسی مسئولانه به محتوای عمومی حمایت میکند، اما با شرکتهایی که سازوکارهای حفاظتی ما را دور میزنند، قوانین ما را نادیده میگیرند و بدون مجوز از جوامع کاربری ما کسب درآمد میکنند، مخالف است.»
پرونده پرپلکسیتی در میان موج شکایتهای حقوقی هوش مصنوعی
این پرونده یکی از دهها شکایت حقوقی است که از سوی مالکان محتوا، از جمله نویسندگان، شرکتهای موسیقی و رسانههای خبری علیه شرکتهای فناوری به دلیل سوءاستفاده ادعایی از آثار دارای حق نشر برای آموزش سامانههای هوش مصنوعی مطرح شده است. ردیت سال گذشته نیز شکایت جداگانهای درباره استخراج داده علیه شرکت Anthropic تنظیم کرد که همچنان در دادگاه ایالتی کالیفرنیا در جریان رسیدگی است.
نقش محتوای ردیت در پاسخهای هوش مصنوعی
ردیت که میزبان هزاران جامعه کاربری موضوعمحور موسوم به سابردیت (Subreddit) است، در شکایت خود علیه پرپلکسیتی اعلام کرده که این پلتفرم رایجترین منبعی است که در پاسخهای تولیدشده توسط هوش مصنوعی به پرسشهای کاربران به آن استناد میشود. این شرکت پیشتر مجوز استفاده از محتوای خود را برای آموزش مدلهای هوش مصنوعی به شرکتهایی از جمله Google و OpenAI واگذار کرده است.
اتهام استخراج داده توسط شرکتهای واسطه
ردیت همچنین مدعی شده است که شرکت Oxylabs مستقر در لیتوانی، AWMProxy مستقر در روسیه و SerpApi مستقر در ایالت تگزاس که آنها نیز در این پرونده طرف شکایت هستند؛ بدون مجوز، دادههای ردیت را از میان میلیاردها نتیجه جستوجو استخراج کردهاند. به گفته ردیت، پرپلکسیتی که مجوز استفاده از محتوای این پلتفرم را در اختیار ندارد، دستکم با یکی از این شرکتها برای دستیابی به این دادهها همکاری کرده است.
دفاع SerpApi از دسترسی به نتایج جستوجوی عمومی
«جف هومریگ»، وکیل شرکت SerpApi از مؤسسه حقوقی Weil Gotshal & Manges، در بیانیهای اعلام کرد: «SerpApi به نتایج جستوجوی عمومی دسترسی دارد، نه به پلتفرم ردیت و اطلاعات عمومی صرفاً به این دلیل که یک پلتفرم قصد دارد برای دسترسی به آن هزینه دریافت کند، به اطلاعات حفاظتشده تبدیل نمیشود.» سخنگویان شرکت Oxylabs بلافاصله به درخواست رویترز برای اظهارنظر پاسخ ندادند و امکان برقراری ارتباط فوری با شرکت AWMProxy نیز فراهم نشد.
درخواست ردیت برای منع استفاده از دادهها
ردیت از دادگاه درخواست کرده است ضمن تعیین خسارت مالی که میزان آن مشخص نشده حکمی صادر کند که بر اساس آن پرپلکسیتی از استفاده از دادههای این پلتفرم منع شود. پرپلکسیتی تمامی این اتهامات را رد کرده است. قاضی انگلمایر در رأی روز جمعه خود برخی از ادعاهای فرعی ردیت را رد کرد، اما اجازه داد بخش اصلی پرونده، شامل ادعاهای مربوط به استخراج غیرقانونی دادههای ردیت توسط پرپلکسیتی و همچنین مشارکت این شرکت در تبانی با شرکتهای استخراج داده،