جدیدترین تحولات هوش مصنوعی را در کانال بله هوشیو بخوانید

Generic filters
Search in title
Filter by دسته‌ها
chatGTP
ابزارهای هوش مصنوعی
اخبار
گزارش خبری
پرامپت‌ نویسی
تیتر یک
چندرسانه ای
آموزش علوم داده
اینفوگرافیک
پادکست
ویدیو
دانش روز
آموزش‌های پایه‌ای هوش مصنوعی
اصول هوش مصنوعی
یادگیری بدون نظارت
یادگیری تقویتی
یادگیری عمیق
یادگیری نیمه نظارتی
آموزش‌های پیشرفته هوش مصنوعی
بینایی ماشین
پردازش زبان طبیعی
پردازش گفتار
چالش‌های عملیاتی
داده کاوی و بیگ دیتا
رایانش ابری و HPC
سیستم‌‌های امبدد
علوم شناختی
خطرات هوش مصنوعی
دیتاست
مدل‌های بنیادی
رویدادها
جیتکس
کاربردهای هوش مصنوعی
کتابخانه
اشخاص
شرکت‌های هوش مصنوعی
محصولات و مدل‌های هوش مصنوعی
مفاهیم
کسب‌و‌کار
تحلیل بازارهای هوش مصنوعی
کارآفرینی
هوش مصنوعی در ایران
هوش مصنوعی در جهان
مقاله
پیاده‌سازی هوش مصنوعی
گزارش
مصاحبه
هوش مصنوعی در عمل
یادداشت
 از هر ۳ پستی که با هوش مصنوعی نوشته می‌شود، ۲ پست در لینکدین منتشر می‌شود

نخستین بررسی تحلیلی داده‌های افزونه کروم Pangram

از هر ۳ پستی که با هوش مصنوعی نوشته می‌شود، ۲ پست در لینکدین منتشر می‌شود

زمان مطالعه: 5 دقیقه

Pangram شرکتی پژوهش‌محور است؛ نه‌تنها به دلیل توسعه الگوریتم‌های پیشرفته خود در زمینه تشخیص محتوای تولیدشده با هوش مصنوعی، بلکه به‌خاطر رصد میزان شیوع و مخاطرات این نوع محتوا.

این شرکت در آوریل ۲۰۲۶، افزونه کروم خود را با هدف مقابله با موج فزاینده محتوای هرز تولیدشده با هوش مصنوعی (AI Slop) در شبکه‌های اجتماعی منتشر کرد. این افزونه به کاربران امکان می‌دهد هنگام مرور شبکه‌های اجتماعی، پست‌ها را به‌صورت لحظه‌ای اسکن کنند و محتوای تولیدشده با هوش مصنوعی را شناسایی و علامت‌گذاری کنند تا بتوانند آگاهانه درباره نحوه صرف توجه و زمان خود تصمیم بگیرند.

چرا سوشال‌مدیا؟

شبکه‌های اجتماعی یکی از دشوارترین حوزه‌ها برای مطالعه پدیده AI Slop به شمار می‌روند؛ به‌مراتب دشوارتر از حوزه‌هایی مانند مقالات خبری، پژوهش‌های علمی یا نقد و بررسی‌های آمازون. بااین‌حال، این حوزه یکی از مهم‌ترین عرصه‌ها نیز هست، زیرا احتمالاً بیشترین حجم محتوای تولیدشده با هوش مصنوعی که کاربران به‌صورت روزانه با آن مواجه می‌شوند، در همین شبکه‌ها منتشر می‌شود.

Pangram معتقد است برای مقابله مؤثر با این مسئله، ابتدا باید آن را به‌درستی بشناسیم. به همین دلیل، در افزونه کروم خود گزینه‌ای اختیاری (Opt-in) قرار داده تا کاربران در صورت تمایل، آمار اسکن‌های خود را به‌صورت ناشناس در اختیار این شرکت قرار دهند و به تحقیقات کمک کنند. گزارش حاضر بر اساس داده‌هایی تهیه شده است که طی چند ماه نخست از این طریق گردآوری شده‌اند.

یافته‌های کلیدی

  • از هر چهار پست بلند (Longform) در شبکه‌های اجتماعی، یک پست به طور کامل توسط هوش مصنوعی تولید شده است.
  • از میان تمام پست‌هایی که به‌عنوان محتوای تولیدشده با هوش مصنوعی شناسایی شدند، حدود دوسوم متعلق به لینکدین بودند.
  • نزدیک به نیمی از مقالات منتشرشده در X حاوی متن تولیدشده با هوش مصنوعی بودند.

محتوای تولیدشده با هوش مصنوعی بیشترین تأثیر را بر مطالب بلند گذاشته است

در مجموعه‌داده‌های Pangram، محتوای تولیدشده با هوش مصنوعی در تمامی شبکه‌های اجتماعی مشاهده شد. به طور میانگین، ۱۳.۸ درصد از تمام موارد اسکن‌شده به‌عنوان محتوای تولیدشده با هوش مصنوعی شناسایی شدند، هرچند این نرخ بسته به پلتفرم و طول محتوا متفاوت بود. در چهار پلتفرم از پنج پلتفرم بررسی‌شده، احتمال تولید مطالب بلند توسط هوش مصنوعی بیش از محتوای کوتاه بود. در مجموع، از هر چهار محتوای بلند (۲۵.۷۲ درصد از مطالب بیش از ۲۵۰ کلمه)، یک مورد کاملاً توسط هوش مصنوعی تولید شده بود.

Substack تنها استثنا بود. در این پلتفرم، نرخ محتوای کاملاً تولیدشده با هوش مصنوعی تقریباً ثابت باقی ماند و حتی مطالب بلندتر و مفصل‌تر، اندکی کمتر از مطالب کوتاه در معرض تولید کامل توسط هوش مصنوعی قرار داشتند.

لینکدین اشباع‌شده‌ترین پلتفرم از نظر محتوای هوش مصنوعی بود؛ به‌گونه‌ای که بیش از ۴۰ درصد از پست‌های بلند آن به‌عنوان محتوای کاملاً تولیدشده با هوش مصنوعی شناسایی شدند. بااین‌حال، اگر محتواهای ترکیبی (ترکیب متن انسان و هوش مصنوعی) نیز در نظر گرفته شوند، وضعیت X از همه وخیم‌تر بود. تقریباً نیمی از مقالات منتشرشده در X یا کاملاً توسط هوش مصنوعی تولید شده بودند (۲۳.۹ درصد) یا با کمک هوش مصنوعی نوشته شده بودند (۲۲.۹ درصد). در نتیجه، تنها ۵۳.۲ درصد از مقالات X به‌عنوان محتوای کاملاً انسانی شناسایی شدند.

داده‌های Pangram نشان می‌دهد محتوای تولیدشده با هوش مصنوعی اکنون در همه شبکه‌های اجتماعی به یک مسئله تبدیل شده و بیشترین تأثیر را بر محتوای بلند گذاشته است. حتی در Substack که پایین‌ترین نرخ ترکیبی محتوای تولیدشده یا کمک‌گرفته از هوش مصنوعی را در میان پلتفرم‌های مبتنی بر مطالب بلند داشت، همچنان بیش از یک‌پنجم پست‌ها (۲۱.۹ درصد) به‌عنوان محتوای تولیدشده یا کمک‌گرفته از هوش مصنوعی شناسایی شدند.

سیل محتوای هرز هوش مصنوعی در لینکدین

لینکدین، در تمام شاخص‌ها، بالاترین سهم محتوای تولیدشده با هوش مصنوعی را در میان پلتفرم‌های بررسی‌شده داشت. اگرچه پست‌های لینکدین تنها یک‌سوم از کل موارد اسکن‌شده را تشکیل می‌دادند، اما نزدیک به دوسوم (۶۲ درصد) از تمام محتواهای تولیدشده با هوش مصنوعی که شناسایی شد، متعلق به همین پلتفرم بود.

برخلاف آنچه ممکن است انتظار برود، کاربران به طور گسترده حاضرند در محیط‌های حرفه‌ای که هویت واقعی آن‌ها با فعالیتشان گره خورده است، از هوش مصنوعی برای بیان دیدگاه‌های خود استفاده کنند؛ درحالی‌که استفاده از آن در پلتفرم‌های غیررسمی و ناشناس کمتر مشاهده می‌شود.

لینکدین نیز از چند مسیر مختلف، استفاده از هوش مصنوعی را در پلتفرم خود تشویق می‌کند؛ از جمله با ارائه قابلیت داخلی «Write with AI» که اکنون با نام «Enhance Post» شناخته می‌شود، اما همچنان امکان کمک‌گرفتن از هوش مصنوعی برای نگارش متن را فراهم می‌کند.

کاربران نیز به‌تدریج متوجه شهرت روزافزون لینکدین به‌عنوان بستری مملو از محتوای بی‌کیفیت تولیدشده با هوش مصنوعی شده‌اند. شاید در واکنش به همین وضعیت، یکی از مدیران اجرایی لینکدین اخیراً اعلام کرد این پلتفرم با استفاده از یک الگوریتم داخلی، پست‌های تولیدشده با هوش مصنوعی را شناسایی کرده و رتبه آن‌ها را کاهش خواهد داد؛ نکته طنزآمیز اینجاست که خود این اعلامیه نیز توسط هوش مصنوعی تولید شده بود.

صرف‌نظر از اینکه لینکدین تا چه اندازه در حال مدیریت حضور محتوای هوش مصنوعی در فید کاربران خود باشد، داده‌های Pangramنشان می‌دهد کاربران همچنان با حجم زیادی از نوشته‌های تولیدشده توسط هوش مصنوعی در این پلتفرم مواجه هستند.

پست‌های اصلی بیش از پاسخ‌ها توسط هوش مصنوعی تولید شده‌اند

در این مجموعه‌داده‌ها، Reddit بیشترین حجم اسکن را به خود اختصاص داد و ۳۶.۷ درصد از کل موارد بررسی‌شده مربوط به این پلتفرم بود. بااین‌حال، تنها ۴.۴ درصد از محتوای Reddit در دسته محتوای تولیدشده یا کمک‌گرفته از هوش مصنوعی قرار گرفت که یکی از پایین‌ترین نرخ‌ها در میان پلتفرم‌های بررسی‌شده محسوب می‌شود.

دلیل این موضوع، تفاوت در ترکیب داده‌هاست. پاسخ‌ها (Replies) در Reddit تقریباً همگی توسط انسان نوشته شده بودند (۹۸.۱ درصد) و در مجموع ۷۲ درصد از موارد اسکن‌شده در این پلتفرم را تشکیل می‌دادند. در مقابل، احتمال اینکه پست‌های اصلی (Top-level Posts) در Reddit  توسط هوش مصنوعی نوشته شده باشند، به‌مراتب بیشتر بود؛ به‌طوری که ۱۱.۶ درصد از این پست‌ها توسط هوش مصنوعی تولید شده بودند؛ رقمی که تقریباً با نرخ ۱۰ درصدی اشباع محتوای هوش مصنوعی در پست‌های X برابری می‌کند. همین الگو، هرچند با شدت کمتر، در لینکدین نیز مشاهده شد؛ به‌گونه‌ای که احتمال تولید یک پست اصلی در لینکدین توسط هوش مصنوعی ۱.۳۵ برابر بیشتر از یک کامنت بود.

بااین‌حال، اگر طول متن کنترل شود، نتیجه در لینکدین معکوس می‌شود؛ یعنی کامنت‌های لینکدین در واقع اندکی بیشتر از پست‌های اصلی احتمال می‌رود با هوش مصنوعی تولید شده باشد. اما در Reddit این تفاوت مستقل از قالب محتوا باقی می‌ماند؛ حتی پس از کنترل طول متن، احتمال اینکه یک پست اصلی Reddit توسط هوش مصنوعی تولید شده باشد، ۵.۲۵ برابر بیشتر از یک پاسخ است.

پاسخ‌های تقریباً عاری از هوش مصنوعی در Reddit، یکی از نقاط ضعف بسیاری از راهبردهای مقابله با ربات‌ها را آشکار می‌کند. سیاست مقابله با هرزنامه Reddit، حساب‌هایی را که از هوش مصنوعی برای تولید خودکار پاسخ‌های اسپم استفاده می‌کنند، به‌خوبی حذف می‌کند؛ اما این رویکرد تنها کم‌کیفیت‌ترین انواع اسپم را هدف قرار می‌دهد. پست‌های اصلی تنها یک‌چهارم از کل محتوای Reddit را تشکیل می‌دهند، اما تأثیر بسیار بیشتری بر مخاطبان دارند و ازآنجاکه تعدادشان کمتر است، پست‌های تولیدشده توسط هوش مصنوعی راحت‌تر از سازوکارهای نظارتی مبتنی بر حجم، مانند محدودسازی نرخ انتشار (Rate Limiting)، عبور می‌کنند.

روش تحقیق و گردآوری داده‌ها

از زمان انتشار افزونه کروم Pangram در ۲۴ آوریل ۲۰۲۶، کاربرانی که با اشتراک‌گذاری داده‌های خود برای اهداف پژوهشی موافقت کردند، به Pangram کمک کردند مجموعه‌داده‌ای شامل ۱,۰۰۲,۶۲۷ پست از چند مورد از بزرگ‌ترین شبکه‌های اجتماعی اینترنت، شامل LinkedIn، Medium، Substack، X (توییتر سابق) و Reddit ایجاد کند.

هر پست در این مجموعه‌داده تنها یک‌بار شمارش شده است و تنها مطالبی اسکن شده‌اند که بیش از ۵۰ کلمه داشته‌اند. تمام پست‌ها با استفاده از Pangram 3.3، مدل تشخیص محتوای تولیدشده با هوش مصنوعی این شرکت تحلیل شدند؛ مدلی که نرخ مثبت کاذب (False Positive Rate) آن تنها ۰.۰۱ درصد است.

این مجموعه‌داده تصویری مستقیم از نوع محتوای تولیدشده با هوش مصنوعی که کاربران در حال حاضر در فید شبکه‌های اجتماعی خود مشاهده می‌کنند، در اختیار قرار می‌دهد.

مطالب پیشنهادی مرتبط

اشتراک در
اطلاع از
0 نظرات
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها

در جریان مهم‌ترین اتفاقات AI بمانید

هر هفته، خلاصه‌ای از اخبار، تحلیل‌ها و رویدادهای هوش مصنوعی را در ایمیل‌تان دریافت کنید.

[wpforms id="48325"]