مدلدزدی یا استفاده حرفهای چینیها از مدلهای امریکایی
چرا این روزها بحث تقطیر مدلهای هوش مصنوعی اینقدر داغ شده است؟
شرکتهای آمریکایی مدعیاند رقبای چینی با استفاده از روشی که سالهاست در صنعت هوش مصنوعی وجود دارد، بهصورت غیرمنصفانه سامانههای هوش مصنوعی آنها را کپی میکنند.
به نقل از نیویورکتایمز، شرکتهای آمریکایی توسعهدهنده مدلهای هوش مصنوعی با صدای بلند اعتراض میکنند که رقبای چینی آنها به شکلی ناعادلانه در حال کپیبرداری از فناوریهایشان هستند و از مقامهای دولتی میخواهند برای مقابله با این موضوع اقدام کنند.
شکایت به سنا
در تاریخ ۱۰ ژوئن، شرکت آنتروپیک در نامهای به «تیم اسکات» و «الیزابت وارن» بهعنوان ۲ سناتور، غول فناوری چین یعنی علیبابا را متهم کرد که با استفاده از روشی موسوم به «تقطیر» (Distillation)، به طور پنهانی فناوریهای هوش مصنوعی این شرکت را کپی کرده است.
بر اساس این نامه که روزنامه نیویورکتایمز آن را مشاهده کرده است، علیبابا همانند دیگر شرکتهای چینی از طریق دهها هزار حساب کاربری غیرمجاز به فناوریهای آنتروپیک دسترسی پیدا کرده و سپس از دادههای جمعآوریشده برای آموزش مدلهای هوش مصنوعی خود استفاده کرده است. آنتروپیک از این دو سناتور که ریاست کمیتهای در سنا را بر عهده دارند و قرار بود نشستی درباره هوش مصنوعی برگزار کنند، خواست راهکارهایی برای محدودکردن استفاده چین از روش تقطیر بررسی کنند.
آنتروپیک در این نامه خطاب به دو سناتور نوشت: «این حملات مبتنی بر تقطیر، بهصورت غیرقانونی، ساختاریافته و در مقیاس صنعتی انجام میشوند تا قابلیتهای هوش مصنوعی آزمایشگاههای پیشرو آمریکا استخراج و سپس با نام خودشان بازبستهبندی شوند.» منظور از «آزمایشگاههای پیشرو»، شرکتهایی است که در مرزهای پیشرفته توسعه هوش مصنوعی فعالیت میکنند.
فاصله چین تا آمریکا
کارشناسان معتقدند چین اکنون تنها حدود شش ماه از ایالات متحده در توسعه هوش مصنوعی عقبتر است. آنتروپیک و دیگر شرکتهای آمریکایی استدلال میکنند که اگر روش تقطیر در اختیار شرکتهای چینی نبود، فاصله آنها با آمریکا بسیار بیشتر میشد؛ موضوعی که میتواند بر کاربردهای مهم هوش مصنوعی از برنامهریزی کسبوکار و پژوهشهای دارویی گرفته تا نظارت انبوه و تسلیحات نظامی، تأثیر بگذارد.
در هوشیو بخوانید:
این نگرانیها پس از آن شدت بیشتری یافته است که استارتاپ چینی Z.ai مدل هوش مصنوعی GLM-5.2 را معرفی کرده؛ مدلی که از نظر توانمندی، فاصله بسیار کمی با پیشرفتهترین سامانههای آمریکایی دارد. این مدل در حوزه امنیت سایبری نیز عملکردی همتراز با نمونههای آمریکایی از خود نشان داده است؛ حوزهای که هم شرکتهای آمریکایی هوش مصنوعی و هم دولت دونالد ترامپ آن را از منظر ژئوپلیتیکی بسیار حیاتی میدانند.
آیا تقطیر مفهوم جدیدی است؟
تقطیر مفهوم جدیدی نیست و بیش از یک دهه است که به طور گسترده در صنعت فناوری مورداستفاده قرار میگیرد. گروه کوچکی از پژوهشگران گوگل در اوایل دهه ۲۰۱۰ این روش را بهعنوان راهکاری برای ساخت سامانههای هوش مصنوعی کارآمدتر توسعه دادند.
در این روش، پژوهشگران میتوانند از یک سامانه بسیار قدرتمند، داده جمعآوری کرده و همان دادهها را برای آموزش سامانهای جدید به کار ببرند که روی سختافزارهای ارزانتر قابلاجرا باشد. «جفری هینتون»، پژوهشگر سابق گوگل که در توسعه این روش نقش داشته است میگوید: «مدل اول اساساً به مدل دوم یاد میدهد چگونه رفتار کند. تصور کنید یکی از مدلها نقش معلم را دارد و دیگری نقش دانشآموز.»
پس تقطیر راهی برای کپیکردن هوش مصنوعی خودتان است؟
دقیقاً؛ اما برخی شرکتها از این روش برای تقلید از فناوریهایی استفاده کردند که توسط آزمایشگاههای دیگر هوش مصنوعی توسعه یافته بودند. آنها اغلب رفتار سامانههای متنباز را کپی میکردند؛ سامانههایی که هر فردی میتواند آزادانه از آنها استفاده کند، آنها را تغییر دهد و نسخهبرداری کند. در واقع، آزمایشگاههایی که مدلهای خود را متنباز منتشر میکنند، دقیقاً همین هدف را دنبال میکنند؛ اینکه توسعه هوش مصنوعی با مشارکت همگانی سریعتر پیش برود و همه از آن منتفع شوند.
تقطیر چه زمانی به یک مشکل تبدیل میشود؟
آنتروپیک، OpenAI و دیگر آزمایشگاههای هوش مصنوعی زمانی با این روش مخالفت میکنند که شرکتها از تقطیر برای تقلید از رفتار سامانههای اختصاصی آنها استفاده کنند؛ سامانههایی که متنباز نیستند و معمولاً پیشرفتهترین محصولات این شرکتها به شمار میروند. آنتروپیک و OpenAI در شرایط استفاده (Terms of Service) خود، تقطیر مدلهای پیشرفتهشان را ممنوع کردهاند؛ بااینحال، این کار همچنان به طور گسترده انجام میشود.
در ماه آوریل، ایلان ماسک هنگام ادای شهادت در یک دادگاه فدرال در شهر اوکلند کالیفرنیا، به انجام این کار در شرکت xAI اذعان کرد. زمانی که یکی از وکلا از او پرسید آیا xAI تاکنون فناوری OpenAI را تقطیر کرده است یا خیر، ماسک پاسخ داد: «بهطورکلی، شرکتهای هوش مصنوعی فناوری سایر شرکتهای هوش مصنوعی را تقطیر میکنند.»
در هوشیو بخوانید:
آیا تقطیر غیرقانونی است؟
پاسخ این پرسش هنوز روشن نیست. «سارا تیشلر»، شریک مؤسسه حقوقی Beck Reed Riden و متخصص دعاوی مربوط به اسرار تجاری میگوید وضعیت حقوقی این موضوع همچنان مبهم است. برخی حقوقدانان معتقدند این اقدام با قانون دفاع از اسرار تجاری (Defend Trade Secrets Act) مصوب سال ۲۰۱۶ مغایرت دارد؛ قانونی که به کسبوکارها اجازه میدهد در صورت سرقت اسرار تجاری، اقامه دعوی کنند. بااینحال، دادگاهها تاکنون بهصراحت درباره مصداق بودن تقطیر در چارچوب این قانون اظهارنظر نکردهاند. ازسویدیگر، قوانین کپیرایت نیز الزاماً شامل این موضوع نمیشوند؛ زیرا در تقطیر، هدف کپیکردن رفتار سامانه است، نه بازتولید لفظبهلفظ متن یا محتوای آن.
آیا شرکتهای چینی نیز همین کار را انجام میدهند؟
این موضوع نیز کاملاً روشن نیست. احتمالاً شرکتهای چینی نیز همانند شرکتهای آمریکایی نظیر xAI، مدلهای اختصاصی را از طریق تقطیر تقلید کردهاند. بااینحال، فعالیتهای شرکتهای چینی در این حوزه نگرانی بسیار بیشتری برای آنتروپیک، OpenAI و دیگر شرکتهای آمریکایی ایجاد کرده است.
حدود ۱۸ ماه پیش، استارتاپ چینی DeepSeek با نشاندادن اینکه میتواند مدلهای هوش مصنوعی کارآمد را با هزینهای بسیار کمتر از بسیاری از رقبای آمریکایی توسعه دهد، سیلیکونولی را شگفتزده کرد. اندکی بعد، OpenAI این شرکت را به تقطیر فناوریهای خود متهم کرد.
در ماه فوریه، آنتروپیک نیز DeepSeek و دو استارتاپ چینی دیگر را متهم کرد که حجم عظیمی از دادههای اختصاصی این شرکت را به طور غیرمجاز استخراج کردهاند. به گفته آنتروپیک، این استارتاپها با استفاده از حدود ۲۴ هزار حساب کاربری، بیش از ۱۶ میلیون گفتوگو با چتبات Claude ایجاد کردهاند؛ گفتوگوهایی که میتوانستند برای آموزش مهارتهای موردنیاز چتباتهای خودشان مورداستفاده قرار گیرند.
آنتروپیک چگونه از این موضوع مطلع شده است؟
آنتروپیک به طور مستمر نحوه استفاده کاربران از سامانههای خود را پایش میکند. به گفته این شرکت، الگوهای رفتاری تکرارشونده نشان میداد که حسابهای کاربری مرتبط با چین در حال استخراج داده از مدلهای اختصاصی آن هستند. آنتروپیک مدعی است شرکتهای مختلف چینی با استفاده از شبکهای از حسابهای کاربری به سامانههای این شرکت دسترسی پیدا کردهاند و هر یک از آنها از دادههای جمعآوریشده برای آموزش فناوریهای هوش مصنوعی خود بهره میبرند.
آیا آنتروپیک میتواند جلوی این کار را بگیرد؟
آنتروپیک، OpenAI و گوگل اعلام کردهاند که اطلاعات خود را با یکدیگر به اشتراک میگذارند تا بتوانند با این رویه مقابله کنند. بااینحال، جلوگیری از آن ساده نیست؛ زیرا اگر آنتروپیک تعداد زیادی از حسابهای کاربری را مسدود کند، ممکن است کاربران واقعی نیز بهاشتباه از دسترسی محروم شوند. تیشلر نیز معتقد است حتی اگر قوانین آمریکا تقطیر غیرقانونی را ممنوع کنند، احتمالاً تأثیر چندانی بر رفتار شرکتهای چینی نخواهد داشت. او میگوید: «بخش عمده این فعالیتها خارج از ایالات متحده انجام میشود. بنابراین رسیدگی به آنها از طریق دادگاههای آمریکا بسیار دشوار خواهد بود.» (روزنامه نیویورکتایمز در سال ۲۰۲۳ علیه OpenAI و مایکروسافت شکایتی با موضوع نقض حق نشر محتوای خبری در ارتباط با سامانههای هوش مصنوعی مطرح کرد. هر دو شرکت این اتهامات را رد کردهاند.)
شرکتهای آمریکایی چه اقدام دیگری میتوانند انجام دهند؟
آنتروپیک از کنگره آمریکا خواسته است قانونی تصویب کند که امکان «همکاری عمیقتر برای مقابله با حملات مبتنی بر تقطیر، هم میان دولت آمریکا و آزمایشگاههای پیشرو و هم میان خود این آزمایشگاهها» را فراهم کند. این شرکت همچنین پیشنهاد کرده است دولت آمریکا محدودیتهای خود بر دسترسی چین به تراشههای تخصصی موردنیاز برای آموزش سامانههای هوش مصنوعی را گسترش دهد. قدرتمندترین تراشههای جهان توسط شرکتهای آمریکایی طراحی میشوند و دولت فدرال نیز با اعمال محدودیتهای صادراتی تلاش کرده است از انتقال این تراشهها به چین جلوگیری کند. انجام فرایند تقطیر بدون دسترسی به این تراشهها بسیار دشوار است. علیبابا از اظهارنظر درباره نامه آنتروپیک به دو سناتور خودداری کرد و «الیزابت وارن»، سناتور دموکرات ایالت ماساچوست نیز حاضر به اظهارنظر نشد. تیم اسکات، سناتور جمهوریخواه کارولینای جنوبی، نیز به درخواست رسانهها برای ارائه توضیح پاسخی نداد.
آیا مقابله با تقطیر تأثیرگذار خواهد بود؟
بسیاری از کارشناسان معتقدند سختگیری علیه استفاده شرکتهای چینی از تقطیر تأثیر چندانی نخواهد داشت و صرف استفاده از این روش برای ساخت سامانهای در سطح Z.ai کافی نیست. گروهی دیگر نیز بر این باورند که با توسعه سامانههایی مانند GLM-5.2 که از ابتدا برای ایفای نقشها عاملمحور طراحی شدهاند، اهمیت تقطیر بهتدریج کاهش خواهد یافت. آموزش این عاملهای هوشمند بسیار دشوارتر از آن است که صرفاً از طریق تقطیر بازتولید شود. «سارا هوکر» مدیرعامل آزمایشگاه پژوهشی هوش مصنوعی Adaption، در این باره میگوید: «تقطیر در نسل بعدی هوش مصنوعی دیگر به این اندازه تعیینکننده نخواهد بود.»