خرید اقساطی از سایت کارت با کمترین پیش پرداخت

تلاش برای مهندسی معکوس جمینای؛ وقتی رقابت به «سرقت هوشمند» نزدیک می‌شود


avatar
زهرا حسینی
25 بهمن 1404 | 4 دقیقه مطالعه

گزارش‌های تازه نشان می‌دهد چت‌بات هوش مصنوعی پیشرفته‌ی Google Gemini  هدف موجی از حملات سازمان‌یافته قرار گرفته است؛ حملاتی که انگیزه‌ای صرفاً فنی نداشته و بیشتر با اهداف تجاری دنبال شده‌اند. به گفته گوگل، مهاجمان با ارسال ده‌ها هزار درخواست متنوع—در برخی موارد بیش از ۱۰۰ هزار پرامپت—تلاش کرده‌اند الگوهای رفتاری، ساختار پاسخ‌دهی و منطق درونی این مدل را شناسایی و بازسازی کنند.

این شیوه که گوگل آن را «حملات تقطیری» یا distillation attacks می‌نامد، بر مبنای استخراج دانش از خروجی‌های یک مدل پیشرفته برای آموزش یا تقویت مدلی دیگر انجام می‌شود. در واقع، مهاجمان بدون دسترسی مستقیم به کد یا داده‌های آموزشی، سعی می‌کنند از طریق تحلیل پاسخ‌ها، معماری و توانمندی‌های سیستم را مهندسی معکوس کنند. گوگل این اقدام را مصداقی از نقض مالکیت فکری و تلاشی برای بهره‌برداری غیرمجاز از سرمایه‌گذاری‌های عظیم خود در حوزه هوش مصنوعی می‌داند.

بر اساس اعلام Google، بخش قابل توجهی از این فعالیت‌ها توسط شرکت‌های خصوصی و برخی پژوهشگران از کشورهای مختلف انجام شده است، هرچند جزئیات دقیقی از هویت عاملان منتشر نشده است. «جان هولتکویست»، تحلیلگر ارشد گروه اطلاعات تهدیدات گوگل، هشدار داده که گستردگی این حملات نشان می‌دهد چنین رویکردهایی به‌زودی علیه مدل‌های سفارشی و کوچک‌تر نیز به کار گرفته خواهد شد. به بیان دیگر، آنچه امروز متوجه جمینای است، فردا می‌تواند دامنگیر استارتاپ‌ها و شرکت‌های نوپا شود.

به‌نظر می‌رسد با رشد انفجاری هوش مصنوعی، رقابت در این حوزه وارد مرحله‌ای تازه شده است؛ مرحله‌ای که مرز میان «الهام گرفتن» و «کپی‌برداری هدفمند» باریک‌تر از همیشه شده است. از یک سو، distillation  بخشی از فرآیند علمی توسعه مدل‌ها محسوب می‌شود، اما زمانی که با مقیاس صنعتی و نیت تجاری برای استخراج دانش پنهان انجام شود، به چالشی جدی در حوزه مالکیت فکری بدل خواهد شد. به اعتقاد من، آینده این رقابت نه‌تنها به قدرت فنی مدل‌ها، بلکه به توانایی شرکت‌ها در حفاظت از دارایی‌های الگوریتمی‌شان وابسته است؛ عرصه‌ای که احتمالاً به یکی از مهم‌ترین میدان‌های حقوقی و امنیتی دنیای فناوری تبدیل خواهد شد.

نبرد بر سر «منطق پنهان»؛ جمینای و چالش استخراج هوش مصنوعی

در موج تازه حملات علیه Google Gemini، تمرکز مهاجمان صرفاً بر دریافت پاسخ‌های عادی نبوده، بلکه آن‌ها تلاش کرده‌اند به لایه‌های عمیق‌تر این مدل نفوذ کنند؛ لایه‌هایی که به الگوریتم‌های تصمیم‌گیری و سازوکار پردازش اطلاعات مربوط می‌شود. هدف اصلی، آشکارسازی توانایی «استدلال» یا reasoning این سامانه بوده است؛ یعنی همان بخشی که جمینای را از یک پاسخ‌دهنده ساده به یک مدل تحلیلی پیشرفته تبدیل می‌کند.

با وجود آنکه  Google اعلام کرده ابزارهایی برای شناسایی و مهار حملات موسوم به distillation در اختیار دارد، این شرکت اذعان کرده که ماهیت مدل‌های زبانی بزرگ آن‌ها را همواره در معرض خطر قرار می‌دهد. دسترسی عمومی کاربران به این سیستم‌ها، اگرچه مزیتی برای توسعه و گسترش فناوری محسوب می‌شود، اما هم‌زمان می‌تواند بستری برای استخراج تدریجی دانش درونی مدل‌ها باشد.

پیش از این نیز OpenAI، خالق ChatGPT، شرکت چینی DeepSeek  را به تلاش برای بهره‌گیری از خروجی‌های مدل‌هایش جهت تقویت سامانه‌های خود متهم کرده بود؛ موضوعی که نشان می‌دهد رقابت در عرصه هوش مصنوعی به‌تدریج رنگ‌وبوی امنیتی و حقوقی پررنگ‌تری به خود گرفته است.

«جان هولتکویست» هشدار داده هرچه شرکت‌ها مدل‌های اختصاصی خود را با داده‌های محرمانه‌تر آموزش دهند، ریسک آسیب‌پذیری افزایش می‌یابد. به‌عنوان مثال، اگر یک سازمان مالی، مدل زبانی خود را با دهه‌ها داده محرمانه درباره استراتژی‌های معامله‌گری تغذیه کرده باشد، بخشی از این دانش ممکن است—دست‌کم به‌صورت نظری—از طریق تحلیل دقیق پاسخ‌ها قابل استخراج باشد. این موضوع می‌تواند پیامدهایی جدی برای امنیت اطلاعات و مزیت رقابتی شرکت‌ها داشته باشد.

در نهایت، آنچه امروز برای جمینای رخ داده، صرفاً یک چالش انحصاری برای گوگل نیست؛ بلکه نشانه‌ای از مرحله تازه‌ای در تکامل صنعت هوش مصنوعی است. مرحله‌ای که در آن، حفاظت از «دانش مدل» به اندازه توسعه آن اهمیت یافته است.

صنعت هوش مصنوعی اکنون وارد دوران حساسی شده است؛ دورانی که ارزش واقعی نه در رابط کاربری یا سرعت پاسخ، بلکه در «منطق درونی مدل‌ها» نهفته است. هرچه مدل‌ها پیچیده‌تر و داده‌های آموزشی آن‌ها خاص‌تر شود، انگیزه برای استخراج و کپی‌برداری نیز افزایش می‌یابد. به نظر می‌رسد در سال‌های آینده، سرمایه‌گذاری روی امنیت مدل‌های زبانی و چارچوب‌های حقوقی مرتبط با مالکیت الگوریتمی، به یکی از اولویت‌های اصلی شرکت‌های فناوری تبدیل خواهد شد؛ چراکه رقابت آینده، رقابت بر سر خودِ هوش خواهد بود، نه صرفاً محصول نهایی.