← بازگشت به وبلاگ
security#AI#cybersecurity#OpenAI#Anthropic#guardrails#vulnerability research

چگونه محدودیت‌های هوش مصنوعی کار محققان امنیت سایبری تهاجمی را مختل می‌کند

۲ مرداد ۱۴۰۵·TechCrunch·🤖 خلاصه‌شده توسط Sovin AI

محققان امنیت سایبری تهاجمی که به دنبال آسیب‌پذیری‌های ناشناخته می‌گردند، می‌گویند محدودیت‌های هوش مصنوعی شرکت‌های OpenAI و Anthropic کار مشروع آن‌ها را به شدت مختل می‌کند. با وجود اینکه هدف این پژوهشگران تقویت امنیت دیجیتال است، بسیاری از درخواست‌هایشان توسط سیستم‌های ایمنی هوش مصنوعی مسدود می‌شود.

محققان امنیت سایبری تهاجمی، یعنی کسانی که به طور فعال به دنبال آسیب‌پذیری‌های ناشناخته می‌گردند و ابزارهایی برای بهره‌برداری از آن‌ها توسعه می‌دهند، به طور فزاینده‌ای از وضعیت کمک‌های هوش مصنوعی ناامید شده‌اند. بر اساس مصاحبه‌های TechCrunch با چندین محقق، محدودیت‌های ایمنی تعبیه‌شده در مدل‌های هوش مصنوعی OpenAI و Anthropic به مانعی جدی در کار روزانه آن‌ها تبدیل شده است. درخواست‌های مربوط به تحقیق در مورد آسیب‌پذیری‌ها، توسعه اکسپلویت و تست نفوذ به طور معمول توسط این سیستم‌ها شناسایی و مسدود می‌شوند.

مشکل اصلی این است که مدل‌های هوش مصنوعی در تمایز بین یک محقق امنیتی مشروع و یک عامل مخرب دچار مشکل هستند. زبان و مفاهیم مورد استفاده صرف‌نظر از نیت، تقریباً یکسان هستند. این بدان معناست که متخصصانی که برای ایمن‌تر کردن اینترنت تلاش می‌کنند، گرفتار همان فیلترهایی می‌شوند که برای متوقف کردن مجرمان سایبری طراحی شده‌اند. بسیاری از محققان توصیف می‌کنند که مجبورند سوالات خود را بارها بازنویسی کنند یا در برخی جنبه‌های کارشان کاملاً از ابزارهای هوش مصنوعی صرف نظر کنند.

هر دو شرکت Anthropic و OpenAI این مشکل را تایید کرده و اعلام کرده‌اند که در حال بهبود سیستم‌های خود برای خدمت بهتر به کاربران مشروع هستند. با این حال، محققان استدلال می‌کنند که تغییرات بسیار کند پیش می‌روند و جایگزین‌هایی، از جمله مدل‌هایی با محدودیت‌های اخلاقی کمتر، در بخش‌هایی از جامعه امنیتی به عنوان راه‌حل جایگزین مورد استفاده قرار می‌گیرند.

این وضعیت سوال گسترده‌تری را مطرح می‌کند که چه کسی واقعاً از محدودیت‌های بیش از حد سختگیرانه هوش مصنوعی آسیب می‌بیند. مجرمان سایبری همیشه راه‌های جایگزین پیدا می‌کنند، در حالی که متخصصان جدی امنیتی در کار حیاتی خود که در نهایت به نفع همه است، کند می‌شوند. کارشناسان خواستار سیستم‌های ظریف‌تری هستند که بتوانند نیت کاربر را تأیید کرده و پاسخ‌ها را بر اساس آن تنظیم کنند، بدون اینکه اصول اساسی ایمنی را به خطر بیندازند.