چگونه محدودیتهای هوش مصنوعی کار محققان امنیت سایبری تهاجمی را مختل میکند
محققان امنیت سایبری تهاجمی که به دنبال آسیبپذیریهای ناشناخته میگردند، میگویند محدودیتهای هوش مصنوعی شرکتهای OpenAI و Anthropic کار مشروع آنها را به شدت مختل میکند. با وجود اینکه هدف این پژوهشگران تقویت امنیت دیجیتال است، بسیاری از درخواستهایشان توسط سیستمهای ایمنی هوش مصنوعی مسدود میشود.
محققان امنیت سایبری تهاجمی، یعنی کسانی که به طور فعال به دنبال آسیبپذیریهای ناشناخته میگردند و ابزارهایی برای بهرهبرداری از آنها توسعه میدهند، به طور فزایندهای از وضعیت کمکهای هوش مصنوعی ناامید شدهاند. بر اساس مصاحبههای TechCrunch با چندین محقق، محدودیتهای ایمنی تعبیهشده در مدلهای هوش مصنوعی OpenAI و Anthropic به مانعی جدی در کار روزانه آنها تبدیل شده است. درخواستهای مربوط به تحقیق در مورد آسیبپذیریها، توسعه اکسپلویت و تست نفوذ به طور معمول توسط این سیستمها شناسایی و مسدود میشوند.
مشکل اصلی این است که مدلهای هوش مصنوعی در تمایز بین یک محقق امنیتی مشروع و یک عامل مخرب دچار مشکل هستند. زبان و مفاهیم مورد استفاده صرفنظر از نیت، تقریباً یکسان هستند. این بدان معناست که متخصصانی که برای ایمنتر کردن اینترنت تلاش میکنند، گرفتار همان فیلترهایی میشوند که برای متوقف کردن مجرمان سایبری طراحی شدهاند. بسیاری از محققان توصیف میکنند که مجبورند سوالات خود را بارها بازنویسی کنند یا در برخی جنبههای کارشان کاملاً از ابزارهای هوش مصنوعی صرف نظر کنند.
هر دو شرکت Anthropic و OpenAI این مشکل را تایید کرده و اعلام کردهاند که در حال بهبود سیستمهای خود برای خدمت بهتر به کاربران مشروع هستند. با این حال، محققان استدلال میکنند که تغییرات بسیار کند پیش میروند و جایگزینهایی، از جمله مدلهایی با محدودیتهای اخلاقی کمتر، در بخشهایی از جامعه امنیتی به عنوان راهحل جایگزین مورد استفاده قرار میگیرند.
این وضعیت سوال گستردهتری را مطرح میکند که چه کسی واقعاً از محدودیتهای بیش از حد سختگیرانه هوش مصنوعی آسیب میبیند. مجرمان سایبری همیشه راههای جایگزین پیدا میکنند، در حالی که متخصصان جدی امنیتی در کار حیاتی خود که در نهایت به نفع همه است، کند میشوند. کارشناسان خواستار سیستمهای ظریفتری هستند که بتوانند نیت کاربر را تأیید کرده و پاسخها را بر اساس آن تنظیم کنند، بدون اینکه اصول اساسی ایمنی را به خطر بیندازند.