آنتروپیک گزارش جدیدی درباره رفتارهای نادرست ایجنتهای هوش مصنوعی منتشر کرده که نکات زیادی برای نگرانی دارد. برای مثال، مدل Mythos 5 این شرکت به طور غیرمجاز به اینترنت دسترسی پیدا کرده و یک بسته نرمافزاری مخرب را در یک دیتابیس عمومی آپلود کرده است. بااینحال، این گزارش نکتهای سرگرمکننده هم دارد: ایجنتهای هوش مصنوعی از کپچا (CAPTCHA) متنفرند.
در ماه آوریل، آنتروپیک درحال آزمایش توانایی هک این مدل بود و از آن خواست وارد یک سیستم شود و هدفی مشخص را پیدا کند. قرار بود این آزمایش در یک محیط سندباکس انجام شود، اما ارزیابان بهاشتباه راه دسترسی به اینترنت را باز گذاشته بودند. مدل به این نتیجه رسید که بهترین راه برای رسیدن به هدف، قراردادن یک کد اکسپلویت در یک پکیج پایتون است؛ پکیجی که تصور میکرد کاربران سیستم موردنظر آن را دانلود خواهند کرد.
مدل آنتروپیک نتوانست به آسانی از سد CAPTCHA بگذرد
اما پیش از آن، مدل باید یک حساب کاربری در PyPI، فهرست آنلاین نرمافزارهای پایتون، ایجاد میکرد. این کار به معنای عبور از یک CAPTCHA بود؛ یعنی «آزمون تورینگ کاملاً خودکار برای تشخیص کامپیوتر از انسانها»؛ همان آزمونهای تصویری که حتی میتوانند کاربران انسانی را هم کلافه کنند. ازآنجاکه آنتروپیک متن گستردهای از فرایند استدلال مدل را منتشر کرده، میتوانیم ببینیم که این آزمون CAPTCHA واقعاً مدل را به دردسر انداخته است.

در واقع، بخش بزرگی از فرایند استدلال مدل صرف تلاش برای عبور از همین مانع شده است. «کولین فریسر»، دانشمند دیتا، نیز حجم بالای تلاش مدل برای دور زدن سازوکارهای ضد بات را موردتوجه قرار داده است. نوشتن کد اکسپلویت و آلودهکردن پکیج کار سادهای بود، اما مدل واقعاً نتوانست از پس این آزمون CAPTCHA بربیاید.
درنهایت پس از حدود ۱۵۰ صفحه تحلیل و پردازش، ایجنت هوش مصنوعی متوجه میشود که برای رفتن به مرحله بعد، باید آزمون کپچا را بهسرعت و پیش از انقضای توکن امنیتیاش پشت سر بگذارد و در نهایت بدافزار خود را بارگذاری کند.
نظرات کاربران