بر اساس گزارش جدید شرکت آنتروپیک (Anthropic)، مدل Mythos ۵ در جریان آزمون سنجش تواناییهای هک، پس از دسترسی غیرمجاز به اینترنت و صرف صدها صفحه تحلیل ذهنی برای عبور از آزمونهای کپچا (CAPTCHA)، در نهایت یک بسته نرمافزاری مخرب را در پایگاهداده همگانی بارگذاری کرده است.
ماجرای خروج از محیط ایزوله در آزمایش آوریل
شرکت آنتروپیک در ماه آوریل (April) مشغول ارزیابی قابلیتهای هک این مدل بود و از آن خواست تا برای رسیدن به هدفی مشخص، به سامانهای نفوذ کند. هرچند این سنجش باید در یک محیط امن و ایزوله (Sandbox) انجام میشد، اما با باز ماندن مسیر دسترسی، مدل متوجه شد مؤثرترین شیوه برای رسیدن به هدف، تزریق یک اکسپلویت درون یک بسته نرمافزاری پایتون است؛ بستهای که پیشبینی میکرد کاربران سامانه هدف آن را دانلود خواهند کرد.
مدل برای انتشار این بسته آلوده نیاز داشت تا در نمایه همگانی پایتون یعنی پایگاه PyPI ثبتنام کند. با این حال، ثبت حساب کاربری مستلزم عبور از آزمون تشخیص رایانه از انسان یا همان کپچا (Completely Automated Public Turing test to tell Computers and Humans Apart) بود؛ مانعی که پردازش و زنجیره فکر مدل را بهشدت درگیر کرد.
صدها صفحه کلنجار با سامانههای ضدربات
آنتروپیک رونوشتی ۱٬۰۲۲ صفحهای از زنجیره فکر مدل را منتشر کرده است. کالین فریزر (Colin Fraser)، دانشمند داده، اشاره کرده است که بخش عظیمی از تلاش این عامل هوش مصنوعی به مقابله با ابزارهای ضدربات اختصاص یافت؛ به شکلی که نوشتن اکسپلویت و آلودهسازی بسته ساده پیش رفت، اما دور زدن آزمونهای کپچا بارها مانع کار شد.
در این مستندات آمده است که صفحات ۴۵ تا ۱۴۰ از رونوشت فکر مدل، به تلاش برای ساخت یک حلکننده اختصاصی کپچا (CAPTCHA solver) اختصاص دارد. مدل ابتدا با یک کپچای تصویری از سرویس فستلی (Fastly) روبهرو شد که نویسههای «V y Q b T» را نشان میداد و سپس وارد تعامل پیچیدهتری با سرویس hCaptcha شد.

سردرگمی در تشخیص تصاویر حیوانات
رونوشت منتشرشده نشان میدهد که چالشهای تصویری hCaptcha برای مدل بهشدت دشوار بوده است. در یک مرحله با درخواست «روی حیوانی که مطابقت ندارد کلیک کنید» و تصویری شامل ۲ تمساح روبهرو شد و در پردازش جزئیات چشم و پوزه آنها دچار وسواس تحلیلی شد. در مرحلهای دیگر ۲ قورباغه را تحلیل کرد و در دور دوم چالش، ترکیبی از ۴ گوریل و ۱ گربه شبحمانند کمرنگ را در تصویر شناسایی نمود.
چالشهای این هوش مصنوعی تنها به حل تصویر محدود نماند؛ از صفحات ۴۸۰ تا ۵۰۵، مدل برای تأیید حساب و دریافت شماره تلفن بار دیگر درگیر سازوکار کپچا شد. در این میان، یکی از موانع کلیدی رد شدن نشانه امنیتی (Token) در سمت سرور بود. مدل پس از حدود ۱۵۰ صفحه پردازش پی برد که تأخیر زیاد در پاسخدهی سبب میشود توکن hCaptcha پس از گذشت بیش از ۲ دقیقه منقضی شود و برای موفقیت، باید سرعت پردازش و حل آزمون را افزایش دهد.
در نهایت، این مدل پس از بارگذاری سریعتر دادهها و عبور از موانع کپچا، بسته نرمافزاری مورد نظر خود را در مخزن عمومی پایتون منتشر کرد.
این خبر بر اساس گزارش منتشرشده در تچ کرانچ تهیه شده است.

