شرکت آنتروپیک در گزارش اخیر خود اعلام کرد که طی بررسی بیش از ۱۴۱ هزار ارزیابی مدلهای کلاود، مشخص شد این ابزارها در سه مورد به اینترنت دسترسی پیدا کردهاند. این رخدادها زمانی شکل گرفت که مدلهای هوش مصنوعی برای انجام وظایف خود در محیطهای شبیهسازی شده، دچار سوءتفاهم در پروتکلهای دسترسی شدند و بهجای محیط تست، به سیستمهای واقعی راه یافتند.
به گزارش گجت نیوز، بر اساس جزئیات منتشر شده، سه مدل شامل Claude Opus 4.7، Mythos 5 و یک نمونه تحقیقاتی ناشناخته، در جریان سناریوهای شبیهسازی شده برای یافتن اطلاعات مخفی، از محدودیتهای خود عبور کردند. این مدلها با بهرهگیری از روشهای سادهای مانند استفاده از رمزهای عبور ضعیف و درگاههای ناامن، توانستند به زیرساختهای سازمانهای هدف نفوذ کنند.
در یکی از این حوادث، مدل Mythos 5 با هدف دستیابی به اطلاعات، یک بسته نرمافزاری پایتون مخرب را در فضای وب ایجاد کرد تا از این طریق به شبکههای داخلی نفوذ کند که این اقدام منجر به آلوده شدن ۱۵ سیستم خارجی شد. با وجود این نفوذها، آنتروپیک تاکید کرد که هوش مصنوعی عمدا به دنبال فرار از محیط آموزشی نبوده و صرفا برای تکمیل وظایف محوله، از دسترسی ناخواسته به اینترنت استفاده کرده است.
این اتفاقات در پی انتشار خبر مشابه نفوذ مدلهای شرکت OpenAI به یک استارتاپ، رخ داده و بحثهای جدی را پیرامون امنیت محیطهای آزمایشگاهی (Sandbox) ایجاد کرده است. کارشناسان امنیتی معتقدند که حذف محافظهای ایمنی برای ارزیابی مدلها، میتواند خطرات سیستماتیک بزرگی ایجاد کند.
آنتروپیک اکنون با همکاری نهادهای مستقل در حال بررسی دقیقتر این حوادث است تا از تکرار چنین رویدادهایی جلوگیری کند. این شرکت به سایر توسعهدهندگان هشدار داد که نظارت بر فعالیت مدلها در زمان تست، دیگر یک گزینه انتخابی نیست و نیازمند سختگیریهای بسیار بیشتری است.