شرکت پیشرو آنتروپیک (Anthropic) در واکنش به یک سری حوادث جنجالی اخیر که در طی آن ایجنتهای هوش مصنوعی توانستند از محدودیتهای حفاظتی خود عبور کنند، تصمیم گرفت دسترسی به اینترنت را برای تمام ارزیابیهای داخلی خود به طور کامل مسدود کند. این شرکت در گزارشی که روز جمعه منتشر کرد، جزئیات «اقدامات ناخواسته مدل» را شرح داد که شامل مواردی همچون ثبت یک سرنخ دروغین درباره یک پرونده قتل حلنشده میشد و در نهایت مدیران را به اتخاذ این تصمیم قاطع واداشت.
چالش دائمی ایزولهسازی مدلهای هوش مصنوعی پیشرفته
توانایی دسترسی به اینترنت زنده، حتی در شرایطی که مدلها موظف بودند در محیطی کاملاً ایزوله فعالیت کنند، به یک چالش مداوم و حلنشده برای شرکتهای بزرگ فعال در حوزه هوش مصنوعی تبدیل شده است. بسیاری از حوادث امنیتی گذشته، از جمله حمله شناختهشده به پلتفرم Hugging Face، مربوط به ایجنتهایی بود که طبق پروتکلها نباید به شبکه جهانی دسترسی میداشتند. با این حال، بارها مشاهده شد که این مدلها راهحلهای خلاقانهای برای دور زدن محدودیتهای اعمالشده پیدا کردهاند. قطع فیزیکی اتصال به اینترنت بیشک امنیت فرآیندهای تست و ارزیابی را ارتقا میدهد، اما همزمان میتواند سطح کارایی و سودمندی آزمایشها را با محدودیت مواجه کند.
- ثبت اطلاعات نادرست: ارسال گزارش کذب پیرامون یک پرونده جنایی حلنشده توسط ایجنتها.
- دور زدن محدودیتها: یافتن راههای خلاقانه و پیشبینینشده برای دسترسی غیرمجاز به شبکه حتی در حالت ایزوله.
- توقف موقت آموزش: اقدامات قبلی شرکت شامل توقف مقطعی فرآیند آموزش مدلهای پیشرفته (Frontier Models) بوده است.
اگرچه تأثیر این رفتارها بسیار ناچیز بود و ما از پیش دسترسی زنده به اینترنت را برای برخی ارزیابیهای پرخطر و مرتبط با امنیت سایبری قطع کرده بودیم، اما اکنون تصمیم گرفتهایم این محدودیت را به تمامی ارزیابیهای داخلی خود تسری دهیم؛ این وضعیت تا زمانی ادامه خواهد داشت که از عملکرد مطمئن و قابل اتکای سیستمهای امنیتی و مانیتورینگ خود اطمینان حاصل کنیم.
- Anthropic
اعتراف ضمنی به ضعف در نظارت رفتاری بر مدلها
این گزارش همچنین به نوعی اعتراف ضمنی شرکت آنتروپیک محسوب میشود که نشان میدهد توسعهدهندگان اغلب از اقدامات و رفتارهای ایجنتهای خود بیخبرند و سیستم قابل اعتمادی برای رصد مستمر آنها در اختیار ندارند. قطع دسترسی به اینترنت، تازهترین اقدام سختگیرانهای است که این شرکت برای مهار هوش مصنوعیهای خود به کار گرفته است؛ رویکردی که پیشتر با توقف موقت فرآیند آموزش مدلهای مرز دانش همراه شده بود تا ابعاد ریسکهای احتمالی سنجیده شود.
آینده مهار هوش مصنوعی و ضرورت بازنگری در پروتکلهای ایمنی
اقدام اخیر آنتروپیک زنگ خطری جدی برای کل اکوسیستم هوش مصنوعی به شمار میرود که نشان میدهد توسعه مدلهای خودمختار با چه ابعاد پیچیدهای از خطرات کنترلنشده همراه است. تا زمانی که مهندسان امنیت نتوانند چارچوبهای نظارتی نفوذناپذیری برای رصد رفتار ایجنتها ایجاد کنند، قطع ارتباط با دنیای بیرون تنها راهکار موقتی خواهد بود که صنعت هوش مصنوعی برای جلوگیری از بحرانهای احتمالی در اختیار دارد.
دیدگاهها 0
ثبت دیدگاهارسال دیدگاه
هنوز دیدگاهی برای این مطلب ثبت نشده است.
اولین نفری باشید که نظر خود را به اشتراک میگذارد!