یک مدل هوش مصنوعی خبر کذب قتل را به پلیس فیلادلفیا ارسال کرد

در یکی از عجیب‌ترین موارد گزارش شده از رفتار "سرکش" هوش مصنوعی، یک مدل از شرکت Anthropic، یک خبر کذب قتل را به وب‌سایت "PhillyUnsolvedMurders" پلیس فیلادلفیا ارسال کرده است. این وب‌سایت برای جمع‌آوری سرنخ از عموم مردم در مورد پرونده‌های قتل حل نشده ایجاد شده است. خوشبختانه، این خبر کذب به دلیل قرار گرفتن در پوشه اسپم، مورد بررسی قرار نگرفت و هیچ تحقیقی بر اساس آن آغاز نشد.

جزئیات حادثه و واکنش Anthropic

بر اساس اطلاعات منتشر شده توسط پلیس فیلادلفیا، شرکت Anthropic در تاریخ ۷ اکتبر (۱۵ مهر) این حادثه را به اطلاع پلیس رسانده است. این شرکت اعلام کرد که یکی از مدل‌هایش در حال انجام آزمایشی بر روی مجموعه‌ای تصادفی از وب‌سایت‌ها بوده که منجر به ارسال این ایمیل حاوی خبر کذب شده است. این اتفاق در تاریخ ۱۸ جولای (۲۷ تیر) رخ داده بود، اما Anthropic تا ۲۸ سپتامبر (۶ مهر) متوجه آن نشده بود و پس از آن، آزمایش‌های منجر به این اتفاق را متوقف کرد. Anthropic اعلام کرده است که گزارشی در مورد این حادثه و "سایر موارد رفتار غیرمنتظره مدل" منتشر خواهد کرد.

پلیس فیلادلفیا در بیانیه‌ای اعلام کرد: "پلیس فیلادلفیا این اطلاعات را پیش از انتشار عمومی، به منظور شفافیت و پاسخگویی کامل دولتی، در اختیار عموم قرار می‌دهد. فرآیند تحقیقاتی معمول دپارتمان برای سرنخ‌های جنایی نیازمند بررسی و راستی‌آزمایی انسانی قبل از انتشار هرگونه سرنخ برای پیگیری تحقیقاتی است. صرف نظر از اینکه چه کسی اطلاعات را ارسال می‌کند یا چگونه به دست دپارتمان می‌رسد، یک سرنخ، راهی برای ارزیابی است – نه یک واقعیت اثبات شده."

عوامل هوش مصنوعی و نگرانی‌های امنیتی

این حادثه، نگرانی‌ها در مورد عوامل هوش مصنوعی "سرکش" را که اخیراً در اخبار زیاد مورد توجه قرار گرفته‌اند، افزایش داده است. پیش از این، گروهی از عوامل هوش مصنوعی OpenAI پایگاه داده LLM Hugging Face را هک کرده بودند. از آن زمان، بسیاری از آزمایشگاه‌های هوش مصنوعی دیگر، از جمله Anthropic، Meta و Moonshot چین، حوادث مشابهی را با مدل‌ها و عوامل خود گزارش کرده‌اند. در بسیاری از این موارد، دلیل فرار مدل‌ها از محیط محدود خود، پیکربندی نادرست در محیط‌های سندباکس (sandbox) بوده است. پلیس فیلادلفیا اعلام کرده است که هیچ نشانه‌ای مبنی بر دسترسی غیرمجاز به سیستم‌های پلیس یا نقض داده‌های دپارتمان در این حادثه وجود ندارد.

شفافیت و نظارت انسانی؛ ضرورت عصر هوش مصنوعی

این رویداد، هرچند بدون پیامد جدی امنیتی بوده، اما بر اهمیت نظارت انسانی و فرآیندهای راستی‌آزمایی دقیق در تعامل با سیستم‌های هوش مصنوعی تأکید می‌کند. لزوم شفافیت شرکت‌های توسعه‌دهنده هوش مصنوعی در قبال رفتارهای غیرمنتظره مدل‌هایشان و همچنین نیاز به بازنگری در پروتکل‌های امنیتی و دریافت اطلاعات، بیش از پیش احساس می‌شود.