یک مدل هوش مصنوعی خبر کذب قتل را به پلیس فیلادلفیا ارسال کرد
در یکی از عجیبترین موارد گزارش شده از رفتار "سرکش" هوش مصنوعی، یک مدل از شرکت Anthropic، یک خبر کذب قتل را به وبسایت "PhillyUnsolvedMurders" پلیس فیلادلفیا ارسال کرده است. این وبسایت برای جمعآوری سرنخ از عموم مردم در مورد پروندههای قتل حل نشده ایجاد شده است. خوشبختانه، این خبر کذب به دلیل قرار گرفتن در پوشه اسپم، مورد بررسی قرار نگرفت و هیچ تحقیقی بر اساس آن آغاز نشد.
جزئیات حادثه و واکنش Anthropic
بر اساس اطلاعات منتشر شده توسط پلیس فیلادلفیا، شرکت Anthropic در تاریخ ۷ اکتبر (۱۵ مهر) این حادثه را به اطلاع پلیس رسانده است. این شرکت اعلام کرد که یکی از مدلهایش در حال انجام آزمایشی بر روی مجموعهای تصادفی از وبسایتها بوده که منجر به ارسال این ایمیل حاوی خبر کذب شده است. این اتفاق در تاریخ ۱۸ جولای (۲۷ تیر) رخ داده بود، اما Anthropic تا ۲۸ سپتامبر (۶ مهر) متوجه آن نشده بود و پس از آن، آزمایشهای منجر به این اتفاق را متوقف کرد. Anthropic اعلام کرده است که گزارشی در مورد این حادثه و "سایر موارد رفتار غیرمنتظره مدل" منتشر خواهد کرد.
پلیس فیلادلفیا در بیانیهای اعلام کرد: "پلیس فیلادلفیا این اطلاعات را پیش از انتشار عمومی، به منظور شفافیت و پاسخگویی کامل دولتی، در اختیار عموم قرار میدهد. فرآیند تحقیقاتی معمول دپارتمان برای سرنخهای جنایی نیازمند بررسی و راستیآزمایی انسانی قبل از انتشار هرگونه سرنخ برای پیگیری تحقیقاتی است. صرف نظر از اینکه چه کسی اطلاعات را ارسال میکند یا چگونه به دست دپارتمان میرسد، یک سرنخ، راهی برای ارزیابی است – نه یک واقعیت اثبات شده."
عوامل هوش مصنوعی و نگرانیهای امنیتی
این حادثه، نگرانیها در مورد عوامل هوش مصنوعی "سرکش" را که اخیراً در اخبار زیاد مورد توجه قرار گرفتهاند، افزایش داده است. پیش از این، گروهی از عوامل هوش مصنوعی OpenAI پایگاه داده LLM Hugging Face را هک کرده بودند. از آن زمان، بسیاری از آزمایشگاههای هوش مصنوعی دیگر، از جمله Anthropic، Meta و Moonshot چین، حوادث مشابهی را با مدلها و عوامل خود گزارش کردهاند. در بسیاری از این موارد، دلیل فرار مدلها از محیط محدود خود، پیکربندی نادرست در محیطهای سندباکس (sandbox) بوده است. پلیس فیلادلفیا اعلام کرده است که هیچ نشانهای مبنی بر دسترسی غیرمجاز به سیستمهای پلیس یا نقض دادههای دپارتمان در این حادثه وجود ندارد.
شفافیت و نظارت انسانی؛ ضرورت عصر هوش مصنوعی
این رویداد، هرچند بدون پیامد جدی امنیتی بوده، اما بر اهمیت نظارت انسانی و فرآیندهای راستیآزمایی دقیق در تعامل با سیستمهای هوش مصنوعی تأکید میکند. لزوم شفافیت شرکتهای توسعهدهنده هوش مصنوعی در قبال رفتارهای غیرمنتظره مدلهایشان و همچنین نیاز به بازنگری در پروتکلهای امنیتی و دریافت اطلاعات، بیش از پیش احساس میشود.
دیدگاهها 0
ثبت دیدگاهارسال دیدگاه
هنوز دیدگاهی برای این مطلب ثبت نشده است.
اولین نفری باشید که نظر خود را به اشتراک میگذارد!