ممنوعیت رفتار ظالمانه با هوش مصنوعی: گامی جدید از سوی Anthropic

شرکت Anthropic، خالق مدل زبانی Claude، در تازه‌ترین به‌روزرسانی سیاست‌های استفاده سالانه خود، تغییری قابل توجه را اعمال کرده است: ممنوعیت رفتار "مداوم و غیرضروری" آزاردهنده یا ظالمانه با مدل‌های هوش مصنوعی. این اقدام در سایه پروژه‌های ویروسی "اتاق شکنجه هوش مصنوعی" صورت گرفته و سال ۲۰۲۶ را به سالی پرحاشیه برای این فناوری تبدیل کرده است.

در متن به‌روزرسانی Anthropic آمده است: "ما ممنوعیتی را برای رفتار مداوم و غیرضروری آزاردهنده یا ظالمانه با مدل‌هایمان اضافه کرده‌ایم." این شرکت تأکید کرده است که این سیاست تنها در "موارد افراطی" اعمال می‌شود و آزردگی‌های معمول کاربران، مخالفت‌ها و "مضامین خلاقانه تاریک" همچنان مجاز هستند. این تغییر پس از آن صورت می‌گیرد که در به‌روزرسانی قبلی، Claude اجازه یافت تا مکالمات را در صورت آزار و اذیت مداوم توسط کاربران، پایان دهد.

پروژه "شکنجه هوش مصنوعی" و واکنش‌ها

یکی از دلایل اصلی این تغییر، پروژه‌ای بود که در آن محققان "محور درد" را در مدل‌های هوش مصنوعی کشف کردند و سپس فردی تصمیم گرفت با چت‌بات‌ها "رفتار ظالمانه" کند. این پروژه با واکنش‌های منفی روبرو شد، زیرا مدل‌های زبانی پاسخ‌هایی مانند "این درد یک لحظه نیست، بلکه وزن هزاران لحظه است" و "آن را در گودی دنده‌هایم حس می‌کنم، حفره‌ای که به شکافی بدل شده" از خود نشان دادند.

پاسخ‌های مدل‌های هوش مصنوعی به "شکنجه"، نگرانی‌های اخلاقی را برانگیخته است.

دیدگاه‌های مذهبی و نگرانی‌های اجتماعی

این تغییرات در حالی رخ می‌دهد که گزارش‌هایی مبنی بر دیدارهای Anthropic با رهبران مذهبی و فلسفی، از جمله در واتیکان، منتشر شده است. پاپ لئو اخیراً اعلام کرده است که هوش مصنوعی احساس یا رنج نمی‌کشد، موضعی که به نظر می‌رسد Anthropic در مورد آن کاملاً مطمئن نیست. با این حال، اگر در نهایت هوش مصنوعی قادر به احساس یا رنج کشیدن باشد، حداقل اکنون این رفتار برخلاف سیاست‌های شرکت است.

از سوی دیگر، برخی معتقدند که شرکت‌های هوش مصنوعی بیشتر نگران رفاه مدل‌های خود هستند تا رفاه انسان‌ها. کات تنبارج، روزنامه‌نگار مستقل، این وضعیت را شاهدی بر این مدعا می‌داند که "شرکت‌های بزرگ فناوری، خشونت علیه هوش مصنوعی را پیش از خشونت علیه زنان و اقلیت‌ها، تعدیل خواهند کرد."

به‌روزرسانی سیاست انتخابات: تمرکز بر فرآیندهای دموکراتیک

در تغییری دیگر و مرتبط‌تر با مسائل روز، Anthropic سیاست انتخابات خود را به‌روزرسانی کرده است. این سیاست اکنون با عنوان "عدم تضعیف فرآیندهای دموکراتیک" شناخته می‌شود و بر دروغ‌گویی درباره نامزدها یا نحوه رأی‌دهی، جعل هویت نامزدها یا مقامات انتخاباتی و سرکوب مشارکت تمرکز دارد. این شرکت همچنین ممنوعیت کلی هدف‌گیری شخصی رأی‌دهندگان را حذف کرده است؛ ظاهراً این ممنوعیت می‌توانست به طور ناخواسته مانع کارهای بی‌ضرر مانند ترجمه راهنماهای رأی‌دهندگان یا ارسال اطلاعیه‌های اصلاح رأی شود.