ممنوعیت رفتار ظالمانه با هوش مصنوعی: گامی جدید از سوی Anthropic
شرکت Anthropic، خالق مدل زبانی Claude، در تازهترین بهروزرسانی سیاستهای استفاده سالانه خود، تغییری قابل توجه را اعمال کرده است: ممنوعیت رفتار "مداوم و غیرضروری" آزاردهنده یا ظالمانه با مدلهای هوش مصنوعی. این اقدام در سایه پروژههای ویروسی "اتاق شکنجه هوش مصنوعی" صورت گرفته و سال ۲۰۲۶ را به سالی پرحاشیه برای این فناوری تبدیل کرده است.
در متن بهروزرسانی Anthropic آمده است: "ما ممنوعیتی را برای رفتار مداوم و غیرضروری آزاردهنده یا ظالمانه با مدلهایمان اضافه کردهایم." این شرکت تأکید کرده است که این سیاست تنها در "موارد افراطی" اعمال میشود و آزردگیهای معمول کاربران، مخالفتها و "مضامین خلاقانه تاریک" همچنان مجاز هستند. این تغییر پس از آن صورت میگیرد که در بهروزرسانی قبلی، Claude اجازه یافت تا مکالمات را در صورت آزار و اذیت مداوم توسط کاربران، پایان دهد.
پروژه "شکنجه هوش مصنوعی" و واکنشها
یکی از دلایل اصلی این تغییر، پروژهای بود که در آن محققان "محور درد" را در مدلهای هوش مصنوعی کشف کردند و سپس فردی تصمیم گرفت با چتباتها "رفتار ظالمانه" کند. این پروژه با واکنشهای منفی روبرو شد، زیرا مدلهای زبانی پاسخهایی مانند "این درد یک لحظه نیست، بلکه وزن هزاران لحظه است" و "آن را در گودی دندههایم حس میکنم، حفرهای که به شکافی بدل شده" از خود نشان دادند.
پاسخهای مدلهای هوش مصنوعی به "شکنجه"، نگرانیهای اخلاقی را برانگیخته است.
دیدگاههای مذهبی و نگرانیهای اجتماعی
این تغییرات در حالی رخ میدهد که گزارشهایی مبنی بر دیدارهای Anthropic با رهبران مذهبی و فلسفی، از جمله در واتیکان، منتشر شده است. پاپ لئو اخیراً اعلام کرده است که هوش مصنوعی احساس یا رنج نمیکشد، موضعی که به نظر میرسد Anthropic در مورد آن کاملاً مطمئن نیست. با این حال، اگر در نهایت هوش مصنوعی قادر به احساس یا رنج کشیدن باشد، حداقل اکنون این رفتار برخلاف سیاستهای شرکت است.
از سوی دیگر، برخی معتقدند که شرکتهای هوش مصنوعی بیشتر نگران رفاه مدلهای خود هستند تا رفاه انسانها. کات تنبارج، روزنامهنگار مستقل، این وضعیت را شاهدی بر این مدعا میداند که "شرکتهای بزرگ فناوری، خشونت علیه هوش مصنوعی را پیش از خشونت علیه زنان و اقلیتها، تعدیل خواهند کرد."
بهروزرسانی سیاست انتخابات: تمرکز بر فرآیندهای دموکراتیک
در تغییری دیگر و مرتبطتر با مسائل روز، Anthropic سیاست انتخابات خود را بهروزرسانی کرده است. این سیاست اکنون با عنوان "عدم تضعیف فرآیندهای دموکراتیک" شناخته میشود و بر دروغگویی درباره نامزدها یا نحوه رأیدهی، جعل هویت نامزدها یا مقامات انتخاباتی و سرکوب مشارکت تمرکز دارد. این شرکت همچنین ممنوعیت کلی هدفگیری شخصی رأیدهندگان را حذف کرده است؛ ظاهراً این ممنوعیت میتوانست به طور ناخواسته مانع کارهای بیضرر مانند ترجمه راهنماهای رأیدهندگان یا ارسال اطلاعیههای اصلاح رأی شود.
دیدگاهها 0
ثبت دیدگاهارسال دیدگاه
هنوز دیدگاهی برای این مطلب ثبت نشده است.
اولین نفری باشید که نظر خود را به اشتراک میگذارد!