آنتروپیک: کلاد ۲۶ درصد از تحقیقات هوش مصنوعی ما را هدایت می‌کند

در پی افشای اخیر OpenAI مبنی بر هک شدن Hugging Face توسط عوامل هوش مصنوعی این شرکت، آنتروپیک (Anthropic) به عنوان یکی از پیشروان حوزه ایمنی هوش مصنوعی، جزئیات جالبی از رویکردهای خود در این زمینه منتشر کرده است. داریو آمودئی، مدیرعامل آنتروپیک، در یک پست وبلاگی جدید که به تشریح استانداردهای اندازه‌گیری برای کمک به شرکت‌های هوش مصنوعی در ارتباط با سرعت توسعه می‌پردازد، اعلام کرد که هوش مصنوعی کلاد (Claude) هدایت ۲۶ درصد از کل فعالیت‌های تحقیق و توسعه (R&D) این شرکت را بر عهده دارد.

تعریف «هدایت» توسط آنتروپیک

منظور آنتروپیک از «هدایت» این است که هوش مصنوعی «قادر است اکثر وظایف را به صورت سرتاسری از یک پرامپت سطح بالا تکمیل کند، در حالی که یک انسان بر آن نظارت دارد». این معیار، با توجه به ماهیت پیچیده تحقیقات هوش مصنوعی، آماری قابل توجه محسوب می‌شود. این شرکت همچنین ادعا می‌کند که هوش مصنوعی در حال حاضر حداقل «بخش‌های بزرگی از کار را تحت هدایت دقیق انسان» در بیش از ۹۰ درصد تحقیقات خود انجام می‌دهد که شامل آن ۲۶ درصد تحت هدایت کلود نیز می‌شود. این بدان معناست که کلود بخش عمده‌ای از کارهایی را که کارمندان آنتروپیک انجام می‌دهند، تحت تأثیر قرار می‌دهد، حتی اگر این شرکت تأکید کند که چت‌بات «به طور کامل خودمختار در هیچ زیرمجموعه اندازه‌گیری شده‌ای از کار تحقیق و توسعه هوش مصنوعی عمل نمی‌کند».

معیارهای پیشنهادی آنتروپیک برای سنجش سرعت توسعه هوش مصنوعی

آنتروپیک این آمار را از طریق اولین معیار پیشنهادی خود که بر «تحقیق و توسعه هوش مصنوعی هدایت‌شده توسط هوش مصنوعی» متمرکز است، به دست آورده است. با استفاده از شاخصی از میزان تحقیق و توسعه هوش مصنوعی که توسط کلود انجام می‌شود و مقیاس درجه‌بندی اتوماسیون توسعه‌یافته توسط Epoch AI، آنتروپیک توانسته نموداری را ترسیم کند که «سطح اتوماسیون» کلود را از اوت ۲۰۲۵ نشان می‌دهد. این شرکت معتقد است که هر سازنده مدل‌های پیشرفته هوش مصنوعی می‌تواند با داده‌های خود و اعتبارسنجی شخص ثالث، این فرآیند را بازتولید کند.

شفافیت و نگرانی‌های ایمنی

این شرکت همچنین روش‌هایی را برای اندازه‌گیری نظارت بر عوامل هوش مصنوعی (میزان فعالیت عوامل نظارت‌شده، زمان بررسی و تعداد دفعات پرچم‌گذاری رفتار عامل) و ردیابی میزان محاسبات اختصاص‌یافته به تحقیق و توسعه هوش مصنوعی به عنوان راه‌های دیگری برای اطمینان از سرعت مناسب توسعه پیشنهاد کرده است. هدف این است که شفافیت بیشتر، پاسخگویی به توسعه خارج از کنترل هوش مصنوعی یا حداقل ارائه دیدگاهی روشن‌تر به عموم را آسان‌تر کند.

تاکنون، مشکل اصلی توافق شرکت‌ها بر سر ایده کند کردن سرعت توسعه هوش مصنوعی نیست. OpenAI در این زمینه سکوت کرده و آنتروپیک متعهد شده است که به ارزیابان شخص ثالث اجازه دهد شیوه‌های توسعه خود را بررسی کنند. موضع آمودئی در مورد ایمنی هوش مصنوعی حتی باعث توافق ایلان ماسک در X شد. اینکه آیا صنعت هوش مصنوعی با چیزی فراتر از خودتنظیمی روبرو خواهد شد یا خیر، بسیار نامشخص است؛ دونالد ترامپ، رئیس‌جمهور سابق، تا حد زیادی خطرات هوش مصنوعی را کم‌اهمیت جلوه داده است.

ابعاد تحقیق و توسعه در آنتروپیک

  • هوش مصنوعی هدایت‌کننده تحقیق و توسعه: ۲۶ درصد از کل فعالیت‌ها
  • کارهای تحت هدایت انسان با کمک هوش مصنوعی: بیش از ۹۰ درصد
  • عملکرد خودمختار کلود: در حال حاضر هیچ زیرمجموعه اندازه‌گیری شده‌ای به طور کامل خودمختار نیست.
  • هدف از معیارهای جدید: افزایش شفافیت و امکان واکنش به توسعه خارج از کنترل هوش مصنوعی.