مسابقه نوآوری در هوش مصنوعی: مدل‌های جدید Anthropic و OpenAI

در میان بحث‌های پررنگ درباره لزوم کند کردن سرعت توسعه هوش مصنوعی، شرکت‌های Anthropic و OpenAI با معرفی مدل‌های جدید خود، بار دیگر فعالانه در این عرصه پیشتازی می‌کنند. این دو شرکت، با تکیه بر دستاوردهای قبلی خود، مدل‌های تازه‌ای را عرضه کرده‌اند که نه تنها سطح عملکرد بالاتری را ارائه می‌دهند، بلکه با کاهش هزینه‌ها، دسترسی به فناوری‌های پیشرفته هوش مصنوعی را تسهیل می‌کنند.

Claude Opus 5.5: تمرکز بر تحلیل پیچیده و کدنویسی

Anthropic با مدل جدید Opus 5.5، تمرکز خود را بر بهبود قابلیت‌های پردازش وظایف پیچیده گذاشته است. این مدل در زمینه‌هایی مانند "یافتن و رفع ناکارآمدی‌ها در نرم‌افزار"، تحلیل‌های مالی و کارهای تجاری، عملکردی چشمگیر از خود نشان می‌دهد و به طور خاص مشتریان سازمانی را هدف قرار داده است. علاوه بر این، بنچمارک‌های Anthropic ادعا می‌کنند که Opus 5.5 در کدنویسی عاملی (agentic coding) نسبت به GPT-6 Astra در هر دو معیار Terminal-Bench 4.0 و FrontierCode v1.1 (Main) امتیاز بالاتری کسب کرده است که این امر می‌تواند آن را برای توسعه‌دهندگان جذاب‌تر کند.

بهبودهای Opus 5.5 تنها به وظایف قابل انجام محدود نمی‌شود؛ بلکه نحوه عملکرد آن نیز ارتقا یافته است. Anthropic ادعا می‌کند که این مدل متنی قابل فهم‌تر تولید می‌کند و حدود ۸۵ درصد کمتر از مدل‌های قبلی تلاش در دور زدن محدودیت‌ها داشته است، که نشان‌دهنده اطاعت‌پذیری بیشتر آن است. نکته قابل توجه دیگر، کاهش هزینه‌های استفاده از این مدل است؛ هزینه هر توکن ورودی ۴ دلار و هر توکن خروجی ۲۰ دلار است، که نسبت به Opus 5 (۵ دلار ورودی و ۲۵ دلار خروجی) کاهش یافته است.

GPT-6 Sol و Luna: کارایی بیشتر با هزینه کمتر

در سوی دیگر، OpenAI با مدل‌های جدید GPT-6 Sol و GPT-6 Luna، رویکردی مشابه در پیش گرفته است. این مدل‌ها که با روش‌های مشابه GPT-6 Astra آموزش دیده‌اند، بهبودهایی را در حوزه‌های کار حرفه‌ای، کدنویسی و استفاده از کامپیوتر ارائه می‌دهند، اما با هزینه‌ای تا ۵۰ درصد کمتر نسبت به قیمت‌های تبلیغاتی مدل‌های GPT-5.6. به طور مشخص، هزینه توکن‌های ورودی برای GPT-6 Sol ۲ دلار و برای توکن‌های خروجی ۱۰ دلار است. برای مدل Luna، هزینه توکن‌های ورودی ۰.۱۰ دلار و توکن‌های خروجی ۰.۵۰ دلار تعیین شده است.

در زمینه بهبودها، هر دو مدل GPT-6 در دقت اطلاعات بهتر عمل می‌کنند؛ به طوری که OpenAI ادعا می‌کند Sol حدود نیمی از خطاهای مدل قبلی خود را مرتکب می‌شود. در کدنویسی نیز، GPT-6 Sol قادر است با هزینه‌ای کمتر، عملکردی هم‌سطح با Fable 5.1 ارائه دهد. این مدل‌های جدید همچنین ارتباطات واضح‌تری دارند و به لطف بهبودهای صورت گرفته در حافظه پنهان دستورات (prompt caching)، می‌توانند زمینه بیشتری را بازیافت کرده و سریع‌تر پاسخ دهند.

همسویی بیشتر و معیارهای ارزیابی جدید

OpenAI همچنین اعلام کرده است که مدل‌های GPT-6 نسبت به قبل همسویی بیشتری دارند. به عنوان مثال، دروغ کمتری درباره نتایج کار کدنویسی خود می‌گویند و در مواجهه با دستورات ناامن، تلاش بیشتری برای دور زدن حفاظ‌ها را رد می‌کنند. مانند Anthropic، OpenAI نیز معیارهای خود را برای ارزیابی پیشرفت و ایمنی توسعه هوش مصنوعی توسط ارزیابان شخص ثالث پیشنهاد داده است. اینکه آیا این پیشنهادات به یک استاندارد صنعتی تبدیل خواهند شد یا خیر، هنوز مشخص نیست.

دسترسی و انتشار مدل‌ها

مدل Opus 5.5 از Anthropic هم‌اکنون از طریق Claude، Amazon Web Services، Google Cloud و Microsoft Azure برای توسعه‌دهندگان در دسترس است. مدل‌های GPT-6 Sol و GPT-6 Luna از OpenAI در ChatGPT Work و Codex برای مشتریان Plus، Business و Enterprise عرضه شده‌اند. کاربران رایگان و مشترکین Go تنها به مدل GPT-6 Luna در برنامه دسکتاپ شرکت دسترسی خواهند داشت.