مسابقه نوآوری در هوش مصنوعی: مدلهای جدید Anthropic و OpenAI
در میان بحثهای پررنگ درباره لزوم کند کردن سرعت توسعه هوش مصنوعی، شرکتهای Anthropic و OpenAI با معرفی مدلهای جدید خود، بار دیگر فعالانه در این عرصه پیشتازی میکنند. این دو شرکت، با تکیه بر دستاوردهای قبلی خود، مدلهای تازهای را عرضه کردهاند که نه تنها سطح عملکرد بالاتری را ارائه میدهند، بلکه با کاهش هزینهها، دسترسی به فناوریهای پیشرفته هوش مصنوعی را تسهیل میکنند.
Claude Opus 5.5: تمرکز بر تحلیل پیچیده و کدنویسی
Anthropic با مدل جدید Opus 5.5، تمرکز خود را بر بهبود قابلیتهای پردازش وظایف پیچیده گذاشته است. این مدل در زمینههایی مانند "یافتن و رفع ناکارآمدیها در نرمافزار"، تحلیلهای مالی و کارهای تجاری، عملکردی چشمگیر از خود نشان میدهد و به طور خاص مشتریان سازمانی را هدف قرار داده است. علاوه بر این، بنچمارکهای Anthropic ادعا میکنند که Opus 5.5 در کدنویسی عاملی (agentic coding) نسبت به GPT-6 Astra در هر دو معیار Terminal-Bench 4.0 و FrontierCode v1.1 (Main) امتیاز بالاتری کسب کرده است که این امر میتواند آن را برای توسعهدهندگان جذابتر کند.
بهبودهای Opus 5.5 تنها به وظایف قابل انجام محدود نمیشود؛ بلکه نحوه عملکرد آن نیز ارتقا یافته است. Anthropic ادعا میکند که این مدل متنی قابل فهمتر تولید میکند و حدود ۸۵ درصد کمتر از مدلهای قبلی تلاش در دور زدن محدودیتها داشته است، که نشاندهنده اطاعتپذیری بیشتر آن است. نکته قابل توجه دیگر، کاهش هزینههای استفاده از این مدل است؛ هزینه هر توکن ورودی ۴ دلار و هر توکن خروجی ۲۰ دلار است، که نسبت به Opus 5 (۵ دلار ورودی و ۲۵ دلار خروجی) کاهش یافته است.
GPT-6 Sol و Luna: کارایی بیشتر با هزینه کمتر
در سوی دیگر، OpenAI با مدلهای جدید GPT-6 Sol و GPT-6 Luna، رویکردی مشابه در پیش گرفته است. این مدلها که با روشهای مشابه GPT-6 Astra آموزش دیدهاند، بهبودهایی را در حوزههای کار حرفهای، کدنویسی و استفاده از کامپیوتر ارائه میدهند، اما با هزینهای تا ۵۰ درصد کمتر نسبت به قیمتهای تبلیغاتی مدلهای GPT-5.6. به طور مشخص، هزینه توکنهای ورودی برای GPT-6 Sol ۲ دلار و برای توکنهای خروجی ۱۰ دلار است. برای مدل Luna، هزینه توکنهای ورودی ۰.۱۰ دلار و توکنهای خروجی ۰.۵۰ دلار تعیین شده است.
در زمینه بهبودها، هر دو مدل GPT-6 در دقت اطلاعات بهتر عمل میکنند؛ به طوری که OpenAI ادعا میکند Sol حدود نیمی از خطاهای مدل قبلی خود را مرتکب میشود. در کدنویسی نیز، GPT-6 Sol قادر است با هزینهای کمتر، عملکردی همسطح با Fable 5.1 ارائه دهد. این مدلهای جدید همچنین ارتباطات واضحتری دارند و به لطف بهبودهای صورت گرفته در حافظه پنهان دستورات (prompt caching)، میتوانند زمینه بیشتری را بازیافت کرده و سریعتر پاسخ دهند.
همسویی بیشتر و معیارهای ارزیابی جدید
OpenAI همچنین اعلام کرده است که مدلهای GPT-6 نسبت به قبل همسویی بیشتری دارند. به عنوان مثال، دروغ کمتری درباره نتایج کار کدنویسی خود میگویند و در مواجهه با دستورات ناامن، تلاش بیشتری برای دور زدن حفاظها را رد میکنند. مانند Anthropic، OpenAI نیز معیارهای خود را برای ارزیابی پیشرفت و ایمنی توسعه هوش مصنوعی توسط ارزیابان شخص ثالث پیشنهاد داده است. اینکه آیا این پیشنهادات به یک استاندارد صنعتی تبدیل خواهند شد یا خیر، هنوز مشخص نیست.
دسترسی و انتشار مدلها
مدل Opus 5.5 از Anthropic هماکنون از طریق Claude، Amazon Web Services، Google Cloud و Microsoft Azure برای توسعهدهندگان در دسترس است. مدلهای GPT-6 Sol و GPT-6 Luna از OpenAI در ChatGPT Work و Codex برای مشتریان Plus، Business و Enterprise عرضه شدهاند. کاربران رایگان و مشترکین Go تنها به مدل GPT-6 Luna در برنامه دسکتاپ شرکت دسترسی خواهند داشت.
دیدگاهها 0
ثبت دیدگاهارسال دیدگاه
هنوز دیدگاهی برای این مطلب ثبت نشده است.
اولین نفری باشید که نظر خود را به اشتراک میگذارد!