کلود سونت ۵.۵ آنتروپیک منتشر شد؛ با نصف قیمت، کدنویسی اپوس ۵.۵ را شکست داد
آپگیتمثبتنوآوری فناوریاخبار

کلود سونت ۵.۵ آنتروپیک منتشر شد؛ با نصف قیمت، کدنویسی اپوس ۵.۵ را شکست داد

زمان مطالعه: ۴ دقیقه

انتراپیک مدل جدید کلود سونت ۵.۵ را معرفی کرد؛ سرعت و کارایی بالاتر با هزینه‌ای کمتر

شرکت انتراپیک روز دوشنبه از عرضه مدل جدید کلود سونت ۵.۵ (Claude Sonnet 5.5) خبر داد که نسخه‌ای ارتقا یافته از مدل سونت ۵ است. این شرکت ادعا می‌کند که مدل میان‌رده جدید، بیش از ۳۰ درصد سریع‌تر از نسل قبلی خود عمل می‌کند.

قابلیت‌های کلیدی سونت ۵.۵

انتراپیک در بیانیه‌ای اعلام کرد: «سونت ۵.۵ در انجام وظایف روزمره با دامنه مشخص، رفع اشکالات نرم‌افزاری، و تولید اسناد، اسلایدها و صفحات گسترده حرفه‌ای، بهترین عملکرد را دارد. همچنین، این مدل در زمینه طراحی نیز دقت بالایی از خود نشان می‌دهد.»

قیمت‌گذاری و صرفه‌جویی

قیمت‌گذاری مدل جدید تغییری نکرده و همچنان ۲ دلار به ازای هر میلیون توکن ورودی و ۱۰ دلار به ازای هر میلیون توکن خروجی است. توکن‌ها واحدهای متنی هستند که هوش مصنوعی آن‌ها را پردازش می‌کند و شرکت‌ها بر اساس میلیون‌ها توکن صورتحساب صادر می‌کنند. این قیمت نصف هزینه مدل اپوس ۵.۵ (Opus 5.5) است. با این حال، سونت ۵.۵ در هر وظیفه تقریباً یک سوم توکن کمتری مصرف می‌کند که این امر در نهایت منجر به کاهش هزینه‌های عملیاتی نسبت به سونت ۵ می‌شود.

عملکرد در کدنویسی

این مدل در زمینه کدنویسی نیز درخشش قابل توجهی دارد. در آزمون Terminal-Bench 4.0 که توانایی یک عامل هوش مصنوعی را در تکمیل وظایف پیچیده حرفه‌ای با تایپ دستورات به صورت خودکار می‌سنجد، سونت ۵.۵ موفق به کسب امتیاز ۷۰.۶ درصد شد. در مقایسه، اپوس ۵.۵ امتیاز ۶۶.۴ درصد و سونت ۵ امتیاز ۱۰.۳ درصد را کسب کردند. به عبارت ساده‌تر، مدل ارزان‌تر توانست وظایف بیشتری را با موفقیت به اتمام برساند.

شرکت Artificial Analysis، یک موسسه مستقل تست، نسخه خود را اجرا کرد و نتایج مشابهی را گزارش داد: ۶۳.۶ درصد برای سونت ۵.۵، ۵۹.۶ درصد برای اپوس ۵.۵ و ۵۹.۱ درصد برای مدل GPT-6 Astra از شرکت OpenAI.

مقایسه با رقبا و هزینه‌ها

امتیازات به میزان تلاش (effort setting) نیز بستگی دارد؛ پارامتری که به مدل اجازه می‌دهد برای پاسخ بهتر، زمان بیشتری صرف کند و در نتیجه هزینه بیشتری داشته باشد. انتراپیک می‌گوید سونت ۵.۵ در حالت تلاش بالا (High effort)، در آزمون FrontierCode با مدل GPT-6 Sol رقابت می‌کند، اما هزینه آن برای هر وظیفه حدود یک پنجم است.

در آزمون GDPval-AA که عملکرد واقعی حرفه‌ای را در ۴۴ شغل با استفاده از سیستم رتبه‌بندی Elo (مشابه شطرنج) ارزیابی می‌کند، سونت ۵.۵ با امتیاز ۱۸۴۴ و اپوس ۵.۵ با امتیاز ۱۸۴۶، عملاً در یک سطح قرار گرفتند. مدل GPT-6 Sol امتیاز ۱۴۸۷ را کسب کرد.

رقبا نیز قیمت‌گذاری مشابهی را ارائه می‌دهند. OpenAI هفته گذشته قیمت مدل GPT-6 Sol را به ۲ و ۱۰ دلار کاهش داد و مدل میان‌رده GPT-5.6 Terra نیز با قیمت ۲ و ۱۲ دلار عرضه می‌شود. انتراپیک هنوز هیچ بنچمارکی برای مدل Terra منتشر نکرده است.

مصرف توکن و هزینه‌های واقعی

سونت ۵.۵ در حالت حداکثر تلاش، حدود ۱۹۳ هزار توکن در هر وظیفه آزمایشی تولید کرده است که بیشترین مقداری است که Artificial Analysis اندازه‌گیری کرده و تقریباً ۶۰ درصد بیشتر از اپوس ۵.۵ است. این امر هزینه هر وظیفه را به ۷.۶۰ دلار رسانده که حدود ۵۰ درصد بیشتر از سونت ۵ است و با ادعای انتراپیک مبنی بر صرفه‌جویی تا ۳۰ درصد در تضاد است.

صرفه‌جویی انتراپیک از تنظیمات پایین‌تر حاصل می‌شود: در حالت تلاش متوسط (Medium effort)، که حالت پیش‌فرض در برنامه‌های این شرکت است، سونت ۵.۵ بهترین امتیاز کدنویسی سونت ۵ را با هزینه‌ای کمتر از یک دهم آن به دست می‌آورد. Artificial Analysis معتقد است حالت تلاش بالا بهترین ارزش را ارائه می‌دهد. برای کاربران عادی، این بدان معناست که می‌توانند عملکردی نزدیک به مدل‌های پرچمدار در کدنویسی را با کسری از قیمت تجربه کنند، به شرطی که تنظیمات تلاش پایین نگه داشته شود.

جداول انتراپیک خوداظهاری هستند و Artificial Analysis یک نسخه پیش از انتشار را تست کرده که دارای یک باگ بوده و انتراپیک انتظار دارد این باگ تأثیر کمی بر امتیازات داشته یا آن‌ها را کمی کمتر از واقعیت نشان داده باشد. انتراپیک همچنان تاکید دارد که اپوس ۵.۵ در کارهای پیچیده که نیاز به قضاوت مداوم دارند، به طور قابل توجهی قوی‌تر است.

انتظار می‌رود مدل Claude Haiku 5.5 که برای کاربردهای با حجم بالا و حساس به هزینه طراحی شده است، در هفته‌های آینده عرضه شود.

برچسب‌ها:آپگیتمثبتنوآوری فناوریاخبار
کپی شد

مقالات مرتبط

مدیر ارشد محصول بیت‌گو شفافیت را در اولویت قرار داد
آپگیتمثبتاخبار

مدیر ارشد محصول بیت‌گو شفافیت را در اولویت قرار داد

بیت‌گو از تأمین امنیت دارایی‌های دیجیتال فراتر می‌رود: تمرکز بر خدمات دارایی برای اوراق بهادار توکنیزه شده در گذشته، نگهداری و حفاظت از دارایی‌های دیجیتال، اطمینان از عدم دسترسی افراد غیرمجاز به کلیده

ادامه مطلب
پرایم‌ایکس‌بی‌تی: بیت‌کوین از افزایش نرخ بهره عبور کرد؛ آیا از فروش اوراق قرضه هم می‌گذرد؟
آپگیتخنثیروند بازاراخبار

پرایم‌ایکس‌بی‌تی: بیت‌کوین از افزایش نرخ بهره عبور کرد؛ آیا از فروش اوراق قرضه هم می‌گذرد؟

بیت‌کوین در مواجهه با افزایش بازده اوراق قرضه؛ تحلیل بازار و چشم‌انداز آینده تحلیلگر ارشد بازار در PrimeXBT در اواسط سپتامبر، وضعیت بیت‌کوین چندان مطلوب به نظر نمی‌رسید. با شکست قانون CLARITY Act در س

ادامه مطلب
مانوس ۲.۰ با معماری جدید کاسکید رونمایی شد؛ استارتاپ عامل هوش مصنوعی در پی ارزش‌گذاری ۴ میلیارد دلاری
آپگیتمثبتاخبار

مانوس ۲.۰ با معماری جدید کاسکید رونمایی شد؛ استارتاپ عامل هوش مصنوعی در پی ارزش‌گذاری ۴ میلیارد دلاری

مانوس با به‌روزرسانی بزرگ ۲.۰، مسیر خود را به سوی تسلط بر بازار هوش مصنوعی هموار می‌کند شرکت مانوس (Manus)، پلتفرم عامل هوش مصنوعی که در مدت زمان کوتاهی از یک استارتاپ گمنام چینی به رقیبی جهانی تبدیل

ادامه مطلب