انتراپیک مدل جدید کلود سونت ۵.۵ را معرفی کرد؛ سرعت و کارایی بالاتر با هزینهای کمتر
شرکت انتراپیک روز دوشنبه از عرضه مدل جدید کلود سونت ۵.۵ (Claude Sonnet 5.5) خبر داد که نسخهای ارتقا یافته از مدل سونت ۵ است. این شرکت ادعا میکند که مدل میانرده جدید، بیش از ۳۰ درصد سریعتر از نسل قبلی خود عمل میکند.
قابلیتهای کلیدی سونت ۵.۵
انتراپیک در بیانیهای اعلام کرد: «سونت ۵.۵ در انجام وظایف روزمره با دامنه مشخص، رفع اشکالات نرمافزاری، و تولید اسناد، اسلایدها و صفحات گسترده حرفهای، بهترین عملکرد را دارد. همچنین، این مدل در زمینه طراحی نیز دقت بالایی از خود نشان میدهد.»
قیمتگذاری و صرفهجویی
قیمتگذاری مدل جدید تغییری نکرده و همچنان ۲ دلار به ازای هر میلیون توکن ورودی و ۱۰ دلار به ازای هر میلیون توکن خروجی است. توکنها واحدهای متنی هستند که هوش مصنوعی آنها را پردازش میکند و شرکتها بر اساس میلیونها توکن صورتحساب صادر میکنند. این قیمت نصف هزینه مدل اپوس ۵.۵ (Opus 5.5) است. با این حال، سونت ۵.۵ در هر وظیفه تقریباً یک سوم توکن کمتری مصرف میکند که این امر در نهایت منجر به کاهش هزینههای عملیاتی نسبت به سونت ۵ میشود.
عملکرد در کدنویسی
این مدل در زمینه کدنویسی نیز درخشش قابل توجهی دارد. در آزمون Terminal-Bench 4.0 که توانایی یک عامل هوش مصنوعی را در تکمیل وظایف پیچیده حرفهای با تایپ دستورات به صورت خودکار میسنجد، سونت ۵.۵ موفق به کسب امتیاز ۷۰.۶ درصد شد. در مقایسه، اپوس ۵.۵ امتیاز ۶۶.۴ درصد و سونت ۵ امتیاز ۱۰.۳ درصد را کسب کردند. به عبارت سادهتر، مدل ارزانتر توانست وظایف بیشتری را با موفقیت به اتمام برساند.
شرکت Artificial Analysis، یک موسسه مستقل تست، نسخه خود را اجرا کرد و نتایج مشابهی را گزارش داد: ۶۳.۶ درصد برای سونت ۵.۵، ۵۹.۶ درصد برای اپوس ۵.۵ و ۵۹.۱ درصد برای مدل GPT-6 Astra از شرکت OpenAI.
مقایسه با رقبا و هزینهها
امتیازات به میزان تلاش (effort setting) نیز بستگی دارد؛ پارامتری که به مدل اجازه میدهد برای پاسخ بهتر، زمان بیشتری صرف کند و در نتیجه هزینه بیشتری داشته باشد. انتراپیک میگوید سونت ۵.۵ در حالت تلاش بالا (High effort)، در آزمون FrontierCode با مدل GPT-6 Sol رقابت میکند، اما هزینه آن برای هر وظیفه حدود یک پنجم است.
در آزمون GDPval-AA که عملکرد واقعی حرفهای را در ۴۴ شغل با استفاده از سیستم رتبهبندی Elo (مشابه شطرنج) ارزیابی میکند، سونت ۵.۵ با امتیاز ۱۸۴۴ و اپوس ۵.۵ با امتیاز ۱۸۴۶، عملاً در یک سطح قرار گرفتند. مدل GPT-6 Sol امتیاز ۱۴۸۷ را کسب کرد.
رقبا نیز قیمتگذاری مشابهی را ارائه میدهند. OpenAI هفته گذشته قیمت مدل GPT-6 Sol را به ۲ و ۱۰ دلار کاهش داد و مدل میانرده GPT-5.6 Terra نیز با قیمت ۲ و ۱۲ دلار عرضه میشود. انتراپیک هنوز هیچ بنچمارکی برای مدل Terra منتشر نکرده است.
مصرف توکن و هزینههای واقعی
سونت ۵.۵ در حالت حداکثر تلاش، حدود ۱۹۳ هزار توکن در هر وظیفه آزمایشی تولید کرده است که بیشترین مقداری است که Artificial Analysis اندازهگیری کرده و تقریباً ۶۰ درصد بیشتر از اپوس ۵.۵ است. این امر هزینه هر وظیفه را به ۷.۶۰ دلار رسانده که حدود ۵۰ درصد بیشتر از سونت ۵ است و با ادعای انتراپیک مبنی بر صرفهجویی تا ۳۰ درصد در تضاد است.
صرفهجویی انتراپیک از تنظیمات پایینتر حاصل میشود: در حالت تلاش متوسط (Medium effort)، که حالت پیشفرض در برنامههای این شرکت است، سونت ۵.۵ بهترین امتیاز کدنویسی سونت ۵ را با هزینهای کمتر از یک دهم آن به دست میآورد. Artificial Analysis معتقد است حالت تلاش بالا بهترین ارزش را ارائه میدهد. برای کاربران عادی، این بدان معناست که میتوانند عملکردی نزدیک به مدلهای پرچمدار در کدنویسی را با کسری از قیمت تجربه کنند، به شرطی که تنظیمات تلاش پایین نگه داشته شود.
جداول انتراپیک خوداظهاری هستند و Artificial Analysis یک نسخه پیش از انتشار را تست کرده که دارای یک باگ بوده و انتراپیک انتظار دارد این باگ تأثیر کمی بر امتیازات داشته یا آنها را کمی کمتر از واقعیت نشان داده باشد. انتراپیک همچنان تاکید دارد که اپوس ۵.۵ در کارهای پیچیده که نیاز به قضاوت مداوم دارند، به طور قابل توجهی قویتر است.
انتظار میرود مدل Claude Haiku 5.5 که برای کاربردهای با حجم بالا و حساس به هزینه طراحی شده است، در هفتههای آینده عرضه شود.



