Anthropic مدل Claude Opus 5.5 را با کاهش هزینه و بهبود عملکرد عرضه کرد
شرکت Anthropic به طور رسمی مدل Claude Opus 5.5 را معرفی کرد. این بهروزرسانی با کاهش ۲۰ درصدی هزینههای ورودی و خروجی، ۶۰ درصدی در خواندن حافظه پنهان و ۵۰ درصدی در پردازش دستهای، صرفهجویی قابل توجهی را برای تیمهایی که به طور گسترده از این مدل استفاده میکنند، به ارمغان میآورد. با این حال، توسعهدهندگان باید توجه داشته باشند که استفاده مستقیم از کد Opus 5 ممکن است به دلیل چهار تغییر در سازگاری، با خطا مواجه شود.
کاهش هزینهها و افزایش سرعت
توسعهدهندگان با تمرکز صرف بر کاهش ۲۰ درصدی هزینههای ورودی و خروجی، ممکن است مهمترین جنبه این بهروزرسانی را نادیده بگیرند. Anthropic در اطلاعیه رسمی خود اعلام کرده است که Claude Opus 5.5 برای انجام وظایف مشابه، به توکنهای کمتری نیاز دارد و سرعت خروجی آن بیش از ۳۰ درصد افزایش یافته است. در نتیجه، هزینه کلی برای بارهای کاری معمول حدود ۴۰ درصد کاهش یافته است. برای تیمهایی که تماسهای مکرر و در مقیاس بزرگ دارند، کاهش هزینه خواندن حافظه پنهان به ۰.۰۵ برابر قیمت ورودی پایه و نیمبها شدن پردازش دستهای، تفاوت چشمگیری را در صورتحساب ایجاد خواهد کرد.
نکته کوچکی نیز وجود دارد: مستندات توسعهدهندگان Anthropic ذکر میکند که چهار تغییر در سازگاری باعث میشود پروژههایی که از کد قدیمی Opus 5 استفاده میکنند، مستقیماً با خطا مواجه شوند. اگر قبل از مطالعه مستندات، شناسه مدل را به claude-opus-5-5 تغییر دهید، ممکن است با مجموعهای از خطاهای ۴۰۰ مواجه شوید.
جزئیات قیمتگذاری و قابلیتهای جدید
با مقایسه جدول قیمتگذاری Opus 5.5 و Opus 5، مشاهده میشود که قیمت پایه ورودی و خروجی تنها ۲۰ درصد کاهش یافته است. تفاوت واقعی در سه حوزه ایجاد میشود: خواندن حافظه پنهان، پردازش دستهای و حالت سریع (fast mode) که منحصراً برای Claude API در دسترس است (پیشنمایش تحقیقاتی با سرعت تا ۲.۵ برابر، که در Claude Code نیز قابل استفاده است، اما در Bedrock، Google Cloud و Microsoft Foundry پشتیبانی نمیشود).
هزینه خواندن حافظه پنهان به ۰.۲۰ دلار کاهش یافته است که معادل ۰.۰۵ برابر قیمت ورودی پایه است. هزینه نوشتن حافظه پنهان ۵ دقیقهای از ۶.۲۵ دلار به ۵ دلار و هزینه نوشتن حافظه پنهان ۱ ساعته به ۸ دلار کاهش یافته است.
پردازش دستهای نیز با هزینه ورودی ۲ دلار و خروجی ۱۰ دلار، مستقیماً نیمبها شده است. حالت سریع با قیمت بالاتری عرضه میشود، به طوری که ورودی و خروجی به ترتیب ۸ دلار و ۴۰ دلار هزینه دارد، که در ازای آن سرعت خروجی تا ۲.۵ برابر افزایش مییابد. Anthropic اعلام کرده است که محدودیت استفاده ۵ ساعته برای طرحهای Pro، Max، Team و Enterprise نیز افزایش یافته است.
تغییرات سازگاری و نکات مهم برای توسعهدهندگان
مستندات توسعهدهندگان Anthropic چهار تغییر ناسازگار را فهرست کرده است که استفاده مستقیم از کد Opus 5 با تغییر شناسه مدل به claude-opus-5-5 را با مشکل مواجه میکند:
۱. حالت تفکر غیرقابل غیرفعالسازی: ارسال پارامترهای thinking disabled یا budget_tokens با خطای ۴۰۰ مواجه میشود. برای کنترل عمق تفکر باید از پارامتر effort استفاده کرد.
۲. عدم پشتیبانی از فراخوانی اجباری ابزار: تنظیم tool_choice بر روی any یا انتخاب ابزار خاص با خطای ۴۰۰ مواجه میشود. باید از auto همراه با تعریف ابزار دقیق استفاده کرد یا به خروجی ساختاریافته روی آورد.
۳. وابستگی تفکر به مدل و مکالمه: بلوکهای تفکر در Opus 5.5 تنها توسط Fable 5.1 و Mythos 5.1 قابل درک هستند. برای حسابهای کاربری که پس از ۳۱ اوت ۲۰۲۶ ایجاد شدهاند، تغییر متن قبلی مکالمه و ارسال مجدد آن، به دلیل مکانیزم “preserved thinking” برای جلوگیری از تقطیر، با خطای ۴۰۰ مواجه خواهد شد.
۴. بهروزرسانی نسخه ابزار عملیات کامپیوتری: در Claude API و Google Cloud، نسخه قدیمی computer20251124 دیگر پذیرفته نمیشود و باید از computertoolset_20260801 استفاده کرد. Bedrock تحت تأثیر این تغییر قرار نگرفته است.
علاوه بر این چهار تغییر اجباری، یک تفاوت رفتاری دیگر نیز وجود دارد که اغلب نادیده گرفته میشود: سطح پیشفرض effort از high به medium کاهش یافته است. درخواستهایی که به طور خاص مشخص نشدهاند، به طور پیشفرض با سطح medium اجرا میشوند. Anthropic توصیه میکند توسعهدهندگان به طور صریح effort را مشخص کنند. در همان سطح effort، میزان تفکر در هر دور در Opus 5.5 افزایش یافته است. متنی که قبلاً بین فراخوانی ابزارها خروجی داده میشد، اکنون به طور پیشفرض در یک بلوک تفکر خالی قرار میگیرد. برنامههایی که از این متن برای نمایش پیشرفت استفاده میکردند، اکنون رابط کاربری آرامتری خواهند داشت.
دقت در خواندن تصاویر و اسکرینشاتها به طور قابل توجهی افزایش یافته است، در حالی که سقف زمینه (context) ۱ میلیون توکن و سقف خروجی ۱۲۸ هزار توکن، مانند Opus 5، باقی مانده است.
امنیت و عملکرد در مقایسه با رقبا
Anthropic اعلام کرده است که Opus 5.5 بهترین عملکرد را در میان مدلهای قبلی در ممیزی رفتار خودکار داشته است. در تستهای تزریق پرامپت Gray Swan، این مدل در کنار Fable 5.1 کمترین نرخ موفقیت را داشته و تلاش برای عبور از مرزهای بسته حدود ۸۵ درصد کمتر از Opus 5 و Mythos 5.1 بوده است.
این شرکت همچنین یک طبقهبندیکننده ایمنی زیستی جدید اضافه کرده است و بسیاری از وظایف امنیتی توسط Opus 4.8 انجام میشود. برنامه تأیید سایبری (Cyber Verification Program) برای درخواستهای خارجی راهاندازی شده است و ارزیابیهای خارجی توسط METR و Frontier Design انجام میشود. برای انطباق با قانون هوش مصنوعی اتحادیه اروپا، Anthropic اقدامات واترمارکینگ را نیز اضافه کرده است.
در زمینه بنچمارکها، Opus 5.5 در همه موارد پیشتاز نیست. در AutomationBench، GPT-6 Astra با ۴۱.۴ درصد عملکرد بهتری نسبت به Opus 5.5 با ۴۰.۰ درصد داشته است. در Terminal-Bench-Science 0.1، GPT-6 Astra با ۶۴.۶ درصد، بسیار بالاتر از ۵۸.۷ درصد Opus 5.5 قرار گرفته است.
Anthropic خود تأکید میکند که در Terminal-Bench 4.0، دستیابی به نتایج مشابه GPT-6 Astra تنها حدود ۴۰ درصد هزینه داشته و در FrontierCode، برتری بر GPT-6 Astra تنها حدود ۲۰ درصد هزینه در بر داشته است. این شرکت بیشتر بر نسبت عملکرد به هزینه تمرکز دارد تا صرفاً امتیازات بنچمارک.



