Claude Opus 5.5 نسل جدید مدل Opus آنتروپیک است که برای برنامه نویسی، کارهای Agentic، تحقیق و وظایف حرفه ای پیچیده طراحی شده است. آنتروپیک این مدل را در 22 سپتامبر 2026 معرفی کرد و می گوید در بیشتر کارها به سطح Claude Fable 5.1 نزدیک می شود، در حالی که هزینه اجرای معمول آن حدود 40 درصد کمتر از Opus 5 است. سرعت تولید خروجی نیز بیش از 30 درصد افزایش یافته و قیمت API کاهش پیدا کرده است. این مدل اولین عضو از خانواده Claude 5.5 محسوب می شود و نسخه های Sonnet و Haiku این نسل نیز قرار است بعدا عرضه شوند.

مدل جدید Opus دقیقا برای چه کاری ساخته شده است؟

Opus همیشه بخش قدرتمند خانواده Claude برای کارهای دشوار بوده است. نسل 5.5 این مسیر را ادامه می دهد، اما تمرکز فقط روی افزایش توانایی خام نیست. آنتروپیک تلاش کرده مدل بتواند همان کارها را با مراحل کمتر، Token کمتر و زمان کوتاه تر انجام دهد.
این موضوع مخصوصا در Agent ها اهمیت دارد. یک ایجنت برنامه نویسی ممکن است برای انجام یک کار صدها بار فایل بخواند، فرمان اجرا کند یا از Tool استفاده کند. اگر مدل بتواند زودتر تصمیم درست بگیرد، هزینه کل Workflow نیز کاهش پیدا می کند.
آنتروپیک می گوید مدل جدید در Agentic Coding، Computer Use و Knowledge Work عملکرد قدرتمندی دارد و در تعدادی از ارزیابی های داخلی و خارجی از Opus 5 و حتی Fable 5.1 جلوتر قرار گرفته است. البته نتایج Benchmark همیشه باید در کنار آزمایش روی وظایف واقعی تفسیر شوند.

تفاوت اصلی با Claude Opus 5 چیست؟

تفاوت مهم را می توان در سه بخش خلاصه کرد: توانایی بیشتر، سرعت بالاتر و مصرف منابع کمتر. قیمت هر یک میلیون Token ورودی از 5 دلار در Opus 5 به 4 دلار کاهش یافته و هزینه یک میلیون Token خروجی نیز از 25 دلار به 20 دلار رسیده است.
کاهش قیمت هر Token به تنهایی 20 درصد است، اما آنتروپیک می گوید مدل برای انجام یک وظیفه معمولا Token کمتری هم مصرف می کند. ترکیب این دو موضوع باعث می شود هزینه معمول بعضی Workflow ها حدود 40 درصد پایین تر باشد.
هزینه Cache Read نیز از 0.50 دلار به 0.20 دلار به ازای هر یک میلیون Token کاهش پیدا کرده است. این تغییر برای Agent های برنامه نویسی و سیستم هایی که Context مشابه را چند بار استفاده می کنند اهمیت زیادی دارد.

چرا سرعت مدل اهمیت زیادی دارد؟

در یک سوال ساده، تفاوت چند ثانیه ای شاید چندان مهم نباشد. اما در Agent هایی که ده ها یا صدها مرحله دارند، سرعت هر پاسخ روی زمان کل انجام پروژه تاثیر می گذارد.
آنتروپیک اعلام کرده Opus 5.5 بیش از 30 درصد سریع تر از نسل قبلی خروجی تولید می کند. علاوه بر حالت عادی، Fast Mode نیز در Claude Code و Claude Platform ارائه شده است که می تواند سرعت را تا 2.5 برابر افزایش دهد. قیمت این حالت 8 دلار برای هر یک میلیون Token ورودی و 40 دلار برای خروجی است.
این حالت بیشتر زمانی کاربرد دارد که سرعت انجام کار از پایین ترین هزینه ممکن مهم تر باشد. برای مثال، یک تیم توسعه ممکن است هنگام Debug کردن یک سیستم Production بخواهد نتیجه را سریع تر دریافت کند.

پیشرفت در برنامه نویسی و پروژه‌های طولانی

یکی از مهم ترین حوزه های تمرکز این مدل، Software Engineering است. آنتروپیک می گوید مدل جدید در وظایف طولانی مثل Migration، Audit و تغییرات گسترده در Codebase بهتر می تواند مسیر کار را حفظ کند.
در یکی از آزمایش های اولیه، یک کاربر توانسته مهاجرت یک Codebase شامل 680 هزار خط را در کمتر از یک روز انجام دهد. در نمونه دیگری، مدل یک Codebase حدود 200 هزار خطی را در کمتر از سه ساعت بررسی و اصلاح کرده؛ کاری که طبق گزارش آنتروپیک با Opus 5 بیش از 20 ساعت زمان گرفته بود.
این نمونه ها تضمین نمی کنند هر پروژه واقعی همین میزان افزایش سرعت را تجربه کند، اما جهت توسعه مدل را نشان می دهند: Agent باید بتواند مدت طولانی روی یک مسئله باقی بماند و بدون تکرار و سردرگمی مراحل بیشتری را تمام کند.

عملکرد مدل در بنچمارک‌های برنامه نویسی

آنتروپیک در Terminal-Bench 4.0 امتیاز 66.4 درصد را برای مدل جدید گزارش کرده است. در FrontierCode v1.1 نیز نتیجه 54.4 درصد و در CursorBench 4.0 امتیاز 57.8 درصد ثبت شده است. این ارزیابی ها روی وظایف چند مرحله ای برنامه نویسی و تغییر Codebase تمرکز دارند.
شرکت تاکید می کند اختلاف Benchmark ها در مدل های بسیار قدرتمند همیشه مستقیما به همان میزان تفاوت در تجربه واقعی تبدیل نمی شود. به همین دلیل بهتر است توسعه دهندگان مدل را روی Repository و وظایف خودشان نیز آزمایش کنند.
نکته مهم تر برای پروژه های تجاری نسبت میان کیفیت و هزینه است. در بعضی آزمایش های منتشر شده، مدل با Effort متوسط توانسته عملکرد بسیار بالایی داشته باشد و در عین حال هزینه هر Task را کاهش دهد.

کار با Agent‌ها و Tool Use

Agent هوش مصنوعی فقط متن تولید نمی کند. ممکن است Terminal را کنترل کند، فایل بخواند، جستجو انجام دهد، Browser را باز کند یا چند Subagent را برای انجام بخش های مختلف یک پروژه مدیریت کند.
نسخه جدید برای چنین جریان هایی بهینه شده است. گزارش های Early Access نشان می دهند تعداد Step و Tool Call در برخی وظایف نسبت به Opus 5 کمتر شده است. این اتفاق اهمیت زیادی دارد، چون هر Tool Call زمان و هزینه جدیدی به Workflow اضافه می کند.
برای مثال، در یک Agent برنامه نویسی بهتر است مدل به جای چند بار باز کردن فایل های مشابه و امتحان کردن مسیرهای مختلف، Context لازم را یک بار جمع کند و تغییر کامل تری ایجاد کند.

پیشرفت در Knowledge Work

کاربرد مدل فقط برنامه نویسی نیست. آنتروپیک آن را برای تحلیل مالی، تحقیق، گزارش نویسی، کار حقوقی، داده و Workflow های کسب و کار نیز آزمایش کرده است.
در GDPval-AA v2.1 که وظایف حرفه ای در 44 شغل را بررسی می کند، مدل امتیاز 1846 Elo گرفته است. Fable 5.1 در همان جدول 1735 و Opus 5 امتیاز 1708 داشته اند.
آنتروپیک همچنین آزمایشی انجام داده که در آن مدل باید اطلاعات مالی یک شرکت را از منابع پراکنده پیدا و گزارش تهیه می کرد. در این ارزیابی هر عدد یا نقل قول ساختگی باعث رد شدن پاسخ می شد. شرکت گزارش کرده 16 مورد از 18 خروجی مدل جدید معیار کیفیت را پاس کرده اند.

پاسخ‌های کوتاه‌تر و طبیعی‌تر

یکی از تغییرهایی که شاید در Benchmark ها زیاد دیده نشود، نحوه نوشتن پاسخ است. آنتروپیک می گوید بازخورد کاربران Opus 5 نشان داده بود بعضی پاسخ ها بیش از حد طولانی هستند یا از عبارت های پیچیده استفاده می کنند.
نسخه جدید تلاش می کند مهم ترین اطلاعات را زودتر ارائه کند، کمتر از اصطلاحات غیر ضروری استفاده کند و قواعد نوشتاری مشخص شده توسط کاربر را بهتر رعایت کند.
این تغییر برای استفاده طولانی اهمیت دارد. اگر یک Agent ساعت ها روی پروژه کار کند، گزارش های طولانی و تکراری می توانند بررسی کار را دشوار کنند. پاسخ کوتاه تر فقط تجربه کاربری را بهتر نمی کند و می تواند میزان Token خروجی را هم کاهش دهد.

امنیت مدل چه تغییری کرده است؟

توانایی بیشتر Agent ها نگرانی امنیتی بیشتری ایجاد می کند. مدلی که می تواند ساعت ها روی Codebase کار کند یا ابزارهای واقعی را کنترل کند، باید بهتر از قبل محدوده دستور را رعایت کند.
آنتروپیک می گوید مدل جدید در Automated Behavioral Audit که نزدیک به 2000 سناریو را بررسی می کند، در بیشتر معیارهای رفتار ناهمسو بهتر از مدل های اخیر Claude عمل کرده است. در یک آزمایش مخصوص عبور از مرزهای محیط، تلاش برای دور زدن محدودیت ها حدود 85 درصد کمتر از Opus 5 و Mythos 5.1 گزارش شده است.
شرکت در عین حال تاکید می کند که ارزیابی رفتار Agent های پیشرفته هنوز مسئله حل شده ای نیست و نتایج آزمایشگاهی نمی توانند همه موقعیت های واقعی را پوشش دهند.

محدودیت‌های سایبری و زیستی

توانایی های مدل در Cybersecurity و Biology به سطحی رسیده که آنتروپیک برای بعضی درخواست ها محدودیت های بیشتری در نظر گرفته است. بسیاری از کارهای معمول توسعه نرم افزار، مثل پیدا کردن و اصلاح Bug، همچنان قابل انجام هستند، اما بخش زیادی از وظایف تخصصی سایبری ممکن است به Opus 4.8 منتقل شوند.
برای سازمان ها و پژوهشگران تایید شده، برنامه های جداگانه ای برای دسترسی گسترده تر به قابلیت های سایبری و زیستی در نظر گرفته شده است. آنتروپیک همچنین اعلام کرده مدل قبل از انتشار توسط مجموعه هایی مانند METR و Frontier Design ارزیابی شده است.

دسترسی و استفاده در API

مدل از زمان معرفی روی پلتفرم های Claude در دسترس قرار گرفته است. توسعه دهندگان می توانند در Claude Platform از شناسه claude-opus-5-5 استفاده کنند. همچنین مدل از طریق Amazon Web Services، Google Cloud و Microsoft Azure ارائه می شود.
همزمان محدودیت استفاده پنج ساعته برای کاربران Pro، Max، Team و برخی حساب های Enterprise افزایش یافته است. بنابراین تغییر فقط مربوط به API نیست و کاربران Claude نیز فضای بیشتری برای استفاده از مدل دارند.

آیا استفاده از مدل جدید برای همه کارها منطقی است؟

قدرتمندترین مدل همیشه بهترین انتخاب اقتصادی برای هر درخواست نیست. خلاصه کردن یک متن کوتاه، دسته بندی ساده داده یا تولید پاسخ های معمول ممکن است با مدل های کوچک تر و ارزان تر نیز به خوبی انجام شود.
مزیت اصلی مدل جدید زمانی مشخص می شود که Task پیچیده باشد، چند مرحله داشته باشد یا خطای مدل باعث تکرار پرهزینه Workflow شود. در چنین شرایطی مدلی که با مراحل و Token کمتر به نتیجه برسد ممکن است با وجود قیمت بالاتر هر Token، هزینه نهایی کمتری داشته باشد.
برای توسعه دهندگان بهتر است Cost per Task را اندازه بگیرند، نه اینکه فقط قیمت هر یک میلیون Token را مقایسه کنند.

خانواده Claude 5.5 چه مسیری خواهد داشت؟

Opus اولین عضو نسل 5.5 است. آنتروپیک اعلام کرده Claude Sonnet 5.5 و Claude Haiku 5.5 نیز در هفته های آینده عرضه خواهند شد و بخشی از پیشرفت های مربوط به عملکرد، سرعت و امنیت را دریافت می کنند.
این ساختار احتمالا امکان انتخاب میان قدرت و هزینه را گسترده تر می کند. Opus برای وظایف سنگین قرار می گیرد، در حالی که Sonnet و Haiku می توانند برای حجم بالاتر درخواست یا کارهای سبک تر مناسب باشند.

جمع بندی

نسل تازه Opus بیشتر از یک افزایش ساده در Benchmark هاست. کاهش قیمت API، مصرف Token کمتر، خروجی بیش از 30 درصد سریع تر و عملکرد بهتر در Agentic Coding باعث شده آنتروپیک روی بهره وری هر Task تمرکز زیادی داشته باشد.
Claude Opus 5.5 برای برنامه نویسی طولانی، Agent ها، تحقیق و Knowledge Work طراحی شده و در عین حال پاسخ های کوتاه تر و طبیعی تری ارائه می دهد. کاهش هزینه معمول تا حدود 40 درصد نسبت به Opus 5 نیز باعث می شود اجرای Workflow های طولانی اقتصادی تر شود. در کنار این پیشرفت ها، محدودیت های بیشتر در حوزه های حساس نشان می دهند افزایش توانایی Agent ها نیاز به کنترل و ارزیابی جدی تری دارد.