Claude Opus 5؛ بررسی مدل حرفهای Anthropic برای کدنویسی عاملمحور و کار سازمانی
آخرین راستیآزمایی: ۱۲ سپتامبر ۲۰۲۶
تاریخ عرضه: ۲۴ ژوئیه ۲۰۲۶
قیمت و شیوهٔ محاسبه: ورودی: ۵ دلار برای هر یک میلیون توکن؛ خروجی: ۲۵ دلار تعرفه و دسترسی را برای زمان خرید دوباره در منبع رسمیِ مقاله بررسی کنید.
مقدمه
Claude Opus 5 مدلی برای کاربرانی است که از هوش مصنوعی فقط یک پاسخ نمیخواهند؛ میخواهند مدل برنامه بریزد، ابزار بهکار بگیرد، کد را تغییر دهد، نتیجه را آزمایش کند و تا رسیدن به یک خروجی قابل تحویل ادامه دهد. Anthropic این مدل را برای کدنویسی عاملمحور پیچیده و کار سازمانی معرفی کرده است.
Opus 5 در خانواده Claude جایگاه جالبی دارد. از Sonnet 5 گرانتر و کندتر است، اما توان بیشتری برای مسائل عمیق دارد. از طرف دیگر، Fable 5.1 در سختترین کارها سقف بالاتری ارائه میکند، ولی قیمت توکنی آن دو برابر Opus است. به همین دلیل Anthropic پیشنهاد میکند بیشتر پروژههای پیچیده از Opus 5 شروع شوند و فقط در صورت ناکافی بودن Evalها به Fable ارتقا پیدا کنند.
این مدل همچنین نمونه روشنی از اهمیت تنظیم Effort است. انتخاب سطح بالاتر میتواند کیفیت کار دشوار را بهتر کند، اما Thinking بیشتر به معنی توکن خروجی، زمان و هزینه بیشتر است. بنابراین «استفاده از قویترین تنظیم» همیشه تصمیم حرفهای نیست.
معرفی کامل Claude Opus 5
Anthropic، Claude Opus 5 را در ۲۴ ژوئیه ۲۰۲۶ عرضه کرد. مدل در زمان آخرین بررسی Active (latest) است و تاریخ بازنشستگی آن زودتر از ۲۴ ژوئیه ۲۰۲۷ نخواهد بود. شناسه Claude API برابر claude-opus-5 است.

Opus 5 نسل بعدی Opus 4.8 محسوب میشود. طبق مستندات سازنده، بیشترین پیشرفت آن در استدلال عمیق، وظایف عاملمحور طولانی، مهندسی نرمافزار و استفاده مؤثر از محاسبه زمان اجرا دیده میشود. Context یکمیلیونتوکنی و خروجی ۱۲۸ هزار توکن نیز برای پروژههایی مناسب است که فایل، تاریخچه و نتیجه ابزار زیادی دارند.
مدل در Claude API، Amazon Bedrock، Google Cloud، Microsoft Foundry و Claude Platform on AWS در دسترس است. Fast Mode بهصورت Research Preview فقط در Claude API ارائه میشود و قیمت جداگانه دارد.
قابلیتهای اصلی
استدلال عمیق با Effort قابل تنظیم
Adaptive Thinking در Opus 5 بهطور پیشفرض روشن است و مقدار Effort پیشفرض high تعیین شده. سطحهای low، medium، high، xhigh و max امکان انتخاب نقطه مناسب میان کیفیت، مصرف توکن و تأخیر را میدهند.
مدل در سطوح بالاتر بهتر از نسل قبل از محاسبه اضافی استفاده میکند، اما max_tokens همچنان سقف مجموع Thinking و پاسخ قابل مشاهده است. تنظیم سقف بسیار پایین ممکن است قبل از تولید پاسخ نهایی، درخواست را ناقص کند.
مهندسی نرمافزار و Agentic Coding
Opus 5 برای Refactor چندفایلی، ریشهیابی باگ، بررسی Pull Request، ساخت تست و تکمیل Feature سرتاسری طراحی شده است. مدل میتواند در یک Tool Loop طولانی مسیر را نگه دارد، نتیجه تست را بخواند و اصلاح بعدی را انتخاب کند.
برای محیط تولید باید دسترسی ابزار حداقلی باشد. حذف داده، Merge، Deploy یا تغییر زیرساخت بهتر است به تأیید صریح انسان وابسته بماند.
Vision و کار با فایل
ورودی متن و تصویر و خروجی متن پشتیبانی میشوند. مدل میتواند Screenshot، Diagram، PDF و فایلهای کاری را تحلیل کند. فایل و PDF از طریق قابلیتهای پلتفرم وارد گردشکار میشوند و هزینه تصویر یا Tokenهای ابزار باید جداگانه در نظر گرفته شود.
Tool Use، Web Search، Browser و Computer Use
Opus 5 میتواند Functionهای تعریفشده توسط توسعهدهنده و ابزارهای Server-side را فراخوانی کند. Web Search برای اطلاعات تازه، Browser Use برای تعامل داخل صفحه و Computer Use برای کنترل محیط دسکتاپ در سطوح پشتیبانیشده قابل استفادهاند.
این دسترسیها بخشی از مدل خام نیستند؛ برنامه میزبان باید ابزار، مجوز و محیط اجرای امن را فراهم کند. طبق راهنمای مهاجرت، Web Fetch در Opus 5 در دسترس نیست، هرچند Web Search و سایر ابزارهای سازگار میتوانند استفاده شوند.
خروجی ساختاریافته و گردشکارهای سازمانی
Function Calling و ابزارهای دارای Schema اجازه میدهند Opus داده را در قالب قابل پردازش برگرداند، سیستم داخلی را استعلام کند یا یک فرایند چندمرحلهای را هدایت کند. Strict Tool Use میتواند انطباق آرگومان ابزار با Schema را تضمین کند، اما صحت معنایی داده همچنان باید اعتبارسنجی شود.
Fast Mode
Fast Mode نسخه جداگانهای از هوش مدل نیست؛ همان Opus 5 را با سرعت خروجی بیشتر و قیمت بالاتر ارائه میکند. این حالت در زمان نگارش Research Preview و فقط روی Claude API است و تا ۲٫۵ برابر سرعت خروجی بیشتری هدف میگیرد.
مهمترین نقاط قوت
- نقطه شروع پیشنهادی Anthropic برای بیشتر کارهای پیچیده
- کیفیت بالا در کدنویسی عاملمحور و پروژههای چندساعته
- Context یکمیلیونتوکنی و خروجی بلند
- تنظیم گسترده Effort برای کنترل کیفیت، هزینه و زمان
- Vision، Tool Use، Browser و Computer Use در محیطهای پشتیبانیشده
- قیمت نصف Fable 5.1 با فاصله عملکرد محدود در بعضی آزمونها
محدودیتها و نقاط ضعف
Opus 5 برای پردازش انبوه ارزان نیست: ورودی ۵ دلار و خروجی ۲۵ دلار برای هر یک میلیون توکن هزینه دارد. چون Thinking پیشفرض روشن و توکنهای آن در خروجی محاسبه میشوند، مهاجرت مستقیم از یک تنظیم بدون Thinking میتواند مصرف را بالا ببرد.

Priority Tier برای این مدل پشتیبانی نمیشود. Fast Mode نیز فقط Preview است و با نرخ دو برابر ارائه میشود. Web Fetch در راهنمای مهاجرت پشتیبانینشده اعلام شده و باید میان آن و Web Search تفاوت گذاشت.
Thinking را فقط در Effort برابر high یا پایینتر میتوان غیرفعال کرد؛ تلاش برای خاموش کردن آن در xhigh یا max خطای 400 میدهد. همچنین مدل ممکن است خروجیهای پیشفرض طولانیتر و گزارش پیشرفت بیشتری از Opus 4.8 تولید کند؛ Prompt باید طول، سبک و شرایط پایان را روشن کند.
خروجی بومی مدل متن است و تولید مستقیم تصویر، ویدیو یا صوت ندارد. مانند هر LLM دیگری، امکان استدلال نادرست، استناد ناقص یا اجرای بیش از حد ابزار وجود دارد و کنترل انسانی برای حوزههای حساس ضروری است.
کاربردهای واقعی Claude Opus 5
پیادهسازی Feature چندسرویسی
مدل میتواند قرارداد API، پایگاه داده، Backend و Frontend را بررسی کند، تغییرات را مرحلهبندی کند و پس از هر مرحله تستهای مرتبط را اجرا کند.
بازبینی معماری و بدهی فنی
برای یک سامانه قدیمی، Opus میتواند وابستگیها، نقاط شکننده، ریسک مهاجرت و ترتیب Refactor را به برنامهای قابل اجرا تبدیل کند.
عامل عملیات کسبوکار
با اتصال به CRM، پایگاه دانش و ابزار پیامرسانی، مدل میتواند داده را جمعآوری و پیشنهاد اقدام بسازد. ارسال پیام، تغییر وضعیت مشتری یا عملیات مالی باید با کنترل دسترسی و تأیید مناسب انجام شود.
تحلیل اسناد پیچیده
در قرارداد، گزارش مالی یا پرونده فنی، مدل میتواند میان چند فایل ارتباط برقرار کند، تناقضها را پیدا کند و خروجی دارای ارجاع تولید کند.
Computer Use برای نرمافزارهای فاقد API
در محیط Sandbox میتوان Opus را برای کار با رابط گرافیکی بهکار گرفت؛ مثلاً وارد کردن داده، ساخت گزارش یا آزمایش یک مسیر UI. ثبت Screenshot و محدودکردن اقدامهای برگشتناپذیر ضروری است.
این مدل مناسب چه کسانی است؟
Claude Opus 5 برای برنامهنویسان حرفهای، تیمهای محصول، معماران نرمافزار، سازندگان Agent، تحلیلگران سازمانی و شرکتهایی مناسب است که کار چندمرحلهای با کیفیت بالا دارند اما نمیخواهند برای همه درخواستها قیمت Fable را بپردازند.
برای چت سریع، تولید محتوای سبک یا پردازش میلیونها درخواست ساده، Sonnet 5 یا Haiku 4.5 گزینه منطقیتری هستند. برای سختترین پژوهش و پروژههایی که Evalهای Opus به حد مطلوب نمیرسند، Fable 5.1 انتخاب بالاتر است.
مشخصات فنی Claude Opus 5
| مشخصه | مقدار تأییدشده |
|---|---|
| Developer | Anthropic |
| Model Family | Claude Opus |
| Model Type | مدل زبانی چندوجهی و استدلالی |
| Release Date | ۲۴ ژوئیه ۲۰۲۶ |
| Lifecycle | Active (latest)؛ بازنشستگی نه زودتر از ۲۴ ژوئیه ۲۰۲۷ |
| API Model ID | claude-opus-5 |
| Input | متن و تصویر |
| Output | متن |
| Context Window | ۱ میلیون توکن |
| Maximum Output | ۱۲۸ هزار توکن؛ ۳۰۰ هزار در Message Batches با Beta Header اعلامشده |
| Reliable Knowledge Cutoff | مه ۲۰۲۶ |
| Thinking | Adaptive؛ پیشفرض high |
| Vision | بله |
| Audio / Video | ورودی یا خروجی بومی اعلام نشده |
| Tool Use | بله |
| Web Search | ابزار قابل فعالسازی؛ Web Fetch پشتیبانینشده |
| Computer / Browser Use | بله، در پلتفرمهای پشتیبانیشده |
| API Availability | Claude API و چند پلتفرم ابری |
۵ نمونه پرامپت کاربردی
۱. Feature کامل با تست
این Issue را از ابتدا تا نتیجه قابل Merge انجام بده. ابتدا معماری موجود و قراردادهای مرتبط را پیدا کن، سپس یک برنامه کوتاه ارائه بده و تغییر را با کمترین سطح اثر اجرا کن. تستهای واحد و Integration لازم را اضافه کن، همه خروجیها را گزارش بده و هیچ فایل نامرتبطی را تغییر نده.
۲. ریشهیابی حادثه تولید
این Timeline، Logها و سه Deploy اخیر را تحلیل کن. فرضیهها را بر اساس شواهد رتبهبندی کن، برای هر فرضیه یک آزمون کمخطر پیشنهاد بده و میان همبستگی و علت تفاوت بگذار. تا وقتی مدرک کافی نداری، علت قطعی اعلام نکن.
۳. بازبینی قرارداد چندسندی
قرارداد اصلی و چهار پیوست را با هم بررسی کن. تعهدات متعارض، SLA، جریمه، تمدید خودکار و بندهای تغییر کنترل را در جدول استخراج کن. هر ردیف باید ارجاع دقیق، مالک اقدام و سطح ریسک داشته باشد؛ موارد نامعلوم را حدس نزن.
۴. طراحی Agent سازمانی
یک گردشکار عاملمحور برای رسیدگی به درخواست بازپرداخت طراحی کن. ابزارها، Schema هر فراخوانی، کنترل دسترسی، شرایط توقف، ثبت Audit و نقاط تأیید انسانی را مشخص کن. مسیر خطا و Idempotency را هم پوشش بده.
۵. تحلیل و تست رابط با Computer Use
این اپ را در عرضهای موبایل، تبلت و دسکتاپ آزمایش کن. مسیر ثبتنام تا پرداخت را طی کن، برای هر خطا Screenshot و مراحل بازتولید بساز، شدت و اثر را بنویس و هیچ عملیات مالی واقعی انجام نده.
بنچمارکها و ارزیابی عملکرد
جدول زیر از انتشار رسمی Anthropic در ۱ سپتامبر ۲۰۲۶ استخراج شده و Vendor-reported است. مزیت آن، قرار گرفتن چند مدل در یک جدول است؛ محدودیتش این است که نتیجه مستقل همه Benchmarkها در دسترس نیست.
| Benchmark | سنجه | Fable 5.1 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | حل کارهای عاملمحور در Terminal | ۵۵٫۸٪ | ۵۲٫۳٪ | ۳۷٫۳٪ |
| GDPval-AA v2 | کار دانشی و حرفهای | ۱۸۵۳ | ۱۸۲۴ | ۱۷۱۱ |
| OSWorld 2.0، partial | کار با کامپیوتر | ۷۷٫۹٪ | ۷۵٫۴٪ | اعلام نشده |
| Humanity’s Last Exam، بدون ابزار | استدلال چندرشتهای دشوار | ۶۰٫۹٪ | ۵۶٫۶٪ | اعلام نشده |
| AutomationBench | اجرای سرتاسری کارهای تجاری | ۳۱٫۴٪ | ۲۶٫۹٪ | ۱۹٫۶٪ |
| CursorBench 3.2.0 | کدنویسی عاملمحور | ۷۳٫۴٪ | ۷۰٫۰٪ | ۶۷٫۲٪ |
در ارزیابی مستقل Terminal-Bench 4.0، Snapshot بررسیشده در ۱۲ سپتامبر ۲۰۲۶ برای Opus 5 با Claude Code امتیاز ۵۱٫۸٪ ± ۳٫۴ و برای Fable 5.1 امتیاز ۵۷٫۹٪ ± ۳٫۸ ثبت کرده است. این اعداد به نتیجه داخلی Anthropic نزدیکاند، اما یکسان نیستند؛ به همین دلیل جدا گزارش شدهاند.
Opus در GDPval و CursorBench فاصله زیادی با Fable ندارد، در حالی که هزینه توکنی آن نصف است. در Terminal-Bench-Science و AutomationBench فاصله Fable بیشتر میشود؛ بنابراین اگر کار شما پژوهشی، بسیار باز یا طولانی است، Fable مزیت روشنتری دارد. برای کار روزمره سریع، Sonnet ممکن است ارزش بهتری بدهد.
بنچمارکها عملکرد یک ترکیب مدل، Effort، Harness، ابزار و بودجه را میسنجند؛ نه مدل را در خلأ. نتیجه نسخه 4.0 Terminal-Bench را نباید با 2.1 یا اجرای بدون Claude Code مستقیماً مقایسه کرد.
مقایسه Claude Opus 5 با رقبای همرده
| مدل | مناسبترین کاربرد | Context | قیمت ورودی/خروجی برای ۱M توکن |
|---|---|---|---|
| Claude Opus 5 | پروژه پیچیده، Agent و کدنویسی طولانی | ۱M | ۵ / ۲۵ دلار |
| Claude Fable 5.1 | سختترین استدلال و پروژههای بلندمدت | ۱M | ۱۰ / ۵۰ دلار |
| Claude Sonnet 5 | کار روزمره سریع با کیفیت بالا | ۱M | ۲ / ۱۰ دلار |
| GPT-6 Astra | کار Frontier با ابزارهای گسترده OpenAI | ۱٫۰۵M | ۱۰ / ۵۰ دلار |
Opus 5 معمولاً انتخاب متعادل برای تیمی است که کیفیت Frontier میخواهد اما Fable یا Astra را برای همه درخواستها گران میبیند. Fable برای کارهایی مناسب است که Opus در Eval واقعی شما شکست میخورد. Sonnet برای ترافیک تعاملی و مسیرهای کمریسک انتخاب اقتصادیتری است.
قیمت و API
قیمت استاندارد در ۱۲ سپتامبر ۲۰۲۶:
- ورودی: ۵ دلار برای هر یک میلیون توکن
- خروجی: ۲۵ دلار
- Cache Write پنجدقیقهای: ۶٫۲۵ دلار
- Cache Write یکساعته: ۱۰ دلار
- Cache Read: ۰٫۵۰ دلار
- Message Batches API: ۵۰٪ تخفیف روی ورودی و خروجی
- Fast Mode Preview: ۱۰ دلار ورودی و ۵۰ دلار خروجی
شناسه API claude-opus-5 است. هزینه Web Search و برخی ابزارهای Server-side جداگانه محاسبه میشود. محدودیت نرخ، Fast Mode و دسترسی ابری باید در حساب مقصد کنترل شوند.
Claude Opus 5 را در Buffalo147 AI امتحان کنید
برای یک Feature چندمرحلهای، بررسی مخزن، تحلیل فایل یا طراحی Agent، Opus 5 را با معیار پایان روشن امتحان کنید. از مدل بخواهید نتیجه را تست و محدودیتهای باقیمانده را بدون پنهانکاری گزارش کند.
شروع استفاده از Claude Opus 5 در Buffalo147 AI
جمعبندی
Claude Opus 5 یکی از منطقیترین انتخابها برای کار حرفهای سنگین است: استدلال عمیق، Context بزرگ، Vision و Tool Use را با قیمتی نصف Fable 5.1 ترکیب میکند. نتایج Terminal-Bench نشان میدهند در کار عاملمحور به Fable نزدیک است، هرچند مدل بالاتر هنوز در آزمونهای دشوارتر برتری دارد.
نقطه ضعف اصلی، هزینه و پیچیدگی کنترل Thinking و ابزارهاست. برای کارهای سادهتر Sonnet و Haiku مناسبترند. اگر یک معماری مسیریابی دارید، Opus میتواند لایه حل مسائل پیچیده باشد و فقط شکستهای واقعی آن به Fable منتقل شوند.
پرسشهای متداول
Claude Opus 5 چیست؟
مدل حرفهای Anthropic برای استدلال عمیق، کدنویسی عاملمحور، Vision و گردشکارهای سازمانی پیچیده است.
آیا Claude Opus 5 برای برنامهنویسی خوب است؟
بله. رفع باگ ریشهای، Refactor چندفایلی، ساخت تست و کار طولانی با ابزار از کاربردهای اصلی آن هستند.
Opus 5 بهتر است یا Fable 5.1؟
Fable در سختترین کارها سقف بالاتری دارد؛ Opus برای بیشتر پروژههای پیچیده با نصف قیمت توکنی ارزش اقتصادی بهتری ارائه میکند.
آیا Opus 5 وب را جستجو میکند؟
با فعالسازی ابزار Web Search بله. Web Fetch طبق راهنمای مهاجرت این مدل پشتیبانی نمیشود و نباید این دو ابزار را یکی دانست.
آیا Claude Opus 5 تصویر تولید میکند؟
خیر. تصویر را بهعنوان ورودی تحلیل میکند، اما خروجی بومی مدل متن است.
Fast Mode چه تفاوتی دارد؟
همان Opus 5 را با سرعت خروجی بیشتر و قیمت دو برابر ارائه میکند و در زمان نگارش فقط بهصورت Research Preview روی Claude API موجود است.
منابع
- صفحه رسمی Claude Opus 5 در Claude Platform
- قابلیتها و تغییرات Claude Opus 5
- معرفی رسمی Claude Opus 5
- جدول جدید بنچمارک خانواده Claude
- Leaderboard مستقل Terminal-Bench 4.0
- راهنمای انتخاب مدلهای Claude
یادداشت تحریریه Buffalo147 AI: نتیجههای Anthropic، Vendor-reported هستند. نتیجه مستقل Terminal-Bench با عدمقطعیت و تاریخ Snapshot جداگانه ارائه شده است.