Buffalo147 AI

خانه › بلاگ

Claude Sonnet 5؛ مدل سریع و عامل‌محور Anthropic برای کدنویسی و کار روزمره

نام برجسته Claude Sonnet 5 میان موج‌های متعادل کد و ابزار با نور مسی روی پس‌زمینه تیره

آخرین راستی‌آزمایی: ۱۲ سپتامبر ۲۰۲۶

در یک نگاه | Claude Sonnet 5
تاریخ عرضه: ۳۰ ژوئن ۲۰۲۶
قیمت و شیوهٔ محاسبه: ورودی: ۲ دلار به‌ازای هر یک میلیون توکن؛ خروجی: ۱۰ دلار تعرفه و دسترسی را برای زمان خرید دوباره در منبع رسمیِ مقاله بررسی کنید.

مقدمه

Claude Sonnet 5 برای نقطه‌ای ساخته شده که بسیاری از محصولات واقعی در آن قرار دارند: کیفیت باید بالا باشد، اما سرعت و هزینه نیز اجازه نمی‌دهند هر درخواست با گران‌ترین مدل اجرا شود. این مدل می‌تواند متن و تصویر را بفهمد، کد تولید و اصلاح کند، ابزار فراخوانی کند و یک کار چندمرحله‌ای را تا نتیجه دنبال کند.

Anthropic، Sonnet 5 را «بهترین ترکیب سرعت و هوشمندی» در خانواده فعلی Claude معرفی می‌کند. این توصیف تبلیغاتی به‌تنهایی برای انتخاب کافی نیست؛ اما قیمت ۲ دلار ورودی و ۱۰ دلار خروجی، Context یک‌میلیون‌توکنی و نتایج رسمی نزدیک به Opus 4.8 در چند آزمون، نشان می‌دهند هدف مدل ارائه یک لایه اجرایی عمومی و مقیاس‌پذیر است.

Sonnet 5 جایگزین مستقیم Fable یا Opus در همه سناریوها نیست. در پروژه‌های بسیار مبهم یا چندساعته، مدل‌های بالاتر می‌توانند پایدارتر باشند. در عوض، برای کدنویسی روزمره، تحلیل داده، تولید محتوا، پشتیبانی ابزارمحور و گردش‌کارهای سازمانی با حجم متوسط تا زیاد، این مدل انتخاب جذابی است.

معرفی کامل Claude Sonnet 5

Claude Sonnet 5 در ۳۰ ژوئن ۲۰۲۶ عرضه شد. وضعیت آن در ۱۲ سپتامبر ۲۰۲۶ Active (latest) است و Anthropic بازنشستگی‌اش را زودتر از ۳۰ ژوئن ۲۰۲۷ برنامه‌ریزی نکرده است. شناسه Claude API برابر claude-sonnet-5 است.

شماتیک روند ورودی، مدل و خروجی برای Claude Sonnet 5
نمای شماتیک روند درخواست تا خروجی برای Claude Sonnet 5؛ قابلیت‌های دقیق در متن مقاله آمده‌اند.

این مدل نسل بعدی Sonnet 4.6 محسوب می‌شود. هدف اصلی، نزدیک کردن قابلیت‌های عامل‌محور Sonnet به مدل‌های گران‌تر است: برنامه‌ریزی، کار با Browser و Terminal، کدنویسی چندمرحله‌ای و بررسی نتیجه پیش از تحویل.

Sonnet 5 از طریق Claude API، Amazon Bedrock، Google Cloud، Microsoft Foundry و Claude Platform on AWS در دسترس است. در محصولات مصرف‌کننده Claude نیز وضعیت دسترسی و سهمیه به طرح حساب وابسته است.

قابلیت‌های اصلی

Adaptive Thinking و تنظیم Effort

Thinking در Sonnet 5 به‌طور پیش‌فرض Adaptive است و مدل بر اساس درخواست تصمیم می‌گیرد چقدر استدلال کند. Effort پیش‌فرض در Claude API و Claude Code برابر high است و سطح‌های پایین‌تر می‌توانند هزینه و زمان را کاهش دهند.

Manual Extended Thinking در این نسل حذف شده و ارسال تنظیم قدیمی آن خطای 400 می‌دهد. توسعه‌دهنده باید از Adaptive Thinking و Effort استفاده کند.

کدنویسی و Agentic Workflows

Sonnet 5 می‌تواند Issue را تحلیل کند، فایل‌های مرتبط را پیدا کند، تغییر چندمرحله‌ای انجام دهد و نتیجه تست را دنبال کند. این مدل برای Pair Programming، ساخت Feature، رفع باگ و اتوماسیون توسعه مناسب است؛ به‌ویژه وقتی سرعت تعامل اهمیت دارد.

در کارهای طولانی باید معیار پایان، بودجه ابزار و مرز اختیار روشن باشد. هیچ امتیاز بنچمارکی جای محیط Sandbox، تست بازگشتی و Code Review انسانی را نمی‌گیرد.

Tool Use، Function Calling و Strict Schema

مدل از ابزارهای تعریف‌شده توسط توسعه‌دهنده و ابزارهای پلتفرم Claude پشتیبانی می‌کند. Function Calling برای اتصال به CRM، پایگاه داده، جستجو یا سرویس داخلی کاربرد دارد. حالت Strict می‌تواند ساختار آرگومان فراخوانی را با Schema هماهنگ نگه دارد، اما داده برگشتی همچنان باید از نظر کسب‌وکار اعتبارسنجی شود.

Web Search، Browser Use و Computer Use

در محیط سازگار، Web Search اطلاعات تازه و منبع‌دار را در اختیار مدل می‌گذارد. Sonnet 5 روی Claude API و Google Cloud از Browser Use و نسخه پایدار Computer Use نیز پشتیبانی می‌کند. این ابزارها دسترسی ذاتی مدل نیستند و برنامه میزبان باید آن‌ها را فعال و اجرا کند.

Vision و تحلیل فایل

ورودی متن و تصویر و خروجی متن پشتیبانی می‌شوند. تحلیل Screenshot، نمودار، صفحه PDF و رابط کاربری از کاربردهای مدل است. خروجی مستقیم تصویر، صوت یا ویدیو ندارد.

Context بزرگ و خروجی بلند

Context مدل یک میلیون توکن و حداکثر خروجی عادی ۱۲۸ هزار توکن است. در Message Batches API با Beta Header اعلام‌شده، سقف خروجی ۳۰۰ هزار توکن پشتیبانی می‌شود. استفاده از سقف‌های بزرگ می‌تواند هزینه و زمان قابل‌توجهی ایجاد کند و باید فقط در صورت نیاز واقعی فعال شود.

مهم‌ترین نقاط قوت

  • سرعت بیشتر از Opus و Fable در مقایسه رسمی خانواده
  • قیمت مناسب‌تر برای استفاده مداوم در محصول
  • Context یک‌میلیون‌توکنی و ورودی تصویری
  • توان قابل توجه در کدنویسی، Tool Use و Computer Use
  • Adaptive Thinking و چند سطح Effort برای تنظیم هزینه و کیفیت
  • نتیجه نزدیک به Opus 4.8 در بعضی بنچمارک‌های کار دانشی و عامل‌محور

محدودیت‌ها و نقاط ضعف

Sonnet 5 سقف توان Fable 5.1 یا Opus 5 را ندارد. برای پروژه‌های بسیار طولانی، استدلال علمی دشوار یا خطاهای با هزینه بالا، ابتدا باید در Eval واقعی با مدل‌های بالاتر مقایسه شود.

سه معیار ارزیابی عملی برای Claude Sonnet 5
معیارهای پیشنهادی برای آزمون Claude Sonnet 5 با کار واقعی؛ این تصویر دادهٔ بنچمارک یا امتیاز گزارش‌شده نیست.

این نسل Tokenizer جدیدی دارد؛ Anthropic می‌گوید یک متن مشابه بسته به نوع محتوا می‌تواند حدود ۱٫۰ تا ۱٫۳۵ برابر توکن بیشتری از Sonnet 4.6 تولید کند. بنابراین مقایسه قیمت فقط با نرخ اسمی هر میلیون توکن ممکن است بودجه واقعی مهاجرت را کمتر نشان دهد.

تنظیم غیرپیش‌فرض temperature، top_p یا top_k خطای 400 می‌دهد. Assistant Prefill و Manual Extended Thinking نیز پشتیبانی نمی‌شوند. Priority Tier برای Sonnet 5 موجود نیست.

هرچند مدل می‌تواند Browser یا Computer Use انجام دهد، خطای انتخاب عنصر، تکرار عمل یا دنبال کردن دستور مخرب داخل صفحه ممکن است رخ دهد. دامنه‌ها، مجوزها و اقدام‌های حساس باید محدود شوند.

کاربردهای واقعی Claude Sonnet 5

دستیار کدنویسی روزانه

برای پیاده‌سازی Endpoint، نوشتن تست، Refactor محدود و تحلیل خطای CI، Sonnet سرعت و کیفیت مناسبی دارد و می‌تواند در همان چرخه بازخورد توسعه‌دهنده باقی بماند.

پشتیبانی مشتری متصل به ابزار

مدل می‌تواند سؤال را تشخیص دهد، در پایگاه دانش جستجو کند، وضعیت سفارش را از Function بگیرد و پاسخ منطبق با داده واقعی بسازد. عملیات مالی یا تغییر حساب باید تأیید و ثبت شود.

تحلیل Dashboard و Spreadsheet

با Code Execution و فایل ورودی، Sonnet می‌تواند داده را پاک‌سازی، محاسبات را بررسی و یافته‌ها را به خلاصه مدیریتی تبدیل کند.

عامل مرورگر برای کارهای اداری

در محیط کنترل‌شده، مدل می‌تواند فرم‌ها را تکمیل، اطلاعات را از چند صفحه گردآوری یا مسیر یک نرم‌افزار وب را تست کند. برای CAPTCHA، پرداخت و حذف داده باید توقف تعریف شود.

تولید محتوای متکی بر منبع

ترکیب Web Search و دستور تحریری دقیق، امکان ساخت Brief، مقاله اولیه یا گزارش رقابتی با لینک منبع را فراهم می‌کند؛ ویرایش انسانی برای لحن و صحت نهایی لازم است.

این مدل مناسب چه کسانی است؟

Claude Sonnet 5 برای برنامه‌نویسان، تیم‌های محصول، تولیدکنندگان محتوا، متخصصان مارکتینگ، تحلیلگران داده، واحدهای پشتیبانی و سازندگان SaaS مناسب است که به یک مدل عمومی قوی و نسبتاً سریع نیاز دارند.

برای پردازش بسیار ساده و پرتعداد، Haiku 4.5 یا مدل‌های اقتصادی دیگر هزینه کمتری دارند. برای سخت‌ترین کارهای چندساعته، Opus 5 و Fable 5.1 باید در مجموعه ارزیابی حضور داشته باشند.

مشخصات فنی Claude Sonnet 5

مشخصه مقدار تأییدشده
Developer Anthropic
Model Family Claude Sonnet
Model Type مدل زبانی چندوجهی و استدلالی
Release Date ۳۰ ژوئن ۲۰۲۶
Lifecycle Active (latest)؛ بازنشستگی نه زودتر از ۳۰ ژوئن ۲۰۲۷
API Model ID claude-sonnet-5
Input متن و تصویر
Output متن
Context Window ۱ میلیون توکن
Maximum Output ۱۲۸K؛ در Message Batches Beta تا ۳۰۰K
Reliable Knowledge Cutoff ژانویه ۲۰۲۶
Thinking Adaptive؛ Effort پیش‌فرض high
Vision بله
Audio / Video / Image Generation خروجی بومی ندارد
Tool Use بله
Web Search از طریق ابزار در محیط پشتیبانی‌شده
Browser / Computer Use بله، روی Claude API و Google Cloud طبق مستندات فعلی
API Availability Claude API و پلتفرم‌های ابری اعلام‌شده

۵ نمونه پرامپت کاربردی

۱. پیاده‌سازی Issue با دامنه محدود

این Issue را در همین Repository پیاده‌سازی کن. ابتدا فقط فایل‌های مرتبط و الگوی تست موجود را پیدا کن. کمترین تغییر سازگار را انجام بده، تست بازگشتی اضافه کن و خروجی همه تست‌های مرتبط را گزارش بده. وابستگی جدید یا Refactor نامرتبط انجام نده.

۲. پاسخ پشتیبانی ابزارمحور

ابتدا با ابزار پایگاه دانش فقط اسناد رسمی محصول را بررسی کن، سپس وضعیت حساب را از Function مربوط بخوان. پاسخ کوتاه و همدلانه بده؛ اگر داده کافی نیست یا اقدام مالی لازم است، سؤال مشخص بپرس و کار را به انسان ارجاع بده.

۳. تحلیل داده و گزارش اجرایی

این CSV را اعتبارسنجی کن، ردیف‌های ناقص و داده پرت را جدا نشان بده و سه روند مهم را با محاسبات قابل بازبینی استخراج کن. در پایان یک خلاصه مدیریتی ۱۵۰ کلمه‌ای بنویس و فرضیات را جدا فهرست کن.

۴. تست مسیر وب با Browser Use

مسیر ثبت‌نام تا ساخت اولین پروژه را در محیط تست طی کن. برای هر مانع، URL، مرحله بازتولید، شدت، Screenshot و پیشنهاد اصلاح ثبت کن. پرداخت واقعی، ارسال پیام و حذف داده ممنوع است.

۵. تولید محتوای مستند

با Web Search فقط منابع اولیه ۶ ماه اخیر را پیدا کن. ابتدا Fact Sheet منبع‌دار بساز، سپس بر اساس آن پیش‌نویس مقاله فارسی روان با تیترهای H2 بنویس. هر ادعای نامطمئن را مشخص کن و از نقل‌قول طولانی خودداری کن.

بنچمارک‌ها و ارزیابی عملکرد

جدول زیر بخشی از گزارش عرضه Anthropic در ۳۰ ژوئن ۲۰۲۶ است و Vendor-reported محسوب می‌شود. ستون Opus 4.8 برای نشان دادن فاصله با رده بالاتر همان زمان درج شده است. این نتایج را نباید با نسخه‌های دیگر Terminal-Bench یا Harnessهای متفاوت یکسان دانست.

Benchmark چه چیزی را می‌سنجد؟ Sonnet 5 Sonnet 4.6 Opus 4.8
SWE-bench Pro حل مسائل دشوار مهندسی نرم‌افزار در Repository ۶۳٫۲٪ ۵۸٫۱٪ ۶۹٫۲٪
Terminal-Bench 2.1 اجرای کارهای عامل‌محور در Terminal ۸۰٫۴٪ ۶۷٫۰٪ ۸۲٫۷٪
Humanity’s Last Exam، بدون ابزار استدلال چندرشته‌ای دشوار ۴۳٫۲٪ ۳۴٫۶٪ ۴۹٫۸٪
Humanity’s Last Exam، با ابزار همان آزمون با دسترسی ابزار ۵۷٫۴٪ ۴۶٫۸٪ ۵۷٫۹٪
OSWorld-Verified کار با سیستم‌عامل و رابط گرافیکی ۸۱٫۲٪ ۷۸٫۵٪ ۸۳٫۴٪
GDPval-AA v2 کیفیت کار دانشی و حرفه‌ای ۱۶۱۸ ۱۳۹۵ ۱۶۱۵

Sonnet 5 نسبت به Sonnet 4.6 در تمام ردیف‌های جدول پیشرفت دارد. در GDPval-AA v2 حتی کمی بالاتر از Opus 4.8 ثبت شده و در Terminal-Bench، HLE با ابزار و OSWorld فاصله آن با Opus 4.8 کم است. در SWE-bench Pro و HLE بدون ابزار، مدل رده بالاتر هنوز جلوتر است.

Anthropic در همان صفحه توضیح داده که روش BrowseComp پس از عرضه اصلاح شده تا با روش استاندارد شامل بودجه ۱۰ میلیون توکن، Compaction و Programmatic Tool Calling هماهنگ شود. این اصلاح نمونه مهمی است: عدد Benchmark بدون روش اجرا قابل اعتماد نیست.

در Snapshot فعلی Terminal-Bench 4.0، نسخه Benchmark بسیار سخت‌تر و تازه‌تر است؛ بنابراین امتیاز 2.1 بالا را نباید با نتایج 4.0 مقایسه مستقیم کرد. برای تصمیم محصول، Sonnet 5 را با Prompt، Effort، ابزار، Timeout و بودجه یکسان کنار Opus 5 و مدل اقتصادی‌تر خودتان اجرا کنید.

مقایسه Claude Sonnet 5 با رقبا

مدل نقطه قوت محدودیت نسبی قیمت ورودی/خروجی برای ۱M توکن
Claude Sonnet 5 سرعت و کیفیت مناسب برای کار روزمره و Agent پایین‌تر از Opus/Fable در سخت‌ترین کارها ۲ / ۱۰ دلار
Claude Opus 5 استدلال و کدنویسی طولانی‌تر ۲٫۵ برابر قیمت Sonnet ۵ / ۲۵ دلار
Claude Fable 5.1 بالاترین سقف توان Anthropic کند و ۵ برابر خروجی Sonnet ۱۰ / ۵۰ دلار
GPT-5.6 Terra Context مشابه و اکوسیستم ابزار OpenAI خروجی کمی گران‌تر از Sonnet ۲ / ۱۲ دلار

برای یک SaaS عمومی، Sonnet 5 می‌تواند مدل پیش‌فرض باشد و درخواست‌های دشوار به Opus یا Fable بروند. Terra رقیب قیمتی نزدیکی است و انتخاب میان آن‌ها به کیفیت فارسی، کدنویسی، ابزارهای میزبان و Eval واقعی محصول بستگی دارد؛ نرخ توکن به‌تنهایی تصمیم را مشخص نمی‌کند.

قیمت و API

قیمت دائمی اعلام‌شده و بررسی‌شده در ۱۲ سپتامبر ۲۰۲۶:

  • ورودی: ۲ دلار به‌ازای هر یک میلیون توکن
  • خروجی: ۱۰ دلار
  • Cache Write پنج‌دقیقه‌ای: ۲٫۵۰ دلار
  • Cache Write یک‌ساعته: ۴ دلار
  • Cache Read: ۰٫۲۰ دلار
  • Message Batches API: ۵۰٪ تخفیف روی ورودی و خروجی

قیمت اولیه قرار بود پس از دوره معرفی افزایش یابد، اما Anthropic در ۱۰ اوت ۲۰۲۶ اعلام کرد نرخ ۲/۱۰ دلار دائمی شده است. شناسه API claude-sonnet-5 است. هزینه ابزارهایی مانند Web Search جداگانه محاسبه می‌شود.

Claude Sonnet 5 را در Buffalo147 AI امتحان کنید

برای کدنویسی روزمره، تحلیل فایل، تولید محتوای مستند یا یک گردش‌کار چندمرحله‌ای، Sonnet 5 را با خروجی و معیار موفقیت دقیق آزمایش کنید. اگر درخواست سخت‌تر از توان مدل بود، آن را به Opus یا Fable ارتقا دهید.

شروع استفاده از Claude Sonnet 5 در Buffalo147 AI

جمع‌بندی

مزیت اصلی Claude Sonnet 5 ترکیب سرعت، Context بزرگ، Vision، Tool Use و قیمت مناسب است. بنچمارک‌های عرضه نشان می‌دهند نسبت به Sonnet 4.6 جهش قابل‌توجهی دارد و در بعضی کارهای عامل‌محور به Opus 4.8 نزدیک می‌شود.

محدودیت مهم، سقف پایین‌تر در پروژه‌های بسیار دشوار و چندساعته و همچنین تغییرات ناسازگار API مانند حذف Manual Thinking و Sampling سفارشی است. برای محصولی که بیشتر درخواست‌ها متوسط‌اند و مسیر ارتقا برای موارد سخت دارد، Sonnet 5 یکی از منطقی‌ترین انتخاب‌هاست.

پرسش‌های متداول

Claude Sonnet 5 چیست؟

مدل سریع و چندوجهی Anthropic برای کدنویسی، تحلیل، Vision، کار دانشی و گردش‌کارهای ابزارمحور روزمره است.

آیا Sonnet 5 برای برنامه‌نویسی خوب است؟

بله. در SWE-bench Pro گزارش‌شده توسط Anthropic امتیاز ۶۳٫۲٪ گرفته و برای Issueهای واقعی، تست و کار Terminal طراحی شده است.

Sonnet 5 بهتر است یا Opus 5؟

Opus برای مسائل عمیق و طولانی سقف بالاتری دارد؛ Sonnet سریع‌تر و ارزان‌تر است و برای کار روزانه و مقیاس بالا انتخاب منطقی‌تری محسوب می‌شود.

آیا Claude Sonnet 5 وب را جستجو می‌کند؟

در صورت فعال بودن ابزار Web Search بله. اینترنت زنده بخشی از حافظه داخلی مدل نیست.

آیا Sonnet 5 ورودی تصویر دارد؟

بله، متن و تصویر را می‌پذیرد و پاسخ متنی تولید می‌کند؛ تولید مستقیم تصویر یا ویدیو ندارد.

آیا Claude Sonnet 5 رایگان است؟

API آن مصرفی و پولی است. دسترسی در اپ Claude و محدودیت استفاده به طرح جاری حساب بستگی دارد.

منابع

یادداشت تحریریه Buffalo147 AI: تمام اعداد جدول بنچمارک این مقاله Vendor-reported هستند و همراه نسخه آزمون و تاریخ گزارش ارائه شده‌اند.

خواندنی‌های دیگر