مدل Claude Sonnet 5.5 در ۲۸ سپتامبر ۲۰۲۶ منتشر شد و در همان روز نسخهی 2.1.284 کلاد کد آن را به مدل پیشفرض Sonnet روی API تبدیل کرد. قیمت توکنیاش با Sonnet 5 یکی است، اما هر کدی که thinking را روی disabled میگذارد، از این پس خطای 400 میگیرد و باید به between_tools مهاجرت کند. صفحهی مدل رسمی پنج شکست را فهرست میکند که هیچکدام با تعویض نام مدل برطرف نمیشوند. لحظهی خواندن: ۳۰ سپتامبر ۲۰۲۶.
در ۲۸ سپتامبر چه چیزی عوض شد
انتشار Sonnet 5.5 با یک شمارهی نسخه در changelog کلاد کد تلاقی کرد. نسخهی 2.1.284 در تاریخ ۲۸ سپتامبر ۲۰۲۶ منتشر شد و در همان سطر نوشت که claude-sonnet-5-5 بهعنوان مدل پیشفرض Sonnet روی Anthropic API اضافه شده است[2].
سه عدد این سطر را میسازند: کانتکست یک میلیونی، قیمت ۲ دلار برای هر میلیون توکن ورودی و ۱۰ دلار برای خروجی، و ۰٫۲۰ دلار برای هر توکن کشخواندهشده[1]. قیمت با Sonnet 5 یکی است؛ آنچه عوض شده، تعداد توکنی است که هر کار مصرف میکند.
پیامد این بند عملی است. اگر کدتان به مدل قدیمی pin شده بود، بدون انتخاب شما به مدل تازه میرود. نام مدل را عوض نکنید و انتظار نداشته باشید رفتار عوض نشود؛ پنج شکستی که در ادامه میآید دقیقاً از همین انتظار میآیند.
در همان بازه، OpenAI هم GPT-6.1 Sol را معرفی کرد[8] و نسخههای 0.159.0 تا 0.159.2 کدکس را منتشر کرد[7]. آن دو اهمیت دارند، اما هیچکدام رفتار کد شما را بدون انتخاب خودتان عوض نمیکنند.
عددی که تعیین میکند ارتقا ارزش دارد یا نه
یادداشت انتشار Sonnet 5.5 یک جدول امتیاز منتشر کرد که مبنای تصمیم شماست. مهمترین سطر آن Terminal-Bench 4.0 است، ارزیابی کدنویسی ایجنتی در خط فرمان.
| سنجه | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | ۷۰٫۶٪ | ۱۰٫۳٪ | ۶۶٫۴٪ | — |
| CursorBench 4.0 | ۵۵٫۵٪ | ۳۴٫۱٪ | ۵۷٫۸٪ | — |
| GDPval-AA v2.1 | ۱۸۴۴ | ۱۴۴۹ | ۱۸۴۶ | ۱۴۸۷ |
| OSWorld 2.1 | ۸۰٫۱٪ | ۵۷٫۰٪ | ۸۱٫۸٪ | — |
| Chartography | ۶۱٫۶٪ | ۱۵٫۶٪ | ۶۴٫۴٪ | ۵۳٫۶٪ |
رشد سطر اول از تقسیم ۷۰٫۶ بر ۱۰٫۳ به دست میآید و برابر است با ۶٫۸۵ برابر. یعنی Sonnet 5.5 در کدنویسی ایجنتی نزدیک هفت برابر امتیاز نسل قبلش را میگیرد، با همان قیمت توکنی.
دو پانویس این جدول را محدود میکنند، و هر دو از خود شرکت سازنده است. عدد ۶۶٫۴ درصد برای Opus 5.5 در تلاش xhigh ثبت شده، یعنی بالاترین امتیازش.
پانویس دوم به سطر رقیب مربوط است. عدد GPT-6 Sol روی سنجهی نمودارخوانی، بدون ابزار سنجیده شده است. سطرهای دیگر جدول ابزار دارند، پس مقایسهی مستقیم این دو خانه مجاز نیست.
به همین دلیل Opus 5.5 در سطر اول از Sonnet 5.5 جلو نیفتاده است. اختلاف ۴٫۲ درصدی دو مدل روی این سنجه، در برابر ۶٫۸۵ برابر شدن امتیاز نسبت به نسل قبل، عدد کوچکی است.
در قیمت تفاوت هم واقعی است. هر یک میلیون توکن ورودی Sonnet 5.5 دو دلار و Opus 5.5 چهار دلار است؛ برای خروجی ۱۰ در برابر ۲۰ دلار[1]. اگر کارتان در سطح تلاش بالا اجرا میشود، Opus 5.5 امتیاز بیشتری میدهد و دو برابر گرانتر است.
در سمت OpenAI هم GPT-6.1 Sol با قیمت ورودی ۲ دلار و ورودیِ کششدهی ۰٫۱۰ دلار معرفی شد[8]. اگر کدتان همزمان به API هر دو خانواده وصل است، مقایسهی هزینهی کششده بین این دو عدد را از کش پرامپت چطور کار میکند بردارید.
قاعدهی کاربردی این نوشته: خاموش کردن تفکر دیگر با مقدار قدیمی کار نمیکند. آن را به بینابزار تغییر دهید، وگرنه هر درخواست با خطای 400 رد میشود.
پنج چیزی که با تعویض نام مدل درست نمیشوند
تعویض نام مدل تنها یک پنجم کار مهاجرت است. صفحهی مدل رسمی پنج شکست را فهرست میکند که با تعویض شناسه باقی میمانند[4].
نخست، پارامترهای نمونهبرداری خطا میدهند. temperature و top_p و top_k روی Sonnet 4.6 و هر مدل قدیمیتر پذیرفته میشدند. روی Sonnet 5.5 هر مقدار غیرپیشفرض خطای 400 برمیگرداند و باید حذف شود[3].
دوم، متن تفکر بهصورت پیشفرض حذف میشود. بلوکهای thinking با یک امضای خالی میرسند و متن خلاصه در آنها نیست. برای دیدن خلاصه باید display را روی summarized بگذارید، چون این مقدار در مدلهای ۴٫۶ و قدیمیتر پیشفرض بود[3].
سوم، اجبار ابزار خطا میدهد. هر مقدار غیرپیشفرض برای tool_choice که ابزار را اجبار کند روی این مدل پذیرفته نمیشود[4].
چهارم، پیشپرکردن دستیار خطا میدهد. اگر در انتهای گفتگو پیام assistant را خودتان میساختید، آن ساختار باید حذف شود[3].
پنجم، بلوکهای تفکر به مدل و به همان گفتگو گره خوردهاند[4]. یعنی بلوک thinking تولیدشده در یک گفتگو را نمیتوانید به گفتگوی دیگری یا به مدل دیگری ببرید. کدی که این بلوکها را ذخیره و بعداً بازپخش میکند باید آنها را دور بیندازد و از گفتگو تازه بپرسد.
کنار این پنج مورد، یک تغییر رفتار هم هست که خطا نمیدهد: Sonnet 5.5 حدود ۳۰ درصد توکن بیشتری مصرف میکند[3]. قیمت توکن یکی است، پس صورتحساب هر کار بالا میرود. همان صفحه میگوید در آزمایش خودش هزینهی هر کار تا ۳۰ درصد کمتر شده، چون مدل برای همان کار توکن کمتری میسازد. این دو جمله را نگه دارید و روی دادهی خودتان بسنجید.
تنظیمی که باید عوض کنید
روی Sonnet 5 و هر مدل قدیمیتر، خاموش کردن تفکر یعنی thinking روی مقدار disabled. روی Sonnet 5.5 همین مقدار خطای 400 میدهد. متن دقیق خطا را راهنمای رسمی اینطور نوشته است[3]:
"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.
جایگزین، همان درخواست بالا با یک کلید تغییرکرده است. در خط زیر مقدار thinking به between_tools تغییر کرده و بقیهی درخواست دستنخورده مانده است.
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"thinking": {"type": "between_tools"},
"messages": [{
"role": "user",
"content": "Summarize this repository README in five bullet points"
}]
}'
اگر این فراخوانی روی پروژهی شما خطای 400 داد، اولین چیزی که باید بررسی کنید سطح تلاش است. سه محدودیت زیر از خود راهنمای رسمی است و هر سه پیش از هر چیز دیگری شما را غافلگیر میکنند[3].
- با
between_toolsنمیتوان سطح تلاش را میان گفتگو عوض کرد. هر پیام که سطح متفاوتی بفرستد خطای 400 میگیرد. - در سطح
xhighیاmaxاین مقدار خطا میدهد. برای آن دو سطح باید تفکر تطبیقی انتخاب کنید. - این مقدار فقط با سطحهای
lowوmediumوhighکار میکند و هیچ فیلد دیگری همراهش پذیرفته نمیشود؛ از جملهdisplayوbudget_tokens.
اگر میخواهید سطح تلاش را در هر نوبت جداگانه تعیین کنید، راه درست تفکر تطبیقی است: فیلد thinking را حذف کنید یا آن را روی adaptive بگذارید و سطح تلاش را با output_config.effort کنترل کنید[6].
در کلاد کد، مهاجرت را خودش انجام میدهد
اگر کدتان به API مستقیم نمیخورد و داخل کلاد کد کار میکند، لازم نیست این پنج مورد را دستی پیدا کنید. راهنمای رسمی یک دستور کوتاه برای همین کار معرفی میکند[3].
/claude-api migrate this project to claude-sonnet-5-5
این اسکیل نام مدل را عوض میکند و در صورت نیاز پارامترهای شکسته، جایگزینی پیشپرکردن و تنظیم سطح تلاش را هم اعمال میکند. سپس فهرستی از کارهایی که باید دستی بررسی کنید میسازد. پیش از هر ویرایشی، دامنهی کار را از شما میپرسد[3].
دو چیز را این اسکیل برایتان انجام نمیدهد. اگر کلاینت شما Bedrock است یا Claude Platform روی AWS، قالب شناسهی مدل فرق میکند و باید دستی تنظیم شود. و اگر سرور SDK شما هنوز between_tools را نمیشناسد، مثالهای پایتون و تایپاسکریپت از نظر تایپ خطا میدهند؛ در آن حالت یا SDK را بهروز کنید یا مقدار را بهصورت JSON خام بفرستید[3].
قبل از مهاجرت، تکلیف هزینه را روشن کنید. کش پرامپت چطور کار میکند نشان میدهد چرا هزینهی یک کار بیشتر از قیمت توکن است، و توکن، پنجرهی زمینه و حافظه عدد پشت هر صورتحساب را باز میکند.
پس اگر هر جای کدتان مقدار disabled را دارید، آن را امروز عوض کنید. متن تفکر را هم صریح بخواهید، وگرنه با بلوکهای خالی میمانید. صورتحساب را بعد از مهاجرت دوباره اندازه بگیرید، چون حدود ۳۰ درصد توکن بیشتری مصرف میشود.
منابع
- معرفی Claude Sonnet 5.5 — Anthropic، ۲۸ سپتامبر ۲۰۲۶
- Claude Code changelog، نسخهی 2.1.284 — ۲۸ سپتامبر ۲۰۲۶
- راهنمای مهاجرت به Claude Sonnet 5.5 — Anthropic
- صفحهی مدل Claude Sonnet 5.5 — Anthropic
- قیمتگذاری Claude — Anthropic
- کار با تفکر در پاسخها — Anthropic
- Codex CLI changelog، نسخههای 0.159.0 تا 0.159.2 — ۲۹ سپتامبر ۲۰۲۶
- معرفی GPT-6.1 Sol — OpenAI، ۲۹ سپتامبر ۲۰۲۶
دیدگاهها
۰ موردهنوز دیدگاهی ثبت نشده. اولین نفر باشید.