مدل Claude Sonnet 5.5 در ۲۸ سپتامبر ۲۰۲۶ منتشر شد و در همان روز نسخه‌ی 2.1.284 کلاد کد آن را به مدل پیش‌فرض Sonnet روی API تبدیل کرد. قیمت توکنی‌اش با Sonnet 5 یکی است، اما هر کدی که thinking را روی disabled می‌گذارد، از این پس خطای 400 می‌گیرد و باید به between_tools مهاجرت کند. صفحه‌ی مدل رسمی پنج شکست را فهرست می‌کند که هیچ‌کدام با تعویض نام مدل برطرف نمی‌شوند. لحظه‌ی خواندن: ۳۰ سپتامبر ۲۰۲۶.

در ۲۸ سپتامبر چه چیزی عوض شد

انتشار Sonnet 5.5 با یک شماره‌ی نسخه در changelog کلاد کد تلاقی کرد. نسخه‌ی 2.1.284 در تاریخ ۲۸ سپتامبر ۲۰۲۶ منتشر شد و در همان سطر نوشت که claude-sonnet-5-5 به‌عنوان مدل پیش‌فرض Sonnet روی Anthropic API اضافه شده است[2].

سه عدد این سطر را می‌سازند: کانتکست یک میلیونی، قیمت ۲ دلار برای هر میلیون توکن ورودی و ۱۰ دلار برای خروجی، و ۰٫۲۰ دلار برای هر توکن کش‌خوانده‌شده[1]. قیمت با Sonnet 5 یکی است؛ آنچه عوض شده، تعداد توکنی است که هر کار مصرف می‌کند.

پیامد این بند عملی است. اگر کدتان به مدل قدیمی pin شده بود، بدون انتخاب شما به مدل تازه می‌رود. نام مدل را عوض نکنید و انتظار نداشته باشید رفتار عوض نشود؛ پنج شکستی که در ادامه می‌آید دقیقاً از همین انتظار می‌آیند.

در همان بازه، OpenAI هم GPT-6.1 Sol را معرفی کرد[8] و نسخه‌های 0.159.0 تا 0.159.2 کدکس را منتشر کرد[7]. آن دو اهمیت دارند، اما هیچ‌کدام رفتار کد شما را بدون انتخاب خودتان عوض نمی‌کنند.

عددی که تعیین می‌کند ارتقا ارزش دارد یا نه

یادداشت انتشار Sonnet 5.5 یک جدول امتیاز منتشر کرد که مبنای تصمیم شماست. مهم‌ترین سطر آن Terminal-Bench 4.0 است، ارزیابی کدنویسی ایجنتی در خط فرمان.

سنجهSonnet 5.5Sonnet 5Opus 5.5GPT-6 Sol
Terminal-Bench 4.0۷۰٫۶٪۱۰٫۳٪۶۶٫۴٪—
CursorBench 4.0۵۵٫۵٪۳۴٫۱٪۵۷٫۸٪—
GDPval-AA v2.1۱۸۴۴۱۴۴۹۱۸۴۶۱۴۸۷
OSWorld 2.1۸۰٫۱٪۵۷٫۰٪۸۱٫۸٪—
Chartography۶۱٫۶٪۱۵٫۶٪۶۴٫۴٪۵۳٫۶٪

رشد سطر اول از تقسیم ۷۰٫۶ بر ۱۰٫۳ به دست می‌آید و برابر است با ۶٫۸۵ برابر. یعنی Sonnet 5.5 در کدنویسی ایجنتی نزدیک هفت برابر امتیاز نسل قبلش را می‌گیرد، با همان قیمت توکنی.

دو پانویس این جدول را محدود می‌کنند، و هر دو از خود شرکت سازنده است. عدد ۶۶٫۴ درصد برای Opus 5.5 در تلاش xhigh ثبت شده، یعنی بالاترین امتیازش.

پانویس دوم به سطر رقیب مربوط است. عدد GPT-6 Sol روی سنجه‌ی نمودارخوانی، بدون ابزار سنجیده شده است. سطرهای دیگر جدول ابزار دارند، پس مقایسه‌ی مستقیم این دو خانه مجاز نیست.

به همین دلیل Opus 5.5 در سطر اول از Sonnet 5.5 جلو نیفتاده است. اختلاف ۴٫۲ درصدی دو مدل روی این سنجه، در برابر ۶٫۸۵ برابر شدن امتیاز نسبت به نسل قبل، عدد کوچکی است.

در قیمت تفاوت هم واقعی است. هر یک میلیون توکن ورودی Sonnet 5.5 دو دلار و Opus 5.5 چهار دلار است؛ برای خروجی ۱۰ در برابر ۲۰ دلار[1]. اگر کارتان در سطح تلاش بالا اجرا می‌شود، Opus 5.5 امتیاز بیشتری می‌دهد و دو برابر گران‌تر است.

در سمت OpenAI هم GPT-6.1 Sol با قیمت ورودی ۲ دلار و ورودیِ کش‌شده‌ی ۰٫۱۰ دلار معرفی شد[8]. اگر کدتان هم‌زمان به API هر دو خانواده وصل است، مقایسه‌ی هزینه‌ی کش‌شده بین این دو عدد را از کش پرامپت چطور کار می‌کند بردارید.

قاعده‌ی کاربردی این نوشته: خاموش کردن تفکر دیگر با مقدار قدیمی کار نمی‌کند. آن را به بین‌ابزار تغییر دهید، وگرنه هر درخواست با خطای 400 رد می‌شود.

پنج چیزی که با تعویض نام مدل درست نمی‌شوند

تعویض نام مدل تنها یک پنجم کار مهاجرت است. صفحه‌ی مدل رسمی پنج شکست را فهرست می‌کند که با تعویض شناسه باقی می‌مانند[4].

نخست، پارامترهای نمونه‌برداری خطا می‌دهند. temperature و top_p و top_k روی Sonnet 4.6 و هر مدل قدیمی‌تر پذیرفته می‌شدند. روی Sonnet 5.5 هر مقدار غیرپیش‌فرض خطای 400 برمی‌گرداند و باید حذف شود[3].

دوم، متن تفکر به‌صورت پیش‌فرض حذف می‌شود. بلوک‌های thinking با یک امضای خالی می‌رسند و متن خلاصه در آن‌ها نیست. برای دیدن خلاصه باید display را روی summarized بگذارید، چون این مقدار در مدل‌های ۴٫۶ و قدیمی‌تر پیش‌فرض بود[3].

سوم، اجبار ابزار خطا می‌دهد. هر مقدار غیرپیش‌فرض برای tool_choice که ابزار را اجبار کند روی این مدل پذیرفته نمی‌شود[4].

چهارم، پیش‌پرکردن دستیار خطا می‌دهد. اگر در انتهای گفتگو پیام assistant را خودتان می‌ساختید، آن ساختار باید حذف شود[3].

پنجم، بلوک‌های تفکر به مدل و به همان گفتگو گره خورده‌اند[4]. یعنی بلوک thinking تولیدشده در یک گفتگو را نمی‌توانید به گفتگوی دیگری یا به مدل دیگری ببرید. کدی که این بلوک‌ها را ذخیره و بعداً بازپخش می‌کند باید آن‌ها را دور بیندازد و از گفتگو تازه بپرسد.

کنار این پنج مورد، یک تغییر رفتار هم هست که خطا نمی‌دهد: Sonnet 5.5 حدود ۳۰ درصد توکن بیشتری مصرف می‌کند[3]. قیمت توکن یکی است، پس صورتحساب هر کار بالا می‌رود. همان صفحه می‌گوید در آزمایش خودش هزینه‌ی هر کار تا ۳۰ درصد کمتر شده، چون مدل برای همان کار توکن کمتری می‌سازد. این دو جمله را نگه دارید و روی داده‌ی خودتان بسنجید.

تنظیمی که باید عوض کنید

روی Sonnet 5 و هر مدل قدیمی‌تر، خاموش کردن تفکر یعنی thinking روی مقدار disabled. روی Sonnet 5.5 همین مقدار خطای 400 می‌دهد. متن دقیق خطا را راهنمای رسمی این‌طور نوشته است[3]:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

جایگزین، همان درخواست بالا با یک کلید تغییرکرده است. در خط زیر مقدار thinking به between_tools تغییر کرده و بقیه‌ی درخواست دست‌نخورده مانده است.

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-sonnet-5-5",
    "max_tokens": 4096,
    "thinking": {"type": "between_tools"},
    "messages": [{
      "role": "user",
      "content": "Summarize this repository README in five bullet points"
    }]
  }'

اگر این فراخوانی روی پروژه‌ی شما خطای 400 داد، اولین چیزی که باید بررسی کنید سطح تلاش است. سه محدودیت زیر از خود راهنمای رسمی است و هر سه پیش از هر چیز دیگری شما را غافلگیر می‌کنند[3].

  1. با between_tools نمی‌توان سطح تلاش را میان گفتگو عوض کرد. هر پیام که سطح متفاوتی بفرستد خطای 400 می‌گیرد.
  2. در سطح xhigh یا max این مقدار خطا می‌دهد. برای آن دو سطح باید تفکر تطبیقی انتخاب کنید.
  3. این مقدار فقط با سطح‌های low و medium و high کار می‌کند و هیچ فیلد دیگری همراهش پذیرفته نمی‌شود؛ از جمله display و budget_tokens.

اگر می‌خواهید سطح تلاش را در هر نوبت جداگانه تعیین کنید، راه درست تفکر تطبیقی است: فیلد thinking را حذف کنید یا آن را روی adaptive بگذارید و سطح تلاش را با output_config.effort کنترل کنید[6].

در کلاد کد، مهاجرت را خودش انجام می‌دهد

اگر کدتان به API مستقیم نمی‌خورد و داخل کلاد کد کار می‌کند، لازم نیست این پنج مورد را دستی پیدا کنید. راهنمای رسمی یک دستور کوتاه برای همین کار معرفی می‌کند[3].

/claude-api migrate this project to claude-sonnet-5-5

این اسکیل نام مدل را عوض می‌کند و در صورت نیاز پارامترهای شکسته، جایگزینی پیش‌پرکردن و تنظیم سطح تلاش را هم اعمال می‌کند. سپس فهرستی از کارهایی که باید دستی بررسی کنید می‌سازد. پیش از هر ویرایشی، دامنه‌ی کار را از شما می‌پرسد[3].

دو چیز را این اسکیل برایتان انجام نمی‌دهد. اگر کلاینت شما Bedrock است یا Claude Platform روی AWS، قالب شناسه‌ی مدل فرق می‌کند و باید دستی تنظیم شود. و اگر سرور SDK شما هنوز between_tools را نمی‌شناسد، مثال‌های پایتون و تایپ‌اسکریپت از نظر تایپ خطا می‌دهند؛ در آن حالت یا SDK را به‌روز کنید یا مقدار را به‌صورت JSON خام بفرستید[3].

قبل از مهاجرت، تکلیف هزینه را روشن کنید. کش پرامپت چطور کار می‌کند نشان می‌دهد چرا هزینه‌ی یک کار بیشتر از قیمت توکن است، و توکن، پنجره‌ی زمینه و حافظه عدد پشت هر صورتحساب را باز می‌کند.

پس اگر هر جای کدتان مقدار disabled را دارید، آن را امروز عوض کنید. متن تفکر را هم صریح بخواهید، وگرنه با بلوک‌های خالی می‌مانید. صورتحساب را بعد از مهاجرت دوباره اندازه بگیرید، چون حدود ۳۰ درصد توکن بیشتری مصرف می‌شود.

منابع

  1. معرفی Claude Sonnet 5.5 — Anthropic، ۲۸ سپتامبر ۲۰۲۶
  2. Claude Code changelog، نسخه‌ی 2.1.284 — ۲۸ سپتامبر ۲۰۲۶
  3. راهنمای مهاجرت به Claude Sonnet 5.5 — Anthropic
  4. صفحه‌ی مدل Claude Sonnet 5.5 — Anthropic
  5. قیمت‌گذاری Claude — Anthropic
  6. کار با تفکر در پاسخ‌ها — Anthropic
  7. Codex CLI changelog، نسخه‌های 0.159.0 تا 0.159.2 — ۲۹ سپتامبر ۲۰۲۶
  8. معرفی GPT-6.1 Sol — OpenAI، ۲۹ سپتامبر ۲۰۲۶