Claude Sonnet 5.5: швидша, дешевша в роботі й майже як Opus
28 вересня 2026 року Anthropic випустила Claude Sonnet 5.5 — середню модель нового покоління 5.5. Ціни лишилися такими ж, як у Sonnet 5, але, за вимірами компанії, відповідь генерується на 30% з гаком швидше, а типове завдання обходиться до 30% дешевше, бо моделі потрібно менше токенів. Найгучніша цифра — Terminal-Bench 4.0: 70,6% проти 10,3% у попередниці. Модель уже працює в застосунках Claude, у Claude Code та через API під ідентифікатором claude-sonnet-5-5.
Для того, хто просто пише Claude в браузері чи на телефоні, головне ось що: відповіді приходять помітно швидше, а якість у робочих задачах (документи, таблиці, презентації, листування) майже дотягує до старшої Opus 5.5. Нижче — цифри, ціни й те, що варто перевірити розробникам перед переходом.
Результати тестів: де Sonnet 5.5 наздогнала Opus
У таблиці, яку Anthropic опублікувала на сторінці анонсу Sonnet 5.5, нова модель обходить Sonnet 5 в усіх восьми випробуваннях. У двох вона майже порівнялася з Opus 5.5, а в Terminal-Bench навіть обійшла її. Бали належать до різних методик і не складаються в загальний рейтинг — порівнювати варто лише в межах одного рядка.
| Випробування | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0, агентне програмування | 70,6% | 10,3% | 66,4% (xhigh) | — |
| FrontierCode 1.1 (Main), агентне програмування | 52,1% (xhigh) / 46,2% (max) | 42,4% | 54,4% | 49,3% |
| CursorBench 4.0, агентне програмування | 55,5% | 34,1% | 57,8% | — |
| GDPval-AA v2.1, робочі задачі (рейтинг) | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1, тривалі робочі задачі (рейтинг) | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam, з інструментами | 64,5% | 54,9% | 67,7% | — |
| OSWorld 2.1, керування комп'ютером | 80,1% | 57,0% | 81,8% | — |
| Chartography, розпізнавання графіків без інструментів | 61,6% | 15,6% | 64,4% | 53,6% |
Terminal-Bench 4.0 перевіряє, як агент виконує багатокрокові завдання в командному рядку. Стрибок з 10,3% до 70,6% — це вже інший клас моделі, а не косметичне оновлення. Opus 5.5 тут отримала 66,4%, і то на рівні зусиль xhigh. Публічного результату GPT-6 Sol для цього тесту немає, тому на графіку «результат проти вартості» Anthropic показує старішу GPT-5.6 Sol.
У GDPval-AA, де оцінюють реальні робочі задачі з 44 професій і дев'яти галузей, Sonnet 5.5 набрала 1844 пункти — на два менше за Opus 5.5 і майже на 400 більше за Sonnet 5. Тут є застереження: цей результат, як і AA-Briefcase, організація Artificial Analysis отримала на попередній версії моделі. Пізніше Anthropic виправила помилку, яка могла погіршувати відповіді зі структурованим виводом. Показники GPT-6 Sol у цих двох тестах і в Chartography, за словами компанії, могли ще не враховувати виправлення розпізнавання зображень у моделі OpenAI. Коли різниця — кілька пунктів, такі деталі важать.

Чому на max результат гірший, ніж на xhigh
Рядок FrontierCode виглядає дивно: 52,1% на рівні зусиль xhigh і лише 46,2% на вищому max. Anthropic пояснює це так: на max модель частіше запускала додаткову перевірку коду, і у двох розібраних випадках це закінчилося перевищенням часу або зайвими змінами, за які методика тесту штрафує. Для порівняння, GPT-6 Sol тут має 49,3%.
Рівень зусиль — це налаштування того, наскільки глибоко модель обробляє запит. Вищий рівень зазвичай означає довшу роботу й більше токенів, але не гарантує кращий результат у кожному тесті. У застосунках Claude і Claude Code за замовчуванням стоїть medium, в Claude API — high.
Ранні тестувальники хвалять не лише цифри. У Base44 на 118 реальних збірках застосунків Sonnet 5.5 вийшла на рівень Opus 5 за 3,6 ітерації замість 7,7. У Unity модель закрила 90% завдань їхнього багатокрокового тесту в Unity Editor. CodeRabbit окремо відзначає, що зникла звичка Sonnet 5 зайвий раз лізти у вебпошук і витрачати забагато токенів.
Ціни не змінилися, але задачі дешевшають
Базові тарифи в Claude API такі ж, як у Sonnet 5:
- 2 $ за мільйон вхідних токенів — усе, що ви надсилаєте моделі: запит, файли, історію розмови.
- 10 $ за мільйон вихідних токенів — текст і код, які модель генерує у відповідь.
- 2,50 $ за мільйон токенів запису в п'ятихвилинний кеш і 0,20 $ за читання з нього — повторно використана частина запиту оплачується окремо й значно дешевше за звичайний вхід.
Мінімальна довжина запиту, який можна покласти в кеш, для Sonnet 5.5 становить 512 токенів. Повні тарифи всіх моделей зведені на сторінці цін Anthropic.
Економія до 30% береться не зі знижки, а з того, що модель робить ту саму роботу меншою кількістю токенів: частіше групує виклики інструментів і проходить менше кроків. За графіками Anthropic, на кількох тестах Sonnet 5.5 на рівні low або medium перевершує найкращий результат Sonnet 5 приблизно за десяту частину вартості задачі. Швидкість і економію компанія міряла на власних навантаженнях, тож у вашому випадку цифри залежатимуть від обсягу запитів, кількості викликів інструментів і обраного рівня зусиль.

Доступність і що перевірити перед переходом із Sonnet 5
Контекстне вікно Sonnet 5.5 — 1 млн токенів, звичайна межа виводу — 128 000 токенів. Згідно з офіційною карткою моделі, вона доступна через Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry та Claude Platform on AWS. Ідентифікатор у Claude API — claude-sonnet-5-5, в Amazon Bedrock — anthropic.claude-sonnet-5-5.
Звичайним користувачам нічого робити не потрібно: модель з'являється у виборі моделей застосунку Claude, а в Claude Code її можна обрати командою /model. Якщо ви працюєте з Claude Code у хмарі, згадайте про кредит до $250 на хмарні сесії Claude Code — швидша модель витрачатиме його повільніше.
А от розробникам готових інтеграцій варто пройтися по посібнику з переходу до того, як міняти назву моделі в коді. Там кілька несумісностей:
- tool_choice. Примусовий виклик інструмента через значення
anyіtoolтепер відхиляється з помилкою, тож логіку «модель зобов'язана викликати функцію» доведеться переписати. - Вимкнення міркувань. Старий спосіб через
disabledтеж повертає помилку. Замість нього є режимbetween_tools, який працює на рівнях зусиль low, medium і high. - Керування комп'ютером. У Claude API та Google Cloud потрібен набір інструментів
computer_toolset_20260801замістьcomputer_20251124. В Amazon Bedrock старий варіант поки лишається. - Блоки thinking. Частина повідомлень між викликами інструментів тепер приходить у блоках thinking. Якщо ваш застосунок показує користувачу хід тривалої задачі, обробку цих блоків, найімовірніше, доведеться змінити.
Ще одна новинка — додаткові обмеження на запити підвищеного ризику у сфері кібербезпеки. За можливостями в цій сфері Sonnet 5.5 порівнянна з Opus 5, тому це перша модель лінійки Sonnet, яка вийшла з такими ж запобіжниками, як у старших моделей. Звичайна розробка й виправлення помилок, за словами Anthropic, під ці обмеження не потрапляють.
Кому переходити вже зараз
Якщо ви користувалися Sonnet 5 для коду, документів чи таблиць — перемикайтеся без вагань: ціна та сама, відповіді швидші, а якість у більшості задач вища. Opus 5.5 за оцінками самої Anthropic і сторонніх тестувальників лишається сильнішою у складних відкритих задачах, де потрібне тривале судження, тож для архітектури великих проєктів її є сенс залишити. Схожу схему описує один із тестувальників: Opus задає архітектуру гри, а Sonnet 5.5 її реалізує.
Конкуренти теж не стоять на місці: Google переводить Gemini на нову систему, про що ми писали в матеріалі Gemini замінить Gems на skills, а для ChatGPT користувачі шукають способи зробити текст живішим, як у випадку з трюком /human. Sonnet 5.5 у цьому змаганні робить ставку на швидкість і ціну задачі.
Наступна модель сімейства, Claude Haiku 5.5, для великих обсягів і чутливих до вартості застосунків, вийде в найближчі тижні — точної дати Anthropic поки не назвала.
Додати коментар