Anthropic офіційно представила Claude Sonnet 5.5 — нову модель сімейства Claude 5.5, орієнтовану на програмування, роботу з документами, аналіз даних та інші повсякденні завдання. За даними компанії, новинка працює більш ніж на 30% швидше за Claude Sonnet 5, а вартість виконання типових завдань може бути до 30% нижчою.
Claude Sonnet 5.5 стала другою моделлю в новому поколінні Claude 5.5 після флагманської Claude Opus 5.5. При цьому Anthropic позиціонує Sonnet не як заміну Opus, а як швидший та економніший варіант для широкого спектра робочих сценаріїв.
Що змінилося в Claude Sonnet 5.5
Головний акцент нової моделі — не лише на максимальній якості відповідей, а й на співвідношенні продуктивності, швидкості та вартості.
Anthropic заявляє про суттєве зростання результатів порівняно з Claude Sonnet 5. Особливо помітний прогрес у програмуванні та роботі з довгими багатокроковими завданнями.
Наприклад, у тесті Terminal-Bench 4.0 нова модель отримала 70,6%, тоді як попередня Claude Sonnet 5 показала лише 10,3%. На CursorBench 4.0 результат зріс із 34,1% до 55,5%.
| Тест | Claude Sonnet 5.5 | Claude Sonnet 5 |
|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 10,3% |
| FrontierCode 1.1 | 46,2% | 42,4% |
| CursorBench 4.0 | 55,5% | 34,1% |
| GDPval-AA v2.1 | 1844 Elo | 1449 Elo |
| OSWorld 2.1 | 80,1% | 57,0% |
| Chartography | 61,6% | 15,6% |
Показники наведені за тестами Anthropic; результати можуть залежати від налаштувань рівня зусиль моделі.
Claude Sonnet 5.5 стала значно сильнішою у програмуванні
Одним із головних напрямків розвитку нової моделі стало AI-програмування.
Claude Sonnet 5.5 краще працює з великими кодовими базами, багатофайловими проєктами та завданнями, де потрібно виконати декілька послідовних дій.
Anthropic також зазначає, що модель ефективніше використовує інструменти. Під час внутрішніх тестів Sonnet 5.5 частіше об’єднувала кілька викликів інструментів, завдяки чому для виконання завдання було потрібно менше кроків.
На CursorBench 4.0 модель отримала 55,5%, наблизившись до показника Claude Opus 5.5 — 57,8%.
Це робить Sonnet 5.5 особливо цікавою для розробників, які використовують AI-агентів у VS Code, Claude Code та інших середовищах програмування.

Реклама
Менше токенів — нижча фактична вартість
Ціна одного мільйона токенів у Claude Sonnet 5.5 залишилася такою ж, як у Sonnet 5:
- $2 за 1 млн вхідних токенів;
- $10 за 1 млн вихідних токенів;
- $0,20 за 1 млн токенів при читанні кешу;
- $2,50 за 1 млн токенів при записі кешу.
Однак Anthropic наголошує, що Sonnet 5.5 часто використовує менше токенів для виконання того самого завдання. У результаті реальна вартість виконання роботи може бути до 30% нижчою, ніж у попереднього покоління.
Для порівняння, Claude Opus 5.5 коштує $4 за 1 млн вхідних токенів і $20 за 1 млн вихідних токенів. Тобто Sonnet 5.5 залишається значно доступнішою моделлю для масових робочих процесів.
Швидкість зросла більш ніж на 30%
Anthropic називає Claude Sonnet 5.5 найшвидшою моделлю Sonnet на момент запуску.
Компанія заявляє, що модель генерує відповіді більш ніж на 30% швидше, ніж Claude Sonnet 5.
Це особливо важливо для інтерактивних сценаріїв — програмування, редагування текстів, створення презентацій, аналізу документів та роботи з AI-агентами.
Користувач також може регулювати рівень зусиль моделі. Нижчі налаштування дозволяють отримувати швидші та дешевші відповіді, тоді як вищі змушують Claude витрачати більше часу на аналіз і перевірку результату.
Модель стала кращою у створенні документів і презентацій
Claude Sonnet 5.5 розрахована не лише на програмістів.
Anthropic повідомляє про покращення в так званій knowledge work — роботі, яка включає аналіз інформації, підготовку документів, презентацій, таблиць та дослідження.
У тесті GDPval-AA v2.1, який оцінює виконання завдань із 44 професійних напрямків, Sonnet 5.5 отримала 1844 Elo. Це майже відповідає показнику Opus 5.5 — 1846 Elo. Для порівняння, Sonnet 5 отримала 1449 Elo.
Anthropic також окремо відзначає покращення у дизайні. Модель краще працює зі структурою інтерфейсів, презентаційними шаблонами та візуальним оформленням матеріалів.
Покращене розуміння зображень
Ще одним напрямком розвитку стала робота з візуальною інформацією.
Sonnet 5.5 демонструє кращі результати у завданнях, де потрібно аналізувати зображення, графіки та інші візуальні дані.
Anthropic навіть наводить незвичайний приклад: нова модель стала першою Sonnet, яка змогла пройти Pokémon Red, використовуючи лише скриншоти гри.
Це демонструє здатність моделі не просто описувати зображення, а використовувати візуальну інформацію для виконання довгих послідовностей дій.
Claude Sonnet 5.5 у реальних продуктах
Anthropic вже протестувала нову модель разом із низкою технологічних компаній.
Наприклад, Slack повідомив про покращення результатів внутрішніх тестів і приблизно на 14% менше вихідних токенів порівняно із Sonnet 5.
У Zendesk під час тестування сотень реальних сценаріїв підтримки Sonnet 5.5 швидше обробляла звернення.
Команда Lovable заявила про приблизно на третину меншу кількість викликів інструментів під час програмування та приблизно вдвічі менше запусків shell-команд.
Anthropic також зазначає результати тестів із Unity, де Sonnet 5.5 виконала 90% завдань у багатокроковому бенчмарку Unity Editor та програмування.
Безпека Claude Sonnet 5.5
Разом зі збільшенням можливостей Anthropic посилила захисні механізми моделі.
Компанія заявляє, що Sonnet 5.5 покращила або зберегла показники попередньої моделі в більшості внутрішніх тестів на відповідність правилам безпеки та стійкість до зловживань.
Окрему увагу приділили кібербезпеці. Через суттєве зростання можливостей у цій сфері Sonnet 5.5 запускається із захисними механізмами, подібними до тих, що використовуються для потужніших моделей Anthropic.
При цьому звичайна розробка програмного забезпечення та пошук помилок у власному коді не повинні блокуватися цими обмеженнями.
Коли можна використовувати Claude Sonnet 5.5
Claude Sonnet 5.5 вже доступна на основних платформах Anthropic, а також через Amazon Web Services, Google Cloud та Microsoft Azure.
Для розробників модель доступна через Claude Platform під ідентифікатором:
claude-sonnet-5-5
Anthropic також заявила про підтримку режиму Zero Data Retention.
Sonnet 5.5 чи Opus 5.5?
Anthropic фактично розділяє ці моделі за сценаріями використання.
Claude Opus 5.5 орієнтована на найбільш складні та відкриті завдання, де потрібні тривале планування, глибокий аналіз і складне прийняття рішень.
Claude Sonnet 5.5 робить ставку на швидкість та ефективність. Вона призначена для програмування, редагування документів, створення презентацій, аналізу даних та інших завдань, які виконуються регулярно.
Тобто Sonnet 5.5 можна розглядати як більш доступний робочий інструмент для щоденного використання, тоді як Opus 5.5 залишається орієнтованою на найскладніші сценарії.
Що далі?
Claude Sonnet 5.5 стала другою моделлю покоління Claude 5.5. Anthropic також повідомила, що Claude Haiku 5.5 приєднається до сімейства протягом найближчих тижнів.
Таким чином, компанія поступово формує нову лінійку моделей із різним балансом між продуктивністю, швидкістю та ціною.
Висновок
Claude Sonnet 5.5 — це суттєве оновлення порівняно із Sonnet 5, особливо для програмування та багатокрокових робочих процесів.
За даними Anthropic, модель не тільки показує значно вищі результати в низці тестів, але й використовує менше токенів для виконання завдань та генерує відповіді більш ніж на 30% швидше.
Особливо цікаво виглядає поєднання 70,6% у Terminal-Bench 4.0, 55,5% у CursorBench 4.0 та 1844 Elo у GDPval-AA. Водночас самі результати бенчмарків не відображають усіх відмінностей між моделями: Anthropic прямо зазначає, що Opus 5.5 залишається сильнішою для складної відкритої роботи, яка потребує тривалого міркування та суджень.
Для розробників та команд, які регулярно використовують AI у роботі, головною особливістю Sonnet 5.5 може стати не просто збільшення продуктивності, а можливість отримувати більше результату за той самий бюджет.
Поширені питання про Штучний інтелект
Хто такі Anthropic?
Anthropic — це американська компанія з безпеки та досліджень у сфері штучного інтелекту, заснована колишніми членами OpenAI, яка розробила AI-помічника Claude.
Які основні технології розробляє Anthropic?
Anthropic відома розробкою сімейства моделей Claude та розробкою методології "Конституційного ШІ" (Constitutional AI) для підвищення безпеки нейромереж.
Чому моделі Anthropic вважаються безпечними?
Моделі Anthropic проходять навчання за конституційним методом, де ШІ дотримується заздалегідь визначених етичних принципів, що мінімізує шкідливі або неправдиві відповіді.

