вологість:
тиск:
вітер:
Anthropic представила Claude Sonnet 5.5: модель стала швидшою і дешевшою на 30%
Компанія Anthropic представила Claude Sonnet 5.5 — другу модель у сімействі Claude 5.5 після Opus . Вона генерує відповіді більш ніж на 30% швидше за Sonnet 5 і може виконувати завдання до 30% дешевше. Як повідомляють розробники, модель уже доступна на платформах Anthropic, Amazon Web Services, Google Cloud і Microsoft Azure.
Переваги Sonnet 5.5
Anthropic позиціює Sonnet 5.5 як швидшу та економнішу альтернативу Claude Opus 5.5. Якщо Opus 5.5 розрахована на складну роботу, що потребує тривалого аналізу та ухвалення рішень, Sonnet 5.5 орієнтована на програмування, виправлення помилок, створення документів, презентацій і електронних таблиць.
За даними Anthropic, у тесті Terminal-Bench 4.0, який оцінює здатність ШІ-агентів виконувати складні завдання в командному рядку, Sonnet 5.5 набрала 70,6% проти 10,3% у Sonnet 5. У тесті GDPval-AA, що перевіряє виконання реальних професійних завдань, нова модель лише на два пункти поступилася Opus 5.5.
Sonnet 5.5 також краще справляється із завданнями, що потребують довгострокового планування, та розпізнавання зображень. Вона стала першою моделлю серії Sonnet, яка змогла пройти Pokémon Red, використовуючи лише скриншоти гри.
Продуктивність у програмуванні
Найпомітніше зростання можливостей Sonnet 5.5 Anthropic зафіксувала у програмуванні. У тесті FrontierCode з високим рівнем обчислювальних зусиль модель отримала на 10 балів більше за Sonnet 5 за тих самих умов, тоді як виконання завдання коштувало приблизно у 15 разів дешевше.
У CursorBench, де моделі перевіряють на завданнях із реальних сеансів програмування в середовищі Cursor, найкращий результат Sonnet 5.5 відрізняється від показника Opus 5.5 лише на два бали. Перші тестувальники також відзначили, що модель швидше освоює кодову базу та частіше групує виклики інструментів, що скорочує кількість необхідних кроків.
Інтелектуальна робота та дизайн
Sonnet 5.5 також показала покращення в широкому спектрі професійних завдань. У GDPval-AA, який охоплює 44 професії та дев’ять основних галузей, вона набрала 1844 бали проти 1449 у Sonnet 5 та майже зрівнялася з Opus 5.5, яка отримала 1846.
У тестах на використання комп’ютера та розпізнавання графіків Sonnet 5.5 також наблизилася до Opus 5.5. Водночас Anthropic наголошує, що за складної відкритої роботи, яка потребує постійного ухвалення рішень, Opus 5.5 залишається сильнішою.
Перші тестувальники окремо відзначили здатність Sonnet 5.5 працювати з дизайном. За їхніми словами, модель створює більш завершені інтерфейси та презентації, які потребують мінімального редагування.
Вартість і швидкість
Ціна Sonnet 5.5 за мільйон токенів така сама, як у Sonnet 5: $2 за вхідні токени, $10 за вихідні та $0,20 за зчитування з кешу. Водночас нова модель зазвичай використовує менше токенів для виконання того самого завдання, тому його загальна вартість може бути до 30% нижчою.
Для порівняння, Opus 5.5 коштує $4 за мільйон вхідних токенів, $20 за мільйон вихідних і $0,20 за мільйон токенів при зчитуванні з кешу. Запис у кеш коштує $2,50 для Sonnet 5.5 та $5 для Opus 5.5.
Sonnet 5.5 також генерує результати більш ніж на 30% швидше за Sonnet 5. Рівень обчислювальних зусиль дозволяє балансувати між швидкістю, вартістю та якістю: нижчі налаштування підходять для рутинних завдань, а вищі дають моделі більше часу на аналіз і перевірку результату.
Безпека моделі
Під час автоматизованого поведінкового аудиту приблизно 1850 сценаріїв Sonnet 5.5 показала кращі або такі самі результати, як Sonnet 5, за більшістю критеріїв узгодженості, стійкості до зловживань та чесності. Anthropic також заявила, що не виявила ознак того, що нова модель переслідує цілі, які суперечать намірам користувача.
Водночас компанія зазначає, що жоден набір тестів не здатен виявити всі можливі проблеми поведінки моделі. Під час тестів на вихід за межі ізольованого середовища Sonnet 5.5 наблизилася до показників Opus 5.5, яка продемонструвала найкращий результат серед протестованих Anthropic моделей.
Через покращення кіберможливостей Sonnet 5.5 запускається із захисними механізмами, подібними до тих, що використовуються в Opus 5.5. Звичайне програмування та пошук помилок залишаються доступними, тоді як завдання з кібербезпеки, які мають вищий рівень ризику, автоматично перемикатимуться на Sonnet 5.
Anthropic також додала до Sonnet 5.5 захист від атак методом дистиляції, коли зловмисники використовують велику кількість фейкових акаунтів для відтворення можливостей моделі. Це перша модель Sonnet, запущена з класифікаторами, які мають запобігати вилученню даних про процес міркування моделі.
Захист від несанкціонованої дистиляції з'явився після того, як у червні 2026 року Anthropic звинуватила китайську корпорацію Alibaba в організації масштабної крадіжки інтелектуальної власності. Тоді розробники заявили, що китайський гігант через мережу з майже 25 тисяч фіктивних акаунтів згенерував близько 29 мільйонів запитів до моделі Claude, аби в обхід санкцій скопіювати алгоритми складного міркування та програмування для навчання власних китайських ШІ-систем.
Джерело: zn.ua (Технології)
Новини рубріки
Втрата контролю над ШІ призведе до вимирання людства: попередження OpenAI, Anthropic і Meta
29 вересня 2026 р. 08:46
iPhone 18 Pro Max і Pixel 11 Pro XL за 1299 доларів: порівняли швидкість, камеру і батарею
29 вересня 2026 р. 07:10
Мікроби можуть вижити на крижаному супутнику Сатурна: вчені вважають, що зможуть їх знайти
29 вересня 2026 р. 06:15