Вийшов Claude Sonnet 5.5
28 вересня 2026 року Anthropic випустила Claude Sonnet 5.5, другу модель родини 5.5. За її даними, вона працює швидше за Sonnet 5 більш ніж на 30% і коштує за завдання до 30% менше, а список цін лишився $2 і $10 за мільйон вхідних і вихідних токенів. Це перша модель Sonnet із кіберзапобіжниками й резервними моделями та із класифікаторами проти вилучення міркувань.
Чому це важливо
Середній за ціною ярус дістає ті самі зміни ефективності й запобіжників, що верхній, через шість днів після Opus 5.5. Стрибок, який Anthropic наводить в одному тесті агентного кодування (з 10,3% до 70,6%), дуже великий; у тій самій таблиці Opus 5.5 має 66,4%, і сторінка цього порядку не коментує.
Власні показники Anthropic. Terminal-Bench 4.0: Sonnet 5.5 — 70,6%, Sonnet 5 — 10,3%, Opus 5.5 — 66,4% (на рівні xhigh, найвищий його результат). GDPval-AA v2.1: 1844 проти 1846 в Opus 5.5 і 1449 у Sonnet 5; Artificial Analysis проганяла його на передрелізному розгортанні з помилкою у структурованих виводах, яка, за сторінкою, могла погіршити відповіді і вже виправлена. FrontierCode 1.1: 46,2% на рівні Max, нижче, ніж на Xhigh; примітка пояснює це тим, що на Max модель частіше запускала навичку рецензування коду, яка ділить роботу між субагентами, і в двох випадках, які розглянула Cognition, це призвело до тайм-ауту або зайвих правок. OSWorld 2.1 (часткова оцінка): 80,1% проти 57,0% у Sonnet 5. Модель, за словами компанії, перша в лінійці Sonnet, що пройшла Pokémon Red лише за скриншотами. Ціна й швидкість. $2 / $10 за мільйон токенів і $0,20 за читання кешу; вихід швидший більш ніж на 30%; у Claude Code і застосунках за замовчуванням середній рівень зусиль. Доступна на Claude API як claude-sonnet-5-5 і на великих хмарах. Дата запуску — 28 вересня за приміткою до випуску API. Запобіжники. Кіберможливості Sonnet 5.5 близькі до Opus 5, тож вона перша серед Sonnet отримала кіберзапобіжники: складніші кіберзавдання помітно переходять на Sonnet 5; біологічні запобіжники як у Sonnet 5; Cyber Verification Program обіцяно розширити. Вона також перша з Sonnet із класифікаторами проти вилучення міркувань і розширеним «збереженим мисленням». Anthropic каже, що Opus 5.5 лишається помітно сильнішою у відкритій роботі, що потребує тривалого судження. Чого запис не стверджує. Усі цифри — власні вимірювання Anthropic і її партнерів-оцінювачів; незалежного повторення не прочитано. Haiku 5.5 обіцяно «найближчими тижнями»; його випуск у цей запис не входить.