Представьте офис, где работают два опытных человека. Первая — партнёр, которую зовут на встречу, когда дело необычное и ставки высоки. Второй — коллега, который разбирает недельную гору дел — сорок писем, три таблицы, презентацию к четвергу — быстро и аккуратно.
Второй человек большинству из нас нужен гораздо чаще первого. Claude Sonnet 5.5 — именно такой коллега.
Anthropic выпустила её 28 сентября 2026 года, через неделю после Claude Opus 5.5, — второй моделью семейства Claude 5.5. Она задумана как повседневное дополнение к Opus. По формулировке Anthropic, Opus создана для сложной работы, требующей тщательного суждения, а Sonnet 5.5 сильнее всего в чётко поставленных повседневных задачах, исправлении ошибок и создании аккуратно оформленных документов, презентаций и таблиц.
Насколько она близка к Opus?
Ближе, чем можно было бы ожидать, — по крайней мере, в независимых тестах.
У Artificial Analysis есть два теста, построенных вокруг готовой профессиональной работы, а не вопросов из викторины. В GDPval-AA v2.1 модели выдают реальные результаты — финансовую модель, юридическую записку, аналитическую справку, — и эти результаты сравниваются попарно, как шахматные партии. Sonnet 5.5 набрала 1844 Elo. У Opus 5.5 — 1846: разница слишком мала, чтобы иметь значение. В более новом AA-Briefcase, где проверяется длительная многошаговая интеллектуальная работа, у неё 1811 против 1822 у Opus.
Самая широкая независимая мера — Intelligence Index от Artificial Analysis, сводная оценка по набору сложных тестов. На уровне max Sonnet 5.5 набрала 56 баллов — впереди только Opus 5.5 с 58.
Для модели Sonnet это огромный шаг. Её предшественница Sonnet 5 набирала в GDPval-AA 1449. На практике это значит, что офисную работу, для которой раньше требовался флагман, теперь можно отдать более дешёвой и быстрой модели.
Где Opus по-прежнему впереди
Есть две области, где разрыв реален.
Факты. Тест AA-Omniscience от Artificial Analysis задаёт тысячи вопросов на знание фактов. Sonnet 5.5 верно ответила на 54 %, Opus 5.5 — на 66 %. Модель поменьше просто хранит меньше знаний. Но есть и светлая сторона: когда Sonnet 5.5 не знала ответа, она выдумывала его в 47 % случаев, а Opus 5.5 — в 59 %. Она знает меньше, зато охотнее в этом признаётся. И всё же, если нужна малоизвестная дата, имя или статистика, попросите её поискать в интернете или привести источник.
Суждение. Здесь Anthropic необычно откровенна. В ряде тестов Sonnet 5.5 на уровне max показывает результаты, сопоставимые с Opus 5.5. Но и во внутренних тестах Anthropic, и у внешних тестировщиков Opus 5.5 остаётся заметно сильнее в сложной, открытой работе, требующей длительного взвешенного суждения. Если у вопроса нет очевидных рамок — стратегическое решение, договор с необычными условиями, — это по-прежнему территория Opus.
В чём она хороша
Anthropic выделяет документы, пересказы, таблицы и презентации и отмечает у модели хорошее чувство дизайна: она может следовать шаблону слайдов так точно, что править почти ничего не приходится. Чтение графиков заметно улучшилось. В тесте Chartography от Anthropic, где модели считывают значения с графиков без вспомогательных инструментов, она набрала 61,6 %, тогда как Sonnet 5 — 15,6 %.
Кроме того, она быстрая. Anthropic утверждает, что ответ приходит более чем на 30 % быстрее, чем у Sonnet 5, и первые тестировщики это заметили: Zendesk сообщает, что обращения в поддержку обрабатывались на 20 % быстрее, а Box намерила скорость в 2,4 раза выше, чем у предыдущей версии.
Умеет она и управлять компьютером. В OSWorld 2.1, где модель кликает и печатает, пробираясь через настоящие настольные программы, Anthropic сообщает о 80,1 % с частичным зачётом — близко к 81,8 % у Opus 5.5.
Оставьте регулятор посередине
У Sonnet 5.5 пять уровней усилий: low, medium, high, xhigh и max. В приложениях Claude по умолчанию стоит medium. Вот что Artificial Analysis намерила на каждом уровне:
| Усилия | Intelligence Index | Стоимость задачи |
|---|---|---|
| Low | 36 | 0,41 $ |
| Medium | 41 | 0,59 $ |
| High | 47 | 1,08 $ |
| Xhigh | 52 | 2,74 $ |
| Max | 56 | 7,60 $ |
Дорого обходится именно последняя ступенька. На max Sonnet 5.5 писала около 193 000 выходных токенов на задачу — рекорд за всю историю замеров Artificial Analysis и примерно на 60 % больше, чем у Opus 5.5 на max. Для большинства пользователей приложения Claude это просто означает более долгое ожидание. Для разработчиков, которые платят за токены, — что Sonnet, выкрученная на максимум, уже не дешёвый вариант. Если задаче нужно столько размышлений, обычно она заслуживает Opus.
Честная оговорка
Никаких картинок. Claude хорошо читает скриншоты, графики и отсканированные PDF, но не создаёт изображения, аудио или видео. Если нужно одно приложение, которое ещё и рисует и разговаривает, ChatGPT и Gemini шире.
Цена токена — не цена задачи. Токены стоят столько же, сколько у Sonnet 5: 2 доллара за миллион входных и 10 долларов за миллион выходных. Anthropic утверждает, что типичные задачи обходятся до 30 % дешевле, потому что модель справляется за меньшее число шагов. Это верно на обычных настройках; на max, как видно из таблицы, счёт быстро растёт.
Некоторые запросы под защитой. Sonnet 5.5 — первая модель Sonnet со строгими защитными механизмами в области кибербезопасности, которые Anthropic применяет к своим самым сильным моделям. Рискованные запросы по безопасности заметно для пользователя передаются Sonnet 5. Почти никого это никогда не коснётся.
Кому она подойдёт
| Если ваш день выглядит так… | Берите | Почему |
|---|---|---|
| Письма, пересказы, таблицы, презентации | Claude Sonnet 5.5 | Офисная работа почти на уровне Opus, быстро, на бесплатном тарифе |
| Решения с высокими ставками, малоизвестные факты, запутанные исследования | Claude Opus 5.5 | Больше знаний и заметно более сильное суждение |
| «Поработай в этой программе на моём компьютере и доведи дело до конца» | GPT-6 Astra | Более сильный и экономный агент для управления компьютером |
| Одно приложение для чата, картинок и голоса | ChatGPT или Gemini | Более широкий творческий набор инструментов |
Вердикт для повседневной работы
Claude Sonnet 5.5 не заменит Opus на самых трудных вопросах, и Anthropic этого не скрывает. Но самые трудные вопросы — лишь малая часть большинства рабочих недель. Для всего остального она быстрая, толковая, доступна на бесплатном тарифе Claude и стоит так, что о цене можно не думать. Оставьте её на настройке по умолчанию, перепроверяйте малоизвестные факты и зовите Opus, когда ставки растут.