Большинство ИИ-ассистентов ведут себя как очень шустрый стажёр. Отвечают мгновенно и уверенно. Дайте им сорокастраничный договор аренды, и они вернут аккуратное резюме, в котором пропущен ровно тот пункт на 37-й странице, который действительно важен.
Claude Opus 5.5 больше похожа на опытную коллегу, которая сначала читает весь документ целиком. А потом в двух предложениях говорит, в чём проблема и где её искать.
Anthropic выпустила Opus 5.5 22 сентября 2026 года — это первая модель семейства Claude 5.5. Она занимает у нас первое место в «Повседневной экосистеме» по простой причине: из всех моделей, которые мы можем измерить, она лучше всех думает вдумчиво, и стоит она уже не как предмет роскоши.
Что говорят независимые тесты
Основной вес здесь несут две цифры, и обе получены Artificial Analysis, а не маркетинговым отделом Anthropic.
Первая — Artificial Analysis Intelligence Index, сводный балл по десяти сложным тестам на логику, естественные науки, программирование и знания. При максимальном усилии Opus 5.5 набрала 58 баллов в сентябре 2026 года. На момент выхода это было первое место в рейтинге, выше GPT-6 Astra и выше собственной флагманской модели Anthropic — Claude Fable 5.1. (Шкалу индекса время от времени пересчитывают, поэтому балл что-то значит только рядом с моделями, измеренными в тот же период.)
Вторая — GDPval-AA v2.1, и она ближе к реальной жизни. Вместо экзаменационных вопросов модели выполняют настоящую работу — модель в электронной таблице, юридическую записку, справку для руководства — по 44 профессиям, а затем результаты сравниваются попарно, как в шахматном рейтинге. Opus 5.5 получила 1846 Elo. У Fable 5.1 — 1735, у Opus 5 — 1708, у GPT-6 Astra — 1542.
Внутренние тесты Anthropic указывают в ту же сторону. В одном из них три модели писали отчёт о квартальных результатах компании, пользуясь копией интернета, где пресс-релиз с отчётностью было трудно найти. Любая выдуманная цифра или цитата означала провал. Opus 5.5 справилась 16 раз из 18. Fable 5.1 и Opus 5 — ни разу. Именно этого и ждёшь от ассистента: не просто ума, а осторожности в утверждениях.
История с ценой — без упрощений
Возможно, вы читали, что Opus 5.5 «на 40 % дешевле». Это правда, но стоит понимать, откуда берётся эта цифра.
- Цена токенов снизилась на 20 %: $4 за миллион входных токенов и $20 за миллион выходных вместо прежних $5 и $25.
- Чтение из кэша подешевело на 60 %: до $0,20 за миллион. Когда вы задаёте вопрос за вопросом по одному и тому же длинному документу, модель перечитывает его из промежуточной памяти. Именно это повторное чтение составляет большую часть счёта у агентов и инструментов для программирования.
- На стандартном уровне модель тратит меньше токенов: по словам Anthropic, поэтому типичная нагрузка и выходит примерно на 40 % дешевле, чем на Opus 5.
Для сравнения: прайс Fable 5.1 — $10/$50. Opus 5.5 даёт вам большую часть возможностей Fable за 40 % её цены за токен. Anthropic даже пишет, что в её собственной повседневной работе разрыв между двумя моделями «меньше, чем можно подумать по этим баллам».
Теперь она пишет по-человечески
Одна из самых частых претензий к Opus 5 заключалась в том, что за её ответами трудно уследить: длинно, с жаргоном, а главная мысль спрятана в четвёртом абзаце. Anthropic говорит, что работала именно над этим. Opus 5.5 начинает с ответа, выбирает слова попроще и соблюдает правила стиля, которые вы ей задаёте.
Кажется, что это косметика, но нет. Ответ, который можно прочитать за тридцать секунд, можно и проверить. Блестящий ответ, который приходится расшифровывать, вы в итоге пробежите глазами и примете на веру.
Честная оговорка
На максимальном усилии модель прожорлива. На самом высоком уровне Opus 5.5 перебирает множество путей, прежде чем ответить. Artificial Analysis насчитала около 119 000 выходных токенов на задачу при максимальном усилии — против примерно 27 000 у GPT-6 Astra. При таких объёмах более низкая цена за токен не гарантирует более низкий счёт за ответ. Практическое правило простое: для повседневной работы оставляйте стандартный (средний) уровень — по данным Anthropic, на нём модель уже обходит в GDPval Astra на максимальном усилии примерно за пятую часть стоимости. Повышайте уровень, только когда задача действительно трудная.
Она не создаёт изображений. Claude отлично читает графики, скриншоты и отсканированные PDF, но не генерирует ни изображений, ни аудио, ни видео. Если нужно одно приложение на все случаи, ChatGPT по-прежнему универсальнее.
Некоторые двери под охраной. Opus 5.5 настолько сильна в кибербезопасности и биологии, что Anthropic применяет к ней дополнительные защитные механизмы. Большинство задач по безопасности в фоновом режиме выполняет старая Opus 4.8, а для части биологических исследований нужно вступить в программу верификации Anthropic. Большинство людей этого никогда не заметят, а вот команды безопасности — заметят.
Кому подойдёт
| Если ваш день — это… | Выбирайте | Почему |
|---|---|---|
| Договоры, исследования, отчёты, финансовые модели | Claude Opus 5.5 | Лучшая измеренная профессиональная работа; ответы, которые можно проверить |
| «Поработай с этой программой на моём компьютере и доведи дело до конца» | GPT-6 Astra | Более сильный и экономный агент для работы с компьютером |
| Одно приложение для чата, картинок и голоса | ChatGPT | Самый широкий набор функций для обычных пользователей |
| Огромные объёмы простых запросов | GPT-6 Luna | Доли цента за задачу |
Итог для повседневной работы
Для быстрых писем и случайных вопросов подойдёт почти любой современный ассистент. Но когда документы запутаны, вопрос неоднозначен, а ошибка имеет последствия, Claude Opus 5.5 — ассистент, которому мы доверяем больше всего. И впервые это доверие не стоит как предмет роскоши.