Место #1 Повседневная экосистема — Ведущие ИИ-помощники
Anthropic

Claude Opus 5.5

Claude Opus 5.5 — модель, которой мы доверили бы запутанную задачу с высокой ценой ошибки и были бы спокойны, что получим верный ответ. По словам Anthropic, в большинстве задач она работает на уровне флагманской Fable 5.1, но стоит меньше половины её цены за токен. А пишет теперь как собранный опытный коллега, а не как волнующийся выпускник.

Обновлено 27 сентября 2026 AA Index 58 #1Knowledge Work SOTAAdaptive Thinking
Лучше всего для

Claude Opus 5.5 — модель, которой мы доверили бы запутанную задачу с высокой ценой ошибки и были бы спокойны, что получим верный ответ. По словам Anthropic, в большинстве задач она работает на уровне флагманской Fable 5.1, но стоит меньше половины её цены за токен. А пишет теперь как собранный опытный коллега, а не как волнующийся выпускник.

Почему он побеждает

Лучший результат в независимом Artificial Analysis Intelligence Index на момент выхода (58 при максимальном усилии). Лидирует в GDPval-AA v2.1 — тесте на реальную профессиональную работу — с 1846 Elo, опережая Fable 5.1 (1735). Цена токенов снизилась на 20 %, до $4/$20, а чтение из кэша — на 60 %, до $0,20; по оценке Anthropic, типичная нагрузка обходится примерно на 40 % дешевле, чем с Opus 5. Ответы генерируются более чем на 30 % быстрее, а пятичасовые лимиты на платных тарифах выросли.

Обратите внимание

На максимальном усилии модель очень много «думает вслух»: Artificial Analysis насчитала около 119 000 выходных токенов на задачу против примерно 27 000 у GPT-6 Astra. Поэтому низкая цена окупается, только если рутинная работа идёт на стандартном уровне усилия. Изображения модель не создаёт, рассуждение больше нельзя отключить, а большинство запросов по кибербезопасности незаметно передаются старой Opus 4.8.

01

Что это на самом деле

Большинство ИИ-ассистентов ведут себя как очень шустрый стажёр. Отвечают мгновенно и уверенно. Дайте им сорокастраничный договор аренды, и они вернут аккуратное резюме, в котором пропущен ровно тот пункт на 37-й странице, который действительно важен.

Claude Opus 5.5 больше похожа на опытную коллегу, которая сначала читает весь документ целиком. А потом в двух предложениях говорит, в чём проблема и где её искать.

Anthropic выпустила Opus 5.5 22 сентября 2026 года — это первая модель семейства Claude 5.5. Она занимает у нас первое место в «Повседневной экосистеме» по простой причине: из всех моделей, которые мы можем измерить, она лучше всех думает вдумчиво, и стоит она уже не как предмет роскоши.

Что говорят независимые тесты

Основной вес здесь несут две цифры, и обе получены Artificial Analysis, а не маркетинговым отделом Anthropic.

Первая — Artificial Analysis Intelligence Index, сводный балл по десяти сложным тестам на логику, естественные науки, программирование и знания. При максимальном усилии Opus 5.5 набрала 58 баллов в сентябре 2026 года. На момент выхода это было первое место в рейтинге, выше GPT-6 Astra и выше собственной флагманской модели Anthropic — Claude Fable 5.1. (Шкалу индекса время от времени пересчитывают, поэтому балл что-то значит только рядом с моделями, измеренными в тот же период.)

Вторая — GDPval-AA v2.1, и она ближе к реальной жизни. Вместо экзаменационных вопросов модели выполняют настоящую работу — модель в электронной таблице, юридическую записку, справку для руководства — по 44 профессиям, а затем результаты сравниваются попарно, как в шахматном рейтинге. Opus 5.5 получила 1846 Elo. У Fable 5.1 — 1735, у Opus 5 — 1708, у GPT-6 Astra — 1542.

Внутренние тесты Anthropic указывают в ту же сторону. В одном из них три модели писали отчёт о квартальных результатах компании, пользуясь копией интернета, где пресс-релиз с отчётностью было трудно найти. Любая выдуманная цифра или цитата означала провал. Opus 5.5 справилась 16 раз из 18. Fable 5.1 и Opus 5 — ни разу. Именно этого и ждёшь от ассистента: не просто ума, а осторожности в утверждениях.

История с ценой — без упрощений

Возможно, вы читали, что Opus 5.5 «на 40 % дешевле». Это правда, но стоит понимать, откуда берётся эта цифра.

  • Цена токенов снизилась на 20 %: $4 за миллион входных токенов и $20 за миллион выходных вместо прежних $5 и $25.
  • Чтение из кэша подешевело на 60 %: до $0,20 за миллион. Когда вы задаёте вопрос за вопросом по одному и тому же длинному документу, модель перечитывает его из промежуточной памяти. Именно это повторное чтение составляет большую часть счёта у агентов и инструментов для программирования.
  • На стандартном уровне модель тратит меньше токенов: по словам Anthropic, поэтому типичная нагрузка и выходит примерно на 40 % дешевле, чем на Opus 5.

Для сравнения: прайс Fable 5.1 — $10/$50. Opus 5.5 даёт вам большую часть возможностей Fable за 40 % её цены за токен. Anthropic даже пишет, что в её собственной повседневной работе разрыв между двумя моделями «меньше, чем можно подумать по этим баллам».

Теперь она пишет по-человечески

Одна из самых частых претензий к Opus 5 заключалась в том, что за её ответами трудно уследить: длинно, с жаргоном, а главная мысль спрятана в четвёртом абзаце. Anthropic говорит, что работала именно над этим. Opus 5.5 начинает с ответа, выбирает слова попроще и соблюдает правила стиля, которые вы ей задаёте.

Кажется, что это косметика, но нет. Ответ, который можно прочитать за тридцать секунд, можно и проверить. Блестящий ответ, который приходится расшифровывать, вы в итоге пробежите глазами и примете на веру.

Честная оговорка

На максимальном усилии модель прожорлива. На самом высоком уровне Opus 5.5 перебирает множество путей, прежде чем ответить. Artificial Analysis насчитала около 119 000 выходных токенов на задачу при максимальном усилии — против примерно 27 000 у GPT-6 Astra. При таких объёмах более низкая цена за токен не гарантирует более низкий счёт за ответ. Практическое правило простое: для повседневной работы оставляйте стандартный (средний) уровень — по данным Anthropic, на нём модель уже обходит в GDPval Astra на максимальном усилии примерно за пятую часть стоимости. Повышайте уровень, только когда задача действительно трудная.

Она не создаёт изображений. Claude отлично читает графики, скриншоты и отсканированные PDF, но не генерирует ни изображений, ни аудио, ни видео. Если нужно одно приложение на все случаи, ChatGPT по-прежнему универсальнее.

Некоторые двери под охраной. Opus 5.5 настолько сильна в кибербезопасности и биологии, что Anthropic применяет к ней дополнительные защитные механизмы. Большинство задач по безопасности в фоновом режиме выполняет старая Opus 4.8, а для части биологических исследований нужно вступить в программу верификации Anthropic. Большинство людей этого никогда не заметят, а вот команды безопасности — заметят.

Кому подойдёт

Если ваш день — это… Выбирайте Почему
Договоры, исследования, отчёты, финансовые модели Claude Opus 5.5 Лучшая измеренная профессиональная работа; ответы, которые можно проверить
«Поработай с этой программой на моём компьютере и доведи дело до конца» GPT-6 Astra Более сильный и экономный агент для работы с компьютером
Одно приложение для чата, картинок и голоса ChatGPT Самый широкий набор функций для обычных пользователей
Огромные объёмы простых запросов GPT-6 Luna Доли цента за задачу

Итог для повседневной работы

Для быстрых писем и случайных вопросов подойдёт почти любой современный ассистент. Но когда документы запутаны, вопрос неоднозначен, а ошибка имеет последствия, Claude Opus 5.5 — ассистент, которому мы доверяем больше всего. И впервые это доверие не стоит как предмет роскоши.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Самая сильная универсальная модель из измеренных: в сентябре 2026 года Artificial Analysis дала Opus 5.5 58 баллов в Intelligence Index при максимальном усилии — первое место в рейтинге на момент выхода, впереди GPT-6 Astra и Claude Fable 5.1.
  • Настоящая офисная работа, а не только экзаменационные вопросы: в GDPval-AA v2.1, где оцениваются готовые результаты работы по 44 профессиям, модель набирает 1846 Elo против 1735 у Fable 5.1 и 1708 у Opus 5. В тесте Anthropic, где каждую цифру нужно было подтвердить источником, прошли проверку 16 из 18 её аналитических отчётов; Fable 5.1 и Opus 5 не прошли ни разу.
  • Результаты уровня Fable за меньшие деньги: $4 за ввод и $20 за вывод на миллион токенов — это 40 % от цены Fable 5.1 ($10/$50). Чтение из кэша — повторное чтение того же длинного документа или кода, на которое приходится основная часть счёта у агентов, — подешевело на 60 %, до $0,20.
  • Её легче читать: Anthropic переработала то, как модель пишет. Она начинает с вывода, обходится без жаргона и следует вашим правилам стиля. Первые тестировщики из Ramp и Deloitte отметили именно это — и это важно: отчёт, который можно быстро просмотреть, можно и проверить.
  • Быстрее и щедрее: текст появляется более чем на 30 % быстрее, чем у Opus 5, а Anthropic увеличила пятичасовые лимиты на тарифах Pro, Max, Team и Enterprise с оплатой за место.

Честные ограничения

  • Максимальное усилие обходится дорого: на самом высоком уровне Opus 5.5 перебирает множество вариантов рассуждения. Artificial Analysis насчитала около 119 000 выходных токенов на задачу при максимальном усилии против примерно 27 000 у GPT-6 Astra, так что более дешёвый токен не гарантирует более дешёвый ответ. Собственные данные Anthropic показывают: экономия — на стандартном (среднем) уровне.
  • Ни картинок, ни звуковой студии: Claude отлично понимает изображения и графики, но не создаёт ни изображений, ни аудио, ни видео. Если нужна одна подписка, которая ещё и рисует, ChatGPT по-прежнему даёт более широкий набор возможностей.
  • Защитные механизмы перенаправляют часть работы: поскольку Opus 5.5 очень силён в кибербезопасности и биологии, большинство задач по безопасности передаётся Opus 4.8, а часть биологических исследований требует участия в программе верификации Anthropic. Специалистам по безопасности стоит быть готовыми к неудобствам, пока их не одобрят.
  • Рассуждение включено всегда: уровень усилия можно понизить, но полностью отключить рассуждение больше нельзя, из-за чего даже простейшие запросы выполняются чуть дольше.
03

Результаты тестов

Artificial Analysis Intelligence Index — 58 (№ 1 на момент выхода)

Независимый сводный балл при максимальном усилии, измерен в сентябре 2026 года. Самый высокий в рейтинге на момент выхода. Artificial Analysis периодически пересчитывает шкалу индекса, поэтому сравнивайте его только с моделями, измеренными в тот же период.

GDPval-AA v2.1 — 1846 Elo

Реальные профессиональные результаты работы по 44 профессиям, оценка Artificial Analysis. В таблице Anthropic к запуску у Fable 5.1 — 1735, у Opus 5 — 1708, у GPT-6 Astra — 1542.

Humanity's Last Exam — 67,7 % с инструментами

Данные Anthropic на момент запуска, с включёнными инструментами. В той же таблице у Fable 5.1 — 65,6 %, у GPT-6 Astra — 57,2 %. Очень сложные междисциплинарные вопросы, составленные экспертами.

OSWorld 2.0 — 81,8 % (частичные баллы)

Данные Anthropic по работе с настоящим рабочим столом: клики, ввод текста, переключение между приложениями. Оценка с частичными баллами, поэтому напрямую с цифрами OpenAI по полностью выполненным задачам её сравнивать нельзя.

Цена — $4 / $20 за 1 млн токенов, $0,20 за чтение из кэша

На 20 % ниже Opus 5 по токенам и на 60 % — по чтению из кэша. Anthropic оценивает стоимость типичной нагрузки примерно на 40 % ниже, потому что на стандартном уровне модель ещё и расходует меньше токенов. Быстрый режим стоит $8/$40.

04

Вердикт

Claude Opus 5.5 занимает у нас первое место в категории «Повседневная экосистема», потому что объединяет три вещи: лучший независимый показатель интеллекта на момент выхода, лучший результат в реальной профессиональной работе и цену, при которой здравое суждение уровня Fable наконец можно использовать каждый день. Это не приложение «всё в одном»: ChatGPT по-прежнему рисует, а GPT-6 Astra по-прежнему эффективнее управляет программами. Но когда нужно прочитать что-то длинное и запутанное, тщательно подумать и дать ответ, который можно проверить, мы первым делом обратились бы к Opus 5.5. Держите его на стандартном уровне усилия, а максимальный оставьте для задач, которые того стоят.

05

Часто задаваемые вопросы