Место #3 Повседневная экосистема — Ведущие ИИ-помощники
Anthropic

Claude Fable 5

Первая модель класса Mythos от Anthropic, сделанная безопасной для всех. Та же архитектура, которая лежит в основе ограниченного Mythos 5, но с консервативными мерами безопасности, которые направляют рискованные запросы к Opus 4.8. Она демонстрирует передовую производительность на всех важных бенчмарках — SWE-Bench Pro 80.3%, FrontierCode Diamond 29.3%, Hebbia Finance #1 — и отрыв увеличивается по мере усложнения задач. Для пользователей, которые могут позволить себе премиальную стоимость, это самая сильная общедоступная модель ИИ в мире.

Обновлено 1 июля 2026 Mythos-class1M ContextReasoning
Лучше всего для

Первая модель класса Mythos от Anthropic, сделанная безопасной для всех. Та же архитектура, которая лежит в основе ограниченного Mythos 5, но с консервативными мерами безопасности, которые направляют рискованные запросы к Opus 4.8. Она демонстрирует передовую производительность на всех важных бенчмарках — SWE-Bench Pro 80.3%, FrontierCode Diamond 29.3%, Hebbia Finance #1 — и отрыв увеличивается по мере усложнения задач. Для пользователей, которые могут позволить себе премиальную стоимость, это самая сильная общедоступная модель ИИ в мире.

Почему он побеждает

SWE-Bench Pro 80.3% (SOTA — сокрушает 58.6% у GPT-5.5). FrontierCode Diamond 29.3% (в 5 раз больше GPT-5.5). Hebbia Finance Benchmark #1. CursorBench SOTA. Stripe мигрировал кодовую базу в 50 млн строк за один день. Прохождение Pokémon FireRed только с помощью зрения. В Slay the Spire с постоянной памятью производительность в 3 раза лучше, чем у Opus 4.8. $10/$50 за миллион токенов. Контекст 1M. Доступно на claude.ai, API, Bedrock, Vertex, Foundry.

Обратите внимание

Премиальное ценообразование — $10/$50 за миллион токенов (в 2 раза дороже Opus 4.8). Консервативные меры безопасности перенаправляют <5% сессий к Opus 4.8 по отмеченным темам (кибербезопасность, биология, химия). Это не неограниченный Mythos 5 (доступ ограничен рамками Project Glasswing). Независимые сторонние бенчмарки все еще появляются в день запуска. Лимиты использования на планах Pro/Max в периоды высокого спроса.

01

Что это на самом деле

Обновление 25 июля: Claude Opus 5 теперь выше Fable 5 в нашем рейтинге. Fable сохраняет узкие пиковые победы на FrontierCode, CursorBench, HLE без инструментов и юридическом тесте, но Opus 5 ведет в более широких агентных и профессиональных оценках при половине цены и меньших ограничениях. Текст ниже сохраняет доказательства июньского запуска Fable; читайте его превосходные степени в этом историческом контексте.

Если Opus 4.8 был повышением по службе, то Fable 5 — это угловой кабинет. Смена названий Anthropic с музыкальных уровней (Haiku, Sonnet, Opus) на литературные (Fable, Mythos) — это не просто брендинг, это сигнал о появлении нового класса моделей. Fable 5 работает на той же архитектуре класса Mythos, что и ограниченный Mythos 5, но с классификаторами безопасности, которые делают его безопасным для общего использования. Думайте об этом как о суперкаре с установленным ограничителем скорости — это все еще самая быстрая вещь на дороге, просто с ограждениями на определенных поворотах.

Цифры говорят сами за себя. SWE-Bench Pro 80.3% не просто превосходит GPT-5.5 (58.6%) — он заставляет все поле конкурентов краснеть. FrontierCode Diamond на уровне 29.3% означает, что Fable 5 пишет код производственного качества в пять раз эффективнее, чем GPT-5.5 (5.7%). В бенчмарке Hebbia’s Finance Benchmark — рассуждениях над документами уровня старшего специалиста, чтении графиков, анализе первопричин — она занимает 1 место. На CursorBench она открыла “класс долгосрочных проблем, которые были недоступны для ранних моделей”.

Но самые показательные демонстрации — это не бенчмарки. Stripe перенес 50-миллионную кодовую базу Ruby за один день — работа, на которую у целой команды ушло бы два месяца. Модель прошла Pokémon FireRed, используя только сырые скриншоты — без карт, вспомогательных инструментов и данных о состоянии игры. А когда ей предоставили постоянную память на основе файлов при игре в Slay the Spire, ее производительность улучшилась в 3 раза больше, чем у Opus 4.8.

История с безопасностью стоит того, чтобы ее понять. Запросы, касающиеся кибербезопасности, биологии, химии или дистилляции моделей, автоматически перенаправляются к Opus 4.8 — все еще модели высшего уровня, но не к полной архитектуре Mythos. Это происходит менее чем в 5% сеансов, и Anthropic признает наличие некоторых ложных срабатываний по безобидным запросам. Это цена за то, чтобы быстро и безопасно выпустить настолько способную модель. Неограниченный Mythos 5 зарезервирован для проверенных партнеров в рамках Project Glasswing — где он уже помогает защищать критически важную программную инфраструктуру.

Настоящий вопрос заключается в том, стоит ли она своей цены. При стоимости $10/$50 за миллион токенов Fable 5 стоит примерно в 2 раза дороже, чем Opus 4.8. Но эффективность использования токенов частично компенсирует это — достижение лидирующих результатов во FrontierCode при средних усилиях означает меньше вычислений на одну задачу. Для профессионалов, чье время стоит дороже, чем их счета за API, математика проста. Для всех остальных Opus 4.8 остается отличным вариантом. Но если вы хотите получить лучшую общедоступную модель ИИ на планете — ту, где разрыв увеличивается по мере того, как задача становится сложнее — это она.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Глобальный перезапуск и доказательство защиты от уязвимостей нулевого дня: После успешного завершения проверки экспортного контроля 30 июня 2026 года Fable 5 вновь доступна по всему миру без региональных VPN-ограничений. В ходе тестирования команды кибербезопасности Amazon подтвердили, что Fable 5 автономно выявила и устранила уязвимость нулевого дня (подделка токенов OAuth2) в 40 микросервисах менее чем за 3 минуты — доказав свою надежность корпоративного уровня.
  • Маршрутизация кибербезопасности на Opus 4.8 и ложные срабатывания: Хотя Fable 5 нативно выполняет ~95% стандартных задач по написанию кода, встроенные классификаторы безопасности Anthropic автоматически перенаправляют сложные или высокорисковые запросы по кибербезопасности на модель Claude Opus 4.8 для строгой проверки. Примечание: агрессивные классификаторы могут иногда выдавать ложные срабатывания на безобидные скрипты системного администрирования.
  • Устойчивость к структурированным агентным джейлбрейкам: В отличие от конкурентов с открытыми весами, которые уязвимы к автоматизированным многошаговым фреймворкам убеждения (например, MoA-джейлбрейкам или атакам Crescendo), иерархическое обучение безопасности Fable 5 сохраняет строгие границы без снижения качества творческого программирования.
  • Возможности класса Mythos для всех: Та же базовая архитектура, что и у ограниченного Mythos 5, но с классификаторами безопасности, которые делают ее широко доступной. Fable 5 является передовой (SOTA) почти на всех протестированных бенчмарках — и отрыв от конкурентов растет по мере усложнения задач. Это не инкрементальное обновление; это скачок поколения.
  • Автономный агент, который действительно выполняет работу: Stripe сжал месяцы инженерии в дни — мигрировав 50-миллионную кодовую базу на Ruby за один день. Модель планирует, делегирует задачи субагентам, проверяет себя собственными тестами и продолжает работать, пока работа не будет сделана. Многодневные автономные сессии — это новая норма.
  • Прорыв в компьютерном зрении: Передовые результаты в задачах со зрением. Может извлекать точные цифры из научных графиков, перестраивать веб-приложения только по скриншотам и завершать Pokémon FireRed только с помощью зрения — без помощников, без данных о состоянии игры. Более ранним моделям требовались сложные вспомогательные леса; Fable 5 нужны только глаза.
  • Память на миллионы токенов: Постоянная файловая память улучшила ее производительность в Slay the Spire в 3 раза больше, чем у Opus 4.8. Модель сохраняет концентрацию на протяжении сессий с миллионом токенов и фактически улучшает свои ответы, используя собственные записи. Длинный контекст — это не просто спецификация, это работающая функция.
  • Эффективность использования токенов выигрывает в математике: Несмотря на цену токена в 2 раза выше по сравнению с Opus 4.8, Fable 5 набирает наивысший балл на FrontierCode даже при средних усилиях. Выполнение большего объема работы на токен означает, что реальная стоимость одной задачи часто оказывается конкурентоспособной. Дорогая модель, которая экономит деньги на сложных проблемах.

Честные ограничения

  • Ложные срабатывания в кибербезопасности: Высокоагрессивные классификаторы безопасности могут иногда помечать легитимные скрипты системного администрирования, тестирования на проникновение или низкоуровневой отладки как вредоносные, вызывая автоматическую переадресацию на Opus 4.8 или блокировку.
  • Отраслевые риски новых джейлбрейков: Хотя модель устойчива к стандартным атакам, ни одна флагманская ИИ-система не обладает абсолютным иммунитетом против новейших структурированных агентных джейлбрейков; непрерывный ред-тиминг остается обязательным условием для корпоративного внедрения.
  • Премиальная цена реальна: $10 за миллион входных токенов, $50 за миллион выходных токенов — цены примерно в 2 раза выше, чем на Opus 4.8. Подписчики Pro получают включенный доступ до 22 июня, затем вступают в силу кредиты за использование. Опытные пользователи (power users) почувствуют счет.
  • Консервативная маршрутизация безопасности: Защитные механизмы срабатывают в <5% сеансов, перенаправляя отмеченные запросы к Opus 4.8. Некоторое количество ложных срабатываний в легитимной профессиональной работе (исследования кибербезопасности, химия, биология). Ограничения отражают мощь двойного назначения базовой модели.
  • Не полный Mythos 5: Неограниченная версия скрыта за проектом Project Glasswing для проверенных специалистов по киберзащите и исследователей. То, что вы получаете, явно является охраняемой версией — чрезвычайно способной, но с учебными колесиками в определенных темах.
  • Независимые бенчмарки в ожидании: Заявления в день запуска подробны и богаты примерами, но полные независимые результаты LMSYS Arena, Artificial Analysis и обновленные результаты SWE-Bench все еще появляются. Проверьте перед тем, как короновать.
03

Результаты тестов

SWE-Bench Pro — 80.3% (SOTA)

Реальная разработка программного обеспечения. Сокрушает GPT-5.5 (58.6%) на 21.7 пункта, а своего предшественника Opus 4.8 (69.2%) на 11.1 пункта. Самый большой отрыв за всю историю бенчмарка.

FrontierCode Diamond — 29.3% (SOTA)

Эффективный по токенам высококачественный производственный код. Набирает 29.3% по сравнению с 13.4% у Opus 4.8 и 5.7% у GPT-5.5. Достигает максимальной производительности даже при средних усилиях рассуждения.

Hebbia Finance Benchmark — #1

Рассуждения по документам на уровне сеньора, интерпретация диаграмм и анализ первопричин. Наивысший балл среди всех протестированных моделей. IMC подтвердила, что модель прошла почти все оценки торгового анализа с отличием.

CursorBench — SOTA

SOTA (передовой результат) на бенчмарке Cursor. «Открыл класс долгосрочных проблем, недоступных для более ранних моделей». — Майкл Труэлл, генеральный директор Cursor.

04

Вердикт

Граница только что сдвинулась. Claude Fable 5 — это не просто итерация Opus 4.8 — это скачок поколения, завернутый в барьеры безопасности. Отрыв в SWE-Bench Pro (80.3% против 58.6% у GPT-5.5) — это не ошибка округления, это пропасть. Отрыв во FrontierCode еще шире. И в отличие от моделей, которые выигрывают бенчмарки, но спотыкаются на практике, у Fable 5 есть доказательства: Stripe, мигрировавший 50 миллионов строк кода за день, прохождение игры только с помощью зрения и постоянная память, которая действительно работает на протяжении длительных сессий. Загвоздка в цене — $10/$50 за миллион токенов это не повседневные траты — а консервативная маршрутизация безопасности иногда будет отправлять вас к Opus 4.8 по вполне легальным запросам. Но для профессионалов, которым нужен самый сильный ИИ-мозг, доступный общественности, и чья работа включает сложную инженерию, глубокие исследования или долгосрочные агентские задачи — это именно оно. Лучшая модель ИИ, которую вы действительно можете использовать.

05

Часто задаваемые вопросы