Обновление 25 июля: Claude Opus 5 теперь выше Fable 5 в нашем рейтинге. Fable сохраняет узкие пиковые победы на FrontierCode, CursorBench, HLE без инструментов и юридическом тесте, но Opus 5 ведет в более широких агентных и профессиональных оценках при половине цены и меньших ограничениях. Текст ниже сохраняет доказательства июньского запуска Fable; читайте его превосходные степени в этом историческом контексте.
Если Opus 4.8 был повышением по службе, то Fable 5 — это угловой кабинет. Смена названий Anthropic с музыкальных уровней (Haiku, Sonnet, Opus) на литературные (Fable, Mythos) — это не просто брендинг, это сигнал о появлении нового класса моделей. Fable 5 работает на той же архитектуре класса Mythos, что и ограниченный Mythos 5, но с классификаторами безопасности, которые делают его безопасным для общего использования. Думайте об этом как о суперкаре с установленным ограничителем скорости — это все еще самая быстрая вещь на дороге, просто с ограждениями на определенных поворотах.
Цифры говорят сами за себя. SWE-Bench Pro 80.3% не просто превосходит GPT-5.5 (58.6%) — он заставляет все поле конкурентов краснеть. FrontierCode Diamond на уровне 29.3% означает, что Fable 5 пишет код производственного качества в пять раз эффективнее, чем GPT-5.5 (5.7%). В бенчмарке Hebbia’s Finance Benchmark — рассуждениях над документами уровня старшего специалиста, чтении графиков, анализе первопричин — она занимает 1 место. На CursorBench она открыла “класс долгосрочных проблем, которые были недоступны для ранних моделей”.
Но самые показательные демонстрации — это не бенчмарки. Stripe перенес 50-миллионную кодовую базу Ruby за один день — работа, на которую у целой команды ушло бы два месяца. Модель прошла Pokémon FireRed, используя только сырые скриншоты — без карт, вспомогательных инструментов и данных о состоянии игры. А когда ей предоставили постоянную память на основе файлов при игре в Slay the Spire, ее производительность улучшилась в 3 раза больше, чем у Opus 4.8.
История с безопасностью стоит того, чтобы ее понять. Запросы, касающиеся кибербезопасности, биологии, химии или дистилляции моделей, автоматически перенаправляются к Opus 4.8 — все еще модели высшего уровня, но не к полной архитектуре Mythos. Это происходит менее чем в 5% сеансов, и Anthropic признает наличие некоторых ложных срабатываний по безобидным запросам. Это цена за то, чтобы быстро и безопасно выпустить настолько способную модель. Неограниченный Mythos 5 зарезервирован для проверенных партнеров в рамках Project Glasswing — где он уже помогает защищать критически важную программную инфраструктуру.
Настоящий вопрос заключается в том, стоит ли она своей цены. При стоимости $10/$50 за миллион токенов Fable 5 стоит примерно в 2 раза дороже, чем Opus 4.8. Но эффективность использования токенов частично компенсирует это — достижение лидирующих результатов во FrontierCode при средних усилиях означает меньше вычислений на одну задачу. Для профессионалов, чье время стоит дороже, чем их счета за API, математика проста. Для всех остальных Opus 4.8 остается отличным вариантом. Но если вы хотите получить лучшую общедоступную модель ИИ на планете — ту, где разрыв увеличивается по мере того, как задача становится сложнее — это она.