GPT-6 Astra берёт coding-корону реальным голосованием разработчиков и агентской практикой: новый №1 на Arena.ai Code Arena (1 797 баллов в WebDev), закрытие инцидентов, терминальные сессии и полная настройка рабочего места при расходе примерно трети токенов Sol.
№1 на Arena.ai Code Arena в общем зачёте и в WebDev с 1 797 баллами (+35 баллов отрыва от Claude Fable 5.1 Max и +109 от Opus 5 Max), лидерство в Data & Analytics, Consumer Product и Content Creation Tools; плюс 57,7–57,9% на Terminal-Bench 4.0, рекордные 74,1% на DeepSWE v1.1, 64,6% на Terminal-Bench Science и 88% pass@1 / 99,2% pass@4 на SRE-Bench.
На синтетическом харнессе Artificial Analysis Fable 5.1 по-прежнему опережает Astra со счётом 70:67, а SWE-Bench Pro остаётся исторической силой Claude Fable. Ценник API — $10/$50 (в 2,5× выше Sol), чтение кэша стоит вчетверо дороже ($1 против $0,25 у Fable 5.1), лаконичные ответы иногда пропускают шаги оформления отчётов, а усиленные кибер-ограничители могут добавлять трения в анализе уязвимостей.