Место #7 Повседневная экосистема — Ведущие ИИ-помощники
xAI

Grok 4.7

Grok 4.7 сохраняет низкую цену Grok 4.6 — $2 за ввод и $6 за вывод на миллион токенов, — но это заметно более сильная и аккуратная модель. xAI обучала её на более длинных и трудных задачах и научила перепроверять собственную работу. Это самый выгодный способ получить помощь почти топового уровня в офисной работе, подготовке юридических черновиков и инженерной математике.

Обновлено 27 сентября 2026 Value Frontier$2/$6 PricingSelf-Verification
Лучше всего для

Grok 4.7 сохраняет низкую цену Grok 4.6 — $2 за ввод и $6 за вывод на миллион токенов, — но это заметно более сильная и аккуратная модель. xAI обучала её на более длинных и трудных задачах и научила перепроверять собственную работу. Это самый выгодный способ получить помощь почти топового уровня в офисной работе, подготовке юридических черновиков и инженерной математике.

Почему он побеждает

Та же цена $2/$6, что у Grok 4.6, плюс быстрая версия — вдвое быстрее за двойную цену. В стартовой таблице xAI Grok 4.7 показывает лучший результат в Harvey Legal Agent Benchmark (19,6 % против 6,7 % у Claude Fable 5.1) и в EEBench по электротехнике (64,0 %). В AA Briefcase, тесте многочасовой офисной работы, она почти догоняет Fable 5.1 (1657 против 1678). xAI называет её своей самой надёжной моделью в отказе от вредных запросов и в устойчивости к джейлбрейкам.

Обратите внимание

Стартовая таблица сравнивает её с GPT-5.6 Sol и Claude Fable 5.1, а не с более новыми Claude Opus 5.5 и GPT-6 Sol, так что её место среди лучших моделей сегодняшнего дня пока не определено. Она явно отстаёт в долгой работе с терминалом (37,6 % в Terminal-Bench 4.0 против 57,9 % у Fable 5.1) и в клиническом мышлении. Все цифры — от самой xAI.

01

Что это на самом деле

Представьте лоукостер, который оставляет цены на билеты прежними, но без лишнего шума пересаживает пассажиров на самолёт побольше и получше.

Примерно это xAI сделала с Grok 4.7, вышедшей 21 сентября 2026 года. Цена не изменилась: $2 за миллион входных токенов и $6 за миллион выходных — ровно как у Grok 4.6. Изменилась сама модель.

Что нового под капотом

xAI описывает три изменения, если говорить простыми словами:

  1. Более крупная базовая модель. По словам xAI, версия 4.7 построена на более крупном фундаменте, чем 4.6. Число параметров в анонсе не названо, так что любые конкретные цифры, которые вы встретите в других местах, считайте неподтверждёнными.
  2. Более долгое и жёсткое обучение. Модель обучали с подкреплением на задачах, которые занимают много часов, — как раз на той работе, где прежние модели теряли нить на полпути.
  3. Проверка собственной работы. xAI специально обучала её перепроверять ответы и надёжнее справляться с длинными документами.

В итоге получилась модель, которая лучше держится на длинной задаче и замечает собственные ошибки раньше вас.

Чем она нас удивила

Самые интересные цифры в стартовой таблице xAI — вовсе не про программирование. Они относятся к областям, где от бюджетной модели не ждёшь лидерства.

  • Юридическая работа. В Harvey Legal Agent Benchmark, тесте на то, насколько хорошо ИИ-агент справляется с реальными юридическими задачами, Grok 4.7 набрала 19,6 %. Это больше, чем у Claude Fable 5.1 (6,7 %) и GPT-5.6 Sol (2,5 %). Тест беспощадно трудный, и у всех результаты низкие, но в этом сравнении Grok оказалась первой.
  • Инженерная математика. В EEBench, где проверяются задачи по электротехнике, она набрала 64,0 % — больше, чем 56,4 % у Fable 5.1.
  • Офисная работа. В AA Briefcase, тесте многочасовых офисных задач вроде подготовки документов и презентаций, она получила 1657 — чуть меньше 1678 у Fable 5.1 и намного больше 1546 у Grok 4.6.

Проще говоря, в реальной офисной и профессиональной работе Grok 4.7 теперь играет в одной лиге с моделями, которые стоят в несколько раз дороже.

Безопаснее, чем гласит репутация

У Grok репутация чат-бота с минимумом ограничений. Для версии 4.7 эта репутация устарела. xAI, по её словам, построила полностью новую систему безопасности и называет модель своей самой надёжной в отказе от опасных запросов и в устойчивости к джейлбрейкам. Кроме того, компания утверждает, что модель редко блокирует законную работу — например, исследования в области защитной кибербезопасности.

Grok по-прежнему скорее отвечает прямо, чем обкладывает ответ предупреждениями. Но это вопрос стиля, а не отсутствия безопасности.

Честная оговорка

С новейшими конкурентами она ещё не встречалась. Таблица xAI сравнивает Grok 4.7 с GPT-5.6 Sol и Claude Fable 5.1. Через день после её выхода Anthropic выпустила Claude Opus 5.5, а OpenAI — GPT-6 Sol: оба сильные и недорогие соперники. Пока независимые тесты не поставят их рядом, точное место Grok остаётся неясным.

Долгая работа в терминале — по-прежнему слабое место. В Terminal-Bench 4.0, который проверяет многочасовую работу в командной строке, Grok 4.7 набрала 37,6 %. Это почти вдвое больше, чем у Grok 4.6, но далеко позади 57,9 % у Fable 5.1.

Медицина — не её конёк. В HealthBench Professional, тесте на клиническое мышление, она набрала 56,7 % — меньше, чем GPT-5.6 Sol и Fable 5.1.

Всё это — цифры xAI. Лидерство в юриспруденции и инженерии впечатляет, но мы хотели бы увидеть его независимое подтверждение.

Кому подойдёт

Если вы весь день работаете с ИИ над документами, аналитикой и техническими вопросами и ежемесячный счёт для вас важен, Grok 4.7 заслуживает серьёзной проверки. Она даёт бо́льшую часть качества лучших моделей за малую долю их цены.

Если вам нужно самое тщательное суждение из доступных, выбирайте Claude Opus 5.5. Если нужен агент, который будет работать с программами на вашем компьютере, выбирайте GPT-6 Astra. Для всего, что между этими крайностями, Grok 4.7 — самый выгодный вариант рядом с вершиной.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Работа почти топового уровня по бюджетной цене: $2 за миллион входных токенов и $6 за миллион выходных. Это меньше трети выходной цены Claude Opus 5.5 и примерно одна восьмая цены GPT-6 Astra. Для команд, которые работают с ИИ весь день, разница видна в ежемесячном счёте.
  • Неожиданно сильна в юридической работе: в Harvey Legal Agent Benchmark Grok 4.7 набрала в таблице xAI 19,6 %, опередив Claude Fable 5.1 (6,7 %) и GPT-5.6 Sol (2,5 %). Тест очень трудный, и все модели пока набирают в нём мало, но Grok возглавила это сравнение.
  • Хороша в инженерной математике: в EEBench, тесте с задачами по электротехнике, она набрала 64,0 % — больше, чем Fable 5.1 (56,4 %), и намного больше, чем Grok 4.6 (53,0 %).
  • Перепроверяет свою работу: xAI обучала Grok 4.7 на более длинных и трудных задачах и отдельно улучшила то, как модель проверяет ответы и работает с длинными документами. В AA Briefcase, тесте многочасовой офисной работы, результат вырос с 1546 до 1657 — почти как 1678 у Fable 5.1.
  • Безопаснее, но без нотаций: xAI перестроила систему безопасности. Компания называет Grok 4.7 своей самой надёжной моделью в отказе от опасных запросов и в устойчивости к джейлбрейкам, которая при этом редко блокирует законную работу, например исследования в области защитной кибербезопасности.

Честные ограничения

  • Не сравнивалась с новейшими конкурентами: таблица xAI противопоставляет Grok 4.7 моделям GPT-5.6 Sol и Claude Fable 5.1. Claude Opus 5.5 и GPT-6 Sol вышли днём позже, так что независимых прямых сравнений пока нет.
  • Слабее в долгих сессиях в терминале: в Terminal-Bench 4.0, который проверяет многочасовую работу в командной строке, модель набрала 37,6 % — большой скачок по сравнению с 20,3 % у Grok 4.6, но далеко позади 57,9 % у Fable 5.1.
  • Отставание в медицине: в HealthBench Professional, тесте на клиническое мышление, она набрала 56,7 % — меньше, чем GPT-5.6 Sol (60,5 %) и Fable 5.1 (62,1 %).
  • Только данные производителя: каждая цифра здесь взята из анонса xAI. Считайте её лидерство в юриспруденции и инженерии многообещающим, пока его не подтвердят независимые тесты.
03

Результаты тестов

Harvey Legal Agent Benchmark — 19,6 %

Юридическая работа, выполняемая агентами. Таблица xAI: Grok 4.7 — 19,6 %, Grok 4.6 — 15,8 %, Claude Fable 5.1 — 6,7 %, GPT-5.6 Sol — 2,5 %. Очень трудный тест; низкие абсолютные результаты в нём нормальны.

EEBench — 64,0 %

Решение задач по электротехнике. В той же таблице у Grok 4.6 — 53,0 %, у Claude Fable 5.1 — 56,4 %, у GPT-5.6 Sol — 39,4 %.

AA Briefcase v1.1 — 1657

Многочасовые офисные задачи вроде документов и презентаций. Рост с 1546 у Grok 4.6, чуть позади Claude Fable 5.1 с 1678.

Terminal-Bench 4.0 — 37,6 %

Многочасовая работа в терминале. Большой прогресс по сравнению с Grok 4.6 (20,3 %), наравне с GPT-5.6 Sol (37,3 %), но далеко позади Claude Fable 5.1 (57,9 %) в таблице xAI. (Собственный прогон Anthropic даёт Fable 5.1 55,8 %; независимые тесты дают GPT-6 Astra и Claude Opus 5.5 по 59,6 %.)

Цена — $2 / $6 за 1 млн токенов

Без изменений по сравнению с Grok 4.6. Быстрая версия вдвое ускоряет вывод за двойную цену.

04

Вердикт

Grok 4.7 сохраняет пятое место в нашей категории «Повседневная экосистема» как самый выгодный вариант рядом с вершиной. Это не самый умный ассистент, какой можно купить: Claude Opus 5.5 и GPT-6 Astra по-прежнему впереди в тщательном суждении и управлении программами. Но в офисной работе Grok 4.7 подходит к ним неожиданно близко, возглавляет свою стартовую таблицу в юридических и инженерных тестах и стоит в разы дешевле. Если вы работаете с ИИ весь день и следите за счётом, её стоит серьёзно попробовать.

05

Часто задаваемые вопросы