O'rin #7 Kundalik ekotizim — Yetakchi SI yordamchilari
xAI

Grok 4.7

Grok 4.7 o'zidan oldingi Grok 4.6 ning past narxini saqlab qoladi — million token uchun kiritishga $2, chiqishga $6 —, lekin u sezilarli darajada kuchliroq va puxtaroq model. xAI uni uzoqroq va qiyinroq vazifalarda o'qitdi hamda o'z ishini tekshirishga o'rgatdi. Bu ofis ishi, yuridik qoralamalar va muhandislik matematikasida yuqori darajaga yaqin yordam olishning eng arzon yo'li.

Yangilangan 2026-yil 27-sentabr Value Frontier$2/$6 PricingSelf-Verification
9.610 dan
Rasmiy veb-sayt
Eng mos

Grok 4.7 o'zidan oldingi Grok 4.6 ning past narxini saqlab qoladi — million token uchun kiritishga $2, chiqishga $6 —, lekin u sezilarli darajada kuchliroq va puxtaroq model. xAI uni uzoqroq va qiyinroq vazifalarda o'qitdi hamda o'z ishini tekshirishga o'rgatdi. Bu ofis ishi, yuridik qoralamalar va muhandislik matematikasida yuqori darajaga yaqin yordam olishning eng arzon yo'li.

Nima uchun bu eng yaxshisi

Grok 4.6 dagi bilan bir xil $2/$6 narx, ikki baravar narxga ikki baravar tezroq ishlaydigan tezkor variant ham bor. xAI'ning chiqish jadvalida Grok 4.7 Harvey Legal Agent Benchmark (19,6%, Claude Fable 5.1 da esa 6,7%) va elektrotexnika bo'yicha EEBench (64,0%) testlarida eng yuqori natijani ko'rsatadi. Soatlab davom etadigan ofis ishini sinaydigan AA Briefcase testida u Fable 5.1 ga yaqin (1 657 ga qarshi 1 678). xAI uni zararli so'rovlarni rad etish va jailbreak urinishlariga qarshi turish bo'yicha hozirgacha eng kuchli modeli deb ataydi.

E'tibor bering

Chiqish jadvali uni yangiroq Claude Opus 5.5 yoki GPT-6 Sol bilan emas, GPT-5.6 Sol va Claude Fable 5.1 bilan solishtiradi, shuning uchun bugungi eng yaxshi modellar orasidagi o'rni hali aniq emas. Terminalda uzoq ishlashda (Terminal-Bench 4.0 da 37,6%, Fable 5.1 da esa 57,9%) va klinik fikrlashda u aniq orqada qoladi. Barcha raqamlar xAI'ning o'zidan.

01

Aslida bu nima

Chipta narxlarini o’zgartirmasdan, jimgina kattaroq va yaxshiroq samolyotlarga o’tgan arzon aviakompaniyani tasavvur qiling.

xAI 2026-yil 21-sentabrda chiqargan Grok 4.7 bilan taxminan shunday qildi. Narx o’zgarmadi: million kiritish tokeni uchun $2 va million chiqish tokeni uchun $6 — xuddi Grok 4.6 dagidek. O’zgargani — ichidagi model.

Ichki tomondan nima yangilik

xAI uchta o’zgarishni tasvirlaydi, oddiy qilib aytganda:

  1. Kattaroq asosiy model. xAI’ning aytishicha, 4.7 versiyasi 4.6 dan kattaroq poydevorga qurilgan. E’londa parametrlar soni ko’rsatilmagan, shuning uchun boshqa joylarda uchratgan aniq raqamlarni tasdiqlanmagan deb hisoblang.
  2. Uzoqroq va qiyinroq o’qitish. Model bajarilishi ko’p soat davom etadigan vazifalarda mustahkamlab o’qitish (reinforcement learning) usuli bilan o’qitilgan — bu aynan oldingi modellar yarim yo’lda ipni yo’qotib qo’yadigan turdagi ish.
  3. O’z ishini tekshirish. xAI uni javoblarini tekshirishga va uzun hujjatlar bilan ishonchliroq ishlashga maxsus o’rgatgan.

Natijada uzoq vazifada yaxshiroq bardosh beradigan va o’z xatolarini sizdan oldin topadigan model paydo bo’ldi.

Bizni nimasi bilan hayratga soldi

xAI chiqish jadvalidagi eng qiziqarli raqamlar dasturlashga oid emas. Ular arzon modelning yetakchi bo’lishini kutmaydigan sohalarda.

  • Yuridik ish. Sun’iy intellekt agenti haqiqiy yuridik vazifalarni qanchalik yaxshi bajarishini sinaydigan Harvey Legal Agent Benchmark da Grok 4.7 19,6% oldi. Bu Claude Fable 5.1 (6,7%) va GPT-5.6 Sol (2,5%) dan yuqori. Test juda qiyin va hamma past natija ko’rsatadi, lekin bu taqqoslashda Grok birinchi o’rinni oldi.
  • Muhandislik matematikasi. Elektrotexnika masalalarini sinaydigan EEBench da u 64,0% oldi — Fable 5.1 ning 56,4% natijasidan yuqori.
  • Ofis ishi. Hujjat va taqdimotlar tayyorlash kabi soatlab davom etadigan ofis vazifalarini sinaydigan AA Briefcase da u 1 657 ball oldi — Fable 5.1 ning 1 678 ballidan biroz past va Grok 4.6 ning 1 546 ballidan ancha yuqori.

Oddiy qilib aytganda: haqiqiy ofis va kasbiy ishlarda Grok 4.7 endi o’zidan bir necha baravar qimmat modellar bilan bir ligada o’ynaydi.

Obro’sidan ko’ra xavfsizroq

Grok cheklovlari kamroq chatbot sifatida tanilgan. 4.7 versiyasi uchun bu obro’ eskirgan. xAI butunlay yangi xavfsizlik tizimini qurganini aytadi va modelni xavfli so’rovlarni rad etish va jailbreak urinishlariga qarshi turish bo’yicha hozirgacha eng kuchli modeli deb ataydi. Shuningdek, kompaniya model himoyaviy xavfsizlik tadqiqotlari kabi qonuniy ishlarni kamdan-kam to’sishini ta’kidlaydi.

Grok hali ham javoblarini ogohlantirishlarga o’rab o’tirmasdan, to’g’ridan-to’g’ri javob berishga moyil. Lekin bu xavfsizlikning yo’qligi emas, uslub masalasi.

Ochig’ini aytsak, kamchiligi

U hali eng yangi raqiblar bilan to’qnashmagan. xAI jadvali Grok 4.7 ni GPT-5.6 Sol va Claude Fable 5.1 bilan solishtiradi. U chiqqanidan bir kun o’tib Anthropic Claude Opus 5.5 ni, OpenAI esa GPT-6 Sol ni chiqardi — ikkalasi ham kuchli va narxi qulay raqiblar. Mustaqil testlar ularni yonma-yon qo’ymaguncha, Grok’ning aniq o’rni noaniq bo’lib qoladi.

Terminalda uzoq ishlash hali ham zaif tomoni. Buyruqlar qatorida soatlab ishlashni sinaydigan Terminal-Bench 4.0 da Grok 4.7 37,6% oldi. Bu Grok 4.6 dagidan deyarli ikki baravar ko’p, lekin Fable 5.1 ning 57,9% natijasidan ancha orqada.

Tibbiyot uning kuchli tomoni emas. Klinik fikrlashni sinaydigan HealthBench Professional da u 56,7% oldi — bu GPT-5.6 Sol va Fable 5.1 dan past.

Bularning hammasi xAI raqamlari. Huquq va muhandislikdagi ustunliklari qiziqarli, lekin biz ularning mustaqil tasdiqlanishini ko’rishni istardik.

Kimga mos keladi

Agar kun bo’yi hujjatlar, tahlillar va texnik savollar ustida sun’iy intellekt bilan ishlasangiz va oylik hisob siz uchun muhim bo’lsa, Grok 4.7 ni jiddiy sinab ko’rishga arziydi. U eng yaxshi modellar sifatining katta qismini narxning kichik bir qismi evaziga beradi.

Mavjud eng puxta mulohaza kerak bo’lsa, Claude Opus 5.5 ni tanlang. Kompyuteringizdagi dasturlarni boshqaradigan agent kerak bo’lsa, GPT-6 Astra’ni tanlang. Ularning oralig’idagi hamma narsa uchun esa Grok 4.7 — cho’qqiga yaqin eng tejamkor model.

02

Kuchli tomonlar va halol cheklovlar

Asosiy afzalliklari

  • Arzon narxda yuqori darajaga yaqin ish: million kiritish tokeni uchun $2 va million chiqish tokeni uchun $6. Bu Claude Opus 5.5 chiqish narxining uchdan biridan kam va GPT-6 Astra narxining taxminan sakkizdan biri. Kun bo’yi sun’iy intellekt bilan ishlaydigan jamoalar uchun farq oylik hisobda ko’rinadi.
  • Yuridik ishda kutilmaganda kuchli: Harvey Legal Agent Benchmark da Grok 4.7 xAI jadvalida 19,6% natija ko’rsatib, Claude Fable 5.1 (6,7%) va GPT-5.6 Sol (2,5%) dan oldinga chiqdi. Bu barcha modellar hali past natija ko’rsatadigan qiyin test, lekin taqqoslashda Grok birinchi bo’ldi.
  • Muhandislik matematikasida yaxshi: elektrotexnika masalalarini sinaydigan EEBench da u 64,0% oldi — bu Fable 5.1 (56,4%) dan yuqori va Grok 4.6 (53,0%) dan ancha yuqori.
  • O’z ishini tekshiradi: xAI Grok 4.7 ni uzoqroq va qiyinroq vazifalarda o’qitdi hamda javoblarini tekshirish va uzun hujjatlar bilan ishlash usulini alohida yaxshiladi. Soatlab davom etadigan ofis ishini sinaydigan AA Briefcase da natijasi 1 546 dan 1 657 ga ko’tarildi — Fable 5.1 ning 1 678 natijasiga yaqin.
  • Nasihatsiz, lekin xavfsizroq: xAI xavfsizlik tizimini qaytadan qurdi. Kompaniya Grok 4.7 ni xavfli so’rovlarni rad etish va jailbreak urinishlariga qarshi turish bo’yicha hozirgacha eng kuchli modeli deb ataydi, shu bilan birga u himoyaviy xavfsizlik tadqiqotlari kabi qonuniy ishlarni kamdan-kam to’sadi.

Haqiqiy cheklovlar

  • Eng yangi raqiblar bilan solishtirilmagan: xAI jadvali Grok 4.7 ni GPT-5.6 Sol va Claude Fable 5.1 ga qarshi qo’yadi. Claude Opus 5.5 va GPT-6 Sol bir kundan keyin chiqdi, shuning uchun mustaqil to’g’ridan-to’g’ri taqqoslashlar hali yo’q.
  • Uzoq terminal sessiyalarida zaifroq: buyruqlar qatorida soatlab ishlashni sinaydigan Terminal-Bench 4.0 da u 37,6% oldi — bu Grok 4.6 ning 20,3% natijasiga nisbatan katta sakrash, lekin Fable 5.1 ning 57,9% natijasidan ancha orqada.
  • Tibbiyotda orqada: klinik fikrlashni sinaydigan HealthBench Professional da u 56,7% oldi — bu GPT-5.6 Sol (60,5%) va Fable 5.1 (62,1%) dan past.
  • Faqat ishlab chiqaruvchi raqamlari: bu yerdagi har bir raqam xAI e’lonidan olingan. Huquq va muhandislikdagi ustunliklarini mustaqil testlar tasdiqlamaguncha istiqbolli deb qabul qiling.
03

Benchmark natijalari

Harvey Legal Agent Benchmark — 19,6%

Agentlar bajaradigan yuridik ish. xAI jadvali: Grok 4.7 — 19,6%, Grok 4.6 — 15,8%, Claude Fable 5.1 — 6,7%, GPT-5.6 Sol — 2,5%. Juda qiyin test; unda past mutlaq natijalar odatiy hol.

EEBench — 64,0%

Elektrotexnika masalalarini yechish. Shu jadvalda Grok 4.6 — 53,0%, Claude Fable 5.1 — 56,4%, GPT-5.6 Sol — 39,4%.

AA Briefcase v1.1 — 1 657

Hujjatlar va taqdimotlar kabi soatlab davom etadigan ofis vazifalari. Grok 4.6 dagi 1 546 dan oshgan va 1 678 natijali Claude Fable 5.1 dan biroz orqada.

Terminal-Bench 4.0 — 37,6%

Terminalda soatlab ishlash. Grok 4.6 (20,3%) ga nisbatan katta yaxshilanish, GPT-5.6 Sol (37,3%) bilan teng, lekin xAI jadvalida Claude Fable 5.1 (57,9%) dan ancha orqada. (Anthropic'ning o'z sinovi Fable 5.1 ni 55,8% da, mustaqil testlar esa GPT-6 Astra va Claude Opus 5.5 ni 59,6% da ko'rsatadi.)

Narx — 1 mln token uchun $2 / $6

Grok 4.6 ga nisbatan o'zgarmagan. Tezkor variant ikki baravar narxga chiqish tezligini ikki baravar oshiradi.

04

Xulosa

Grok 4.7 «Kundalik ekotizim» toifasida cho’qqiga yaqin eng tejamkor model sifatida bizning 5-o’rinni saqlab qoladi. Bu sotib olish mumkin bo’lgan eng aqlli yordamchi emas: puxta mulohaza va dasturlarni boshqarishda Claude Opus 5.5 va GPT-6 Astra hali ham oldinda. Lekin Grok 4.7 ofis ishida ularga kutilmaganda yaqinlashadi, yuridik va muhandislik testlarida o’z chiqish jadvalining boshida turadi va narxi ularning kichik bir qismicha. Agar kun bo’yi sun’iy intellekt bilan ishlasangiz va hisobni kuzatib borsangiz, uni jiddiy sinab ko’rishga arziydi.

05

Ko'p so'raladigan savollar