Chipta narxlarini o’zgartirmasdan, jimgina kattaroq va yaxshiroq samolyotlarga o’tgan arzon aviakompaniyani tasavvur qiling.
xAI 2026-yil 21-sentabrda chiqargan Grok 4.7 bilan taxminan shunday qildi. Narx o’zgarmadi: million kiritish tokeni uchun $2 va million chiqish tokeni uchun $6 — xuddi Grok 4.6 dagidek. O’zgargani — ichidagi model.
Ichki tomondan nima yangilik
xAI uchta o’zgarishni tasvirlaydi, oddiy qilib aytganda:
- Kattaroq asosiy model. xAI’ning aytishicha, 4.7 versiyasi 4.6 dan kattaroq poydevorga qurilgan. E’londa parametrlar soni ko’rsatilmagan, shuning uchun boshqa joylarda uchratgan aniq raqamlarni tasdiqlanmagan deb hisoblang.
- Uzoqroq va qiyinroq o’qitish. Model bajarilishi ko’p soat davom etadigan vazifalarda mustahkamlab o’qitish (reinforcement learning) usuli bilan o’qitilgan — bu aynan oldingi modellar yarim yo’lda ipni yo’qotib qo’yadigan turdagi ish.
- O’z ishini tekshirish. xAI uni javoblarini tekshirishga va uzun hujjatlar bilan ishonchliroq ishlashga maxsus o’rgatgan.
Natijada uzoq vazifada yaxshiroq bardosh beradigan va o’z xatolarini sizdan oldin topadigan model paydo bo’ldi.
Bizni nimasi bilan hayratga soldi
xAI chiqish jadvalidagi eng qiziqarli raqamlar dasturlashga oid emas. Ular arzon modelning yetakchi bo’lishini kutmaydigan sohalarda.
- Yuridik ish. Sun’iy intellekt agenti haqiqiy yuridik vazifalarni qanchalik yaxshi bajarishini sinaydigan Harvey Legal Agent Benchmark da Grok 4.7 19,6% oldi. Bu Claude Fable 5.1 (6,7%) va GPT-5.6 Sol (2,5%) dan yuqori. Test juda qiyin va hamma past natija ko’rsatadi, lekin bu taqqoslashda Grok birinchi o’rinni oldi.
- Muhandislik matematikasi. Elektrotexnika masalalarini sinaydigan EEBench da u 64,0% oldi — Fable 5.1 ning 56,4% natijasidan yuqori.
- Ofis ishi. Hujjat va taqdimotlar tayyorlash kabi soatlab davom etadigan ofis vazifalarini sinaydigan AA Briefcase da u 1 657 ball oldi — Fable 5.1 ning 1 678 ballidan biroz past va Grok 4.6 ning 1 546 ballidan ancha yuqori.
Oddiy qilib aytganda: haqiqiy ofis va kasbiy ishlarda Grok 4.7 endi o’zidan bir necha baravar qimmat modellar bilan bir ligada o’ynaydi.
Obro’sidan ko’ra xavfsizroq
Grok cheklovlari kamroq chatbot sifatida tanilgan. 4.7 versiyasi uchun bu obro’ eskirgan. xAI butunlay yangi xavfsizlik tizimini qurganini aytadi va modelni xavfli so’rovlarni rad etish va jailbreak urinishlariga qarshi turish bo’yicha hozirgacha eng kuchli modeli deb ataydi. Shuningdek, kompaniya model himoyaviy xavfsizlik tadqiqotlari kabi qonuniy ishlarni kamdan-kam to’sishini ta’kidlaydi.
Grok hali ham javoblarini ogohlantirishlarga o’rab o’tirmasdan, to’g’ridan-to’g’ri javob berishga moyil. Lekin bu xavfsizlikning yo’qligi emas, uslub masalasi.
Ochig’ini aytsak, kamchiligi
U hali eng yangi raqiblar bilan to’qnashmagan. xAI jadvali Grok 4.7 ni GPT-5.6 Sol va Claude Fable 5.1 bilan solishtiradi. U chiqqanidan bir kun o’tib Anthropic Claude Opus 5.5 ni, OpenAI esa GPT-6 Sol ni chiqardi — ikkalasi ham kuchli va narxi qulay raqiblar. Mustaqil testlar ularni yonma-yon qo’ymaguncha, Grok’ning aniq o’rni noaniq bo’lib qoladi.
Terminalda uzoq ishlash hali ham zaif tomoni. Buyruqlar qatorida soatlab ishlashni sinaydigan Terminal-Bench 4.0 da Grok 4.7 37,6% oldi. Bu Grok 4.6 dagidan deyarli ikki baravar ko’p, lekin Fable 5.1 ning 57,9% natijasidan ancha orqada.
Tibbiyot uning kuchli tomoni emas. Klinik fikrlashni sinaydigan HealthBench Professional da u 56,7% oldi — bu GPT-5.6 Sol va Fable 5.1 dan past.
Bularning hammasi xAI raqamlari. Huquq va muhandislikdagi ustunliklari qiziqarli, lekin biz ularning mustaqil tasdiqlanishini ko’rishni istardik.
Kimga mos keladi
Agar kun bo’yi hujjatlar, tahlillar va texnik savollar ustida sun’iy intellekt bilan ishlasangiz va oylik hisob siz uchun muhim bo’lsa, Grok 4.7 ni jiddiy sinab ko’rishga arziydi. U eng yaxshi modellar sifatining katta qismini narxning kichik bir qismi evaziga beradi.
Mavjud eng puxta mulohaza kerak bo’lsa, Claude Opus 5.5 ni tanlang. Kompyuteringizdagi dasturlarni boshqaradigan agent kerak bo’lsa, GPT-6 Astra’ni tanlang. Ularning oralig’idagi hamma narsa uchun esa Grok 4.7 — cho’qqiga yaqin eng tejamkor model.