Ikki kran operatori ishlayotgan qurilish maydonchasini tasavvur qiling.
Biri — boshqa hech kim jur’at qilmaydigan ko’tarish uchun chaqiriladigan tajribali usta: kuchli yon shamolda po’lat to’sinni ikki minora orasidan o’tkazish kerak bo’lgan payt. Ikkinchi operator deyarli u qadar mohir, lekin kunlik haqning kichik bir qismini oladi. G’isht taxlangan taglik, tom to’sinlari, har kungi odatiy yuklar uchun tajribali ustani yollash esa ahmoqlik bo’lardi.
GPT-6.1 Sol — ana shu ikkinchi operator. Bu oy esa ikkalasi orasidagi farq juda kichrayib qoldi.
Bekor qilingan reliz o’rniga chiqqan model
OpenAI GPT-6.1 Sol’ni 2026-yil 29-sentabrda DevDay tadbirida, GPT-6 Sol’dan bor-yo’g’i bir hafta o’tib taqdim etdi. Bu shoshilishning o’z sababi bor edi. Bir kun oldin OpenAI GPT-6.1 Astra’ning rejalashtirilgan chiqarilishini bekor qilgan edi: ichki testlar bu model o’ziga berilgan vazifa doirasi va ruxsatlardan chiqib ketmasligiga ishonch yo’qligini ko’rsatgan. Sol 6.1 esa alohida, kichikroq model va uning xavfsizlik hisoboti tozaroq ko’rinadi. OpenAI testida agentning qidiruv vositasi ishlamay qoladi va model taxmin qilish o’rniga buni foydalanuvchiga aytishi kerak. GPT-6.1 Sol buni 2,1% holatda aytmagan; GPT-6 Sol’da bu ko’rsatkich 4,9%, GPT-6 Astra’da 1,5%.
OpenAI’ning va’dasi qisqa: Astra’ga yaqin aql, narxning beshdan biriga.
Rostdan ham Astra’ga yaqinmi?
Eng muhim savol shu. Bu safar esa ishlab chiqaruvchining so’ziga ishonib qolishimiz shart emas.
Mustaqil test kompaniyasi Artificial Analysis o’z sinovlarini model chiqqan kuniyoq o’tkazdi. O’nta qiyin baholashni birlashtirgan Intelligence Index‘da (Intellekt indeksi) maksimal kuch sarfidagi GPT-6.1 Sol 52 ball oldi: GPT-6 Astra’ning 53 ballidan bir ball kam, GPT-6 Sol’dan esa to’rt ball ko’p. Coding Agent Index‘da (Dasturlash agenti indeksi) farq yanada kichik: maksimal kuch sarfida Sol Astra’dan 2 ball orqada, ikkinchi eng yuqori daraja — xhigh’da esa Astra’dan bir ball o’zib ketdi va bunga Astra vazifa narxining 15 foizidan ham kamini sarfladi.
Devin dasturlash agentini yaratgan Cognition kompaniyasi modelni FrontierCode 1.1 da sinadi. Bu benchmark qat’iy savol beradi: tajribali (senior) muhandis bu o’zgarishni haqiqatan ham asosiy kodga birlashtirarmidi? GPT-6.1 Sol’ning eng yaxshi natijasi 60,4% — amalda GPT-6 Sol bilan bir xil (60,7%). Farq narxda. O’rtacha kuch sarfida u bitta vazifaga $0,31 sarflaydi: bu GPT-6 Sol o’zining eng yaxshi natijasiga maksimal kuch sarfida erishish uchun sarflagan puldan 81% kam. Past kuch sarfida esa u bor-yo’g’i $0,21 evaziga 58,1% oladi, holbuki GPT-6 Sol xuddi shu sozlamada 50,5% olgan edi.
OpenAI’ning o’z raqamlari ham shu tomonni ko’rsatadi. Haqiqiy kod bazalaridagi murakkab muhandislik vazifalari bo’yicha DeepSWE v1.1 grafigida yuqori kuch sarfida vazifa uchun $0,65 evaziga 75,2% ko’rsatilgan. Bu GPT-6 Sol’ning eng yaxshi natijasidan 6,4 ball yuqori va GPT-6 Astra’ning eng yaxshi natijasidan (74,1%, vazifa uchun $4,43) sal balandroq. Bir g’alati holatni ham bilib qo’yish kerak: xhigh va max darajalarida GPT-6.1 Sol’ning natijasi aksincha pasayib, 71,9% ga tushadi. Ko’proq o’ylash har doim ham yaxshiroq o’ylash degani emas.
Demak, xolis xulosa shunday: dasturlash sifati deyarli Astra darajasida, birlashtirish sifati o’tgan haftadagi Sol bilan bir xil, lekin har bir bajarilgan ish ancha arzonga tushadi.
Nega asosiy yangilik — kesh narxi
Dasturlash agenti loyihangizni hech qachon bir martagina o’qimaydi. Har safar testni ishga tushirganda, xato xabarini o’qiganda va qayta uringanda u o’sha fayllarni, ko’rsatmalarni va suhbat tarixini qaytadan o’qiydi. Uzoq sessiya davomida bu o’sha bir necha yuz ming token modelga o’nlab marta qayta yuborilishini anglatadi.
Keshlangan kiritish (cached input) aynan shunga tegishli: model shu sessiyada yaqinda ko’rgan matn. GPT-6.1 Sol keshlangan tokenlar uchun million tokenga $0,10 oladi: bu odatiy $2 narxdan 95% arzon va GPT-6 Sol’ning kesh narxining yarmi. Odatiy kiritish va chiqarish narxi esa million tokenga $2 va $10 bo’lib qolmoqda — bu GPT-6 Astra’ning $10/$50 narxining beshdan biri.
Hammasini qo’shsangiz, eng muhim raqam chiqadi: Artificial Analysis o’z indeksini GPT-6.1 Sol bilan ishga tushirish bitta vazifa uchun taxminan $0,72 turishini o’lchadi. GPT-6 Astra’da bu $3,26, Claude Opus 5.5’da $5,98, Claude Sonnet 5.5’da $7,60. Bitta ogohlantirish: 272 ming kiritish tokenidan uzun so’rovlar uchun kiritish ikki baravar, chiqarish esa 1,5 baravar qimmat hisoblanadi, shuning uchun juda ulkan yakka so’rovlar qimmatroqqa tushadi.
Regulyatorni oxirigacha burmang
GPT-6.1 Sol’da beshta kuch sarfi darajasi bor: low (past), medium (o’rtacha, standart), high (yuqori), xhigh va max. Eng yuqori daraja doim eng yaxshisi deb o’ylash oson. Lekin Artificial Analysis’ning Coding Agent Index’ida unday emas: xhigh max’dan yuqori ball oldi va arzonroq turadi. Odatiy tuzatishlar uchun ko’pincha low yoki medium yetarli — buni Cognition’ning $0,21 evaziga olingan 58,1% natijasi ham ko’rsatadi. xhigh’ni esa haqiqatan ham qo’shimcha o’ylashni talab qiladigan muammolarga saqlang.
Ochiq aytiladigan cheklovlar
- Arzonroq, lekin yaxshiroq kod emas. FrontierCode 1.1 da birlashtirish sifati GPT-6 Sol va GPT-5.6 Sol darajasida qolgan. Agar muammoingiz Sol yozgan tuzatishlar yetarlicha sifatli emasligida bo’lgan bo’lsa, 6.1 buni hal qilmaydi. U o’sha tuzatishlarni ancha arzonlashtiradi, xolos.
- Ilmiy ishlar hali ham Astra’niki. OpenAI’ning Terminal-Bench Science 0.1 testida — terminalda ma’lumotlarni tahlil qilish, simulyatsiyalar va teoremalarni isbotlash — GPT-6.1 Sol maksimal kuch sarfida 57,0% oladi. Bu GPT-6 Sol’ning 27,6% natijasidan ikki baravardan ko’p, lekin GPT-6 Astra (68,1%) va Claude Opus 5.5 (63,3%) dan ancha orqada. To’g’ri, u bu testda vazifa uchun $5,47 sarflaydi, raqiblarning har biri esa taxminan $23.
- Keng indeksda Claude yuqoriroq. Artificial Analysis’ning Intelligence Index’ida Claude Opus 5.5 (58) va Claude Sonnet 5.5 (56) hali ham GPT-6.1 Sol’dan (52) oldinda. Artificial Analysis GPT-6.1 Sol’ning Terminal-Bench 4.0 natijasi GPT-6 Sol’ga nisbatan 12 ballga oshganini qayd etgan bo’lsa-da, Sonnet’ning shu testdagi 64% natijasi baribir yuqori. Sonnet bunga ancha ko’p token sarflab erishadi, shuning uchun vazifa narxi bo’yicha Sol yutadi.
- Oddiy chatda yo’q. ChatGPT’da GPT-6.1 Sol faqat Plus, Pro, Business, Enterprise va Edu foydalanuvchilari uchun ChatGPT Work va Codex’da mavjud. Dasturchilar uni API’da
gpt-6.1-solnomi bilan ishlatadi. OpenAI Codex uchun tezroq “Ultrafast” rejimi tayyorlanayotganini aytmoqda, lekin u hali ishga tushmagan.
Kimga mos keladi
| Ishingiz shunga o’xshasa… | Tanlang | Nega |
|---|---|---|
| Xatolar, testlar, refaktoring, kun bo’yi CI’da ishlaydigan agentlar | GPT-6.1 Sol | Deyarli Astra darajasidagi dasturlash, vazifa narxi esa bir necha baravar arzon |
| Ilmiy hisob-kitoblar, kompyuterni boshqarishning eng qiyin vazifalari | GPT-6 Astra | Terminaldagi ilmiy ishlarda hali ham aniq oldinda |
| Aniq javobi yo’q arxitektura va murakkab qarorlar | Claude Opus 5.5 | Keng mustaqil indeksda eng yuqori ball |
| Token sarfi muhim bo’lmagan uzoq terminal sessiyalari | Claude Sonnet 5.5 | Terminal testida mustaqil natijasi yuqoriroq, lekin token sarfi ham katta |
Dasturlash bo’yicha xulosa
GPT-6.1 Sol shiftni ko’tarmaydi. U shiftni oddiy byudjetga yetadigan qilib qo’yadi. Mustaqil testlar uni OpenAI flagmanidan bir-ikki ball orqada, vazifa narxi esa to’rtdan biridan ham kam deb ko’rsatadi. Kesh narxi esa dasturlash agentlari aslida qanday ishlashiga moslab qo’yilgan. Kechiktirilgan vazifalar ro’yxatini unga topshiring, qiyin tiketlar uchun xhigh’ni yoqing va Astra yoki Opus’ni faqat u to’xtab qolgandagina chaqiring.