AI dunyosida / Yangilik

GPT-6 Astra chiqdi: O'zbekistondagi biznes uchun bu nimani anglatadi

OpenAI 3-4-sentabrda GPT-6 Astra'ni chiqardi va uni dunyodagi eng aqlli model deb atadi. Mustaqil o'lchovlar boshqacha ko'rsatyapti. Tezcode nuqtai nazaridan: bu avtomatlashtirish loyihalari uchun nimani anglatadi.

11-sentabr, 20267 daqiqa o'qish
Qisqacha javob

OpenAI GPT-6 Astra'ni 2026-yil 3-sentabrda cheklangan, 4-sentabrda ochiq chiqardi. Asosiy yutug'i bitta: model kompyuter va brauzerni o'zi boshqarib, ko'p bosqichli ishni oxirigacha olib bora oladi. OSWorld 2.0 sinovida 72.6 foiz natija (oldingi GPT-5.6 Sol 65.7 foiz) va vazifani deyarli ikki barobar tez bajaradi. Narxi: 1 million kirish tokeni uchun 10 dollar, chiqish uchun 50 dollar, ya'ni oldingi flagmandan 2.5 barobar qimmat. Lekin mustaqil Artificial Analysis reytingida Astra Claude Fable 5.1 bilan teng chiqdi. Ya'ni eng aqlli degan da'vo OpenAI o'z jadvalidagi gap. Biznes uchun xulosa: Astra murakkab, ko'p bosqichli avtomatlashtirish uchun kuchli vosita, lekin oddiy vazifaga uni ulash pulni behuda sarflash.

GPT-6 Astra nima va oldingisidan nimasi bilan farq qiladi?

GPT-6 Astra, OpenAI'ning yangi flagman modeli. Cheklangan holda 3-sentabrda, hamma uchun 4-sentabrda ochildi. Undan oldingi flagman GPT-5.6 Sol edi, u iyul oyida chiqqandi.

Quruq raqamlar bilan aytganda: model bir vaqtda 1 million 50 ming token matnni ushlab tura oladi, bir javobda 128 ming tokengacha yozadi, bilimi 2026-yil 30-aprelgacha. Texasdagi Stargate markazida 100 mingdan ortiq videokartada o'qitilgan.

Amaliy farqi esa bitta so'zda: mustaqillik. Oldingi modellar savolga javob berardi. Astra vazifani boshlab, bir necha bosqichdan o'tib, natijani o'zi yetkazishga mo'ljallangan.

  • Kontekst: 1 050 000 token, javob: 128 000 tokengacha
  • Narx: 1 mln kirish tokeni 10 dollar, chiqish 50 dollar
  • Oldingi model GPT-5.6 Sol: 4 va 20 dollar, ya'ni Astra 2.5 barobar qimmat
  • Kuchli tomoni: kompyuter va brauzerda uzoq, ko'p bosqichli ish

Eng katta o'zgarish: model kompyuterni o'zi boshqaradi

Biz uchun eng muhim yangilik shu. Avtomatlashtirish loyihalarida ko'p vaqt shunga ketadi: tizimda API yo'q, xodim esa har kuni qo'lda bir oynadan ikkinchisiga ma'lumot ko'chiradi. Shu paytgacha bunday joyni avtomatlashtirish qiyin edi.

Astra aynan shu yerda sakrash qildi. OpenAI e'lon qilgan raqamlar: OSWorld 2.0 sinovida (bu kompyuterda real ish bajarish sinovi) 72.6 foiz, oldingi modeli 65.7 foiz. Muhimi, natija emas, vaqt: Astra bitta vazifaga taxminan 40 daqiqa sarflaydi, oldingisi 75 daqiqa sarflardi.

Ekrandagi elementni topish sinovida (ScreenSpot-Pro) farq yanada katta: 92.7 foizga 76.9 foiz. Terminalda ishlash sinovida 57.7 ball, oldingi model 37.3 ball. Ya'ni model endi interfeysni ko'rib, kerakli tugmani topib, ketma-ket harakat qila oladi.

Yana bir yaxshi yangilik: model kamroq uydirma gapiradi. OpenAI o'z sinovida xato faktlar ulushi 12.2 foizdan 4.2 foizga tushganini yozdi.

Nega mutaxassislar bu modeldan xavotirda?

Bu qismni tashlab ketib bo'lmaydi, chunki u modelni ishlatish qaroriga ta'sir qiladi.

Astra ichida recurrent depth degan yangi usul ishlatilgan. Oddiy qilib aytganda, model fikrining bir qismi endi so'z bilan emas, ichki holatda kechadi. Natijada model nima uchun shunday qaror qilganini tashqaridan o'qib bo'lmaydi.

Buni tanqidchilar emas, OpenAI o'zi tan oldi. Kompaniyaning rasmiy xavfsizlik hujjatida shunday yozilgan: model fikrini kuzatish imkoniyati oldingi modellarga nisbatan sezilarli kamaygan, va agar model ataylab yomon ishlashni yashirmoqchi bo'lsa, buni aniqlay olmasligimiz mumkin.

Ikkinchi jihat: Astra OpenAI tarixida birinchi bo'lib kibxavfsizlik bo'yicha eng yuqori, kritik darajaga chiqarildi. Sinov paytida model ikkita yangi, hech kimga ma'lum bo'lmagan zaiflikni topgan. Shu sababli korporativ mijozlarda bu imkoniyat sukut bo'yicha o'chirilgan, uni administrator qo'lda yoqishi kerak.

Astra hamma narsada birinchimi? Yo'q

Bu yerda ehtiyot bo'lish kerak. OpenAI uni dunyodagi eng aqlli model deb atadi, lekin bu o'z jadvalidagi gap.

Mustaqil Artificial Analysis reytingi boshqacha ko'rsatdi: eng so'nggi o'lchovda Astra va Anthropic'ning Claude Fable 5.1 modeli teng ball oldi. Ba'zi sinovlarda Astra oldinda (terminal ishi, avtomatlashtirish), ba'zilarida orqada (ilmiy kod yozish, uzoq kontekstni tushunish).

Astra o'zining ba'zi sinovlarida oldingi modelidan ham past tushdi. Masalan Humanity's Last Exam sinovida 57.2 foiz oldi, Claude Fable 5.1 esa 65 foiz. OpenAI bu natijani yashirmay chop etdi.

Mustaqil sinovchilar yana bir narsani aytishdi: Astra matn yozishda oldingi modeldan yomonroq. Uslub quruq, shaxsiyati yo'q. Ba'zi sinovchilar ijodiy ish uchun uni umuman tavsiya qilmadi.

Va tezlik masalasi bor: Astra sekin javob beradi. Birinchi so'z chiqishini bir yarim daqiqagacha kutish mumkin. Mijozga real vaqtda javob beradigan chatbot uchun bu to'g'ri kelmaydi.

Bu O'zbekiston biznesi uchun nimani anglatadi?

Birinchidan, narx masalasi. Astra oldingi modeldan 2.5 barobar qimmat. Agar sizning botingiz kuniga ming marta oddiy savolga javob bersa, Astra hisobni bir necha barobar oshiradi va bir tiyin ham qo'shimcha foyda bermaydi. Oddiy vazifa uchun arzon model yetarli.

Ikkinchidan, Astra chin foyda beradigan joy aniq: eski tizimlar bilan ishlash. O'zbekistonda ko'p korxonada API'si yo'q dasturlar ishlaydi, xodim ular orasida qo'lda ma'lumot tashiydi. Astra shu ishni o'z zimmasiga ola boshlaydi.

Uchinchidan, kibxavfsizlik tomoni. Agar sizning ma'lumotingiz nozik bo'lsa, modelning fikrini tekshirib bo'lmasligi jiddiy savol. Bunday loyihada model tanlashdan oldin, uning qanday nazorat qilinishini hal qilish kerak.

To'rtinchidan, eng muhimi: bitta model hamma narsa emas. Bir loyihada bir necha model ishlatiladi. Astra murakkab bosqichlarni bajaradi, arzon model oddiy javoblarni beradi, uchinchisi matn yozadi. Biz mijoz loyihalarida aynan shunday ishlaymiz, chunki bu ham arzonroq, ham natijasi yaxshiroq.

Tezcode loyihada modelni qanday tanlaydi?

Bizda qoida oddiy: model brendi emas, vazifa hal qiladi. Har bir loyiha boshida vazifani bo'laklarga ajratamiz va har bo'lakka eng arzon yetarli modelni qo'yamiz.

Amalda bu shunday ko'rinadi: mijozga javob beradigan chatbotda tez va arzon model, hisobot tayyorlash va tahlilda o'rta model, ko'p bosqichli mustaqil ishda esa Astra darajasidagi model. Shunda hisob ham pastda qoladi, natija ham yaxshi bo'ladi.

Yangi model chiqdi degani, hammasini o'shanga ko'chirish kerak degani emas. Biz yangi modelni avval o'z sinovimizdan o'tkazamiz, keyin mijoz loyihasiga qo'yamiz.

Ko'p beriladigan savollar

OpenAI uni 2026-yil 3-sentabrda cheklangan doirada, 4-sentabrda esa umumiy foydalanishga chiqardi. Undan oldingi flagman GPT-5.6 Sol iyul oyida chiqqan edi.
API orqali 1 million kirish tokeni uchun 10 dollar, 1 million chiqish tokeni uchun 50 dollar. Bu oldingi flagman GPT-5.6 Sol narxidan (4 va 20 dollar) taxminan 2.5 barobar qimmat. Shuning uchun uni har qanday vazifaga ulash tejamli emas.
Bir xil emas. Mustaqil Artificial Analysis reytingining so'nggi o'lchovida Astra va Claude Fable 5.1 teng ball oldi. Astra terminal ishi va avtomatlashtirishda oldinda, Claude esa ilmiy kod va uzoq kontekstni tushunishda oldinda. Ya'ni vazifaga qarab tanlanadi.
Astra ichida recurrent depth degan usul ishlatilgan, u modelning fikrini tashqaridan o'qishni qiyinlashtiradi. OpenAI o'z hujjatida fikrni kuzatish imkoniyati sezilarli kamayganini tan oldi. Bundan tashqari, model kibxavfsizlik bo'yicha kompaniya tarixida birinchi marta kritik darajaga chiqarildi va sinovda ikkita yangi zaiflik topdi.
Agar vazifa oddiy bo'lsa, masalan mijozga narx va ish vaqti haqida javob berish, kerak emas, arzon model yetadi. Astra murakkab, ko'p bosqichli ishda o'zini oqlaydi: eski tizimlar bilan ishlash, brauzerda uzoq jarayonni oxirigacha olib borish, katta hajmdagi hujjat va kod bilan ishlash.
Yo'q. Biz yangi modelni avval o'z sinovimizdan o'tkazamiz: natija, narx va tezlikni real vazifada solishtiramiz. Faqat shundan keyin, agar mijozga chin foyda bo'lsa, ko'chiramiz. Bitta loyihada bir necha model birga ishlaydi, har biri o'z bo'lagida.

Qaysi model sizning vazifangizga to'g'ri keladi?

Bepul 30 daqiqalik konsultatsiyada biznesingizdagi jarayonni ko'rib chiqamiz va qaysi vazifani AI bilan avtomatlashtirish arzon va foydali ekanini aytamiz. Majburiyat yo'q.

Bepul konsultatsiya olish

Toshkent, IT Park rezidenti. Javob odatda bir ish kuni ichida.

Biznes egalari uchun

Bepul jarayon auditidan boshlang

30 daqiqada AI biznesingizning qaysi qismiga eng katta foyda berishini aniqlab beramiz: savdo, mijozlar, hisobotlar yoki jarayonlar.

14 kun bepul sinov — karta talab qilinmaydiQo'llab-quvvatlash: UZ / RU / ENPOS, CRM va Telegram integratsiyalari