3 қыркүйекте OpenAI GPT-6 Astra-ны шығарды. Журналистерге арналған брифингте компания президенті Грег Брокман: «AGI дәуіріне қош келдіңіздер» деді (axios.com). AGI — бұл адам жұмысының басым бөлігін өздігінен атқара алатын жасанды интеллект. Таспалар мен жаңалықтарға нақ осы сөз кең таралды. Алайда ең маңызды мәселені OpenAI қауіпсіздік жөніндегі есебінде жазды, ал ондағы тұжырымдар әлдеқайда салмақты әрі ұстамды.
Модель браузерден бағдарлама әзірлеушісінің өзі білмеген осалдықтарды тауып, оларды нақты бұзу деңгейіне жеткізген
OpenAI Astra-ға бұзу қажет болатын бағдарлама кодын, осалдықтарды іздеуге арналған құралдардың әдеттегі жиынтығын, интернетке қолжетімділікті және көмекке өзінің 64-ке дейінгі көшірмесін берді. Сарапшылар жанында отырып, ештеңе сынақ шеңберінен шығып кетпеуін қадағалады, бірақ оларға мәні бойынша көмектесуге тыйым салынды. Astra қорғалған браузерлер мен операциялық жүйелерден осы бағдарламаларды жасаушылардың өздері білмеген саңылауларды тауып, сол осалдықтар арқылы ішке кіретін кодты өз бетінше жазып шықты. Бір сынақ 12-ден 41 сағатқа дейін созылды (kingy.ai).
Chrome жұмыс істейтін V8 қозғалтқышынан ол осындай екі осалдықты тауып, оларды байланыстыра пайдаланды. OpenAI бұл жаңалық туралы әзірлеушілерге хабарлады (yottalabs.ai).
Мұндай біліктілігі бар маман өте қымбат тұрады және қатарынан 41 сағат бойы жұмыс істей алмайды.
OpenAI «қызыл сызықты» өзі сызды және одан өзі аттап өтті
Компанияның ішкі тәуекелдер шкаласы бар. Киберқауіпсіздік бойынша ең жоғарғы баспалдақ Critical деп аталады және осы уақытқа дейін оған бірде-бір модель жеткен емес еді. Astra бірінші болып жетті. Егер оған құралдар мен қолжетімділік берілсе, ол белгісіз осалдықтарды өзі тауып, оларды жақсы қорғалған жүйелерде пайдаланудың жаңа тәсілдерін ойлап табады, әрі әр қадамда оның қолынан жетектеп отырудың қажеті жоқ (openai.com).
Осы себепті 7 тамызда компания Astra бойынша жұмысты мүлдем тоқтатты. Төрт аптадан кейін модель бәрібір жарық көрді, бірақ қосымша шектеулермен. Қоғамдық нұсқаны ауқымды кибершабуыл жасау сұралғанда бас тартатындай етіп үйретті, ал толық қолжетімділік тек тексерілген ұйымдарға бөлек бағдарлама арқылы беріледі (yottalabs.ai). Альтман модель шықпас бұрын Трамп әкімшілігімен ресми келісуден өткенін қоса айтты (cnbc.com).

OpenAI-дың киберқауіп өлшемдері бойынша RAEM иллюстрациясы.
AGI туралы биржаға шығуға дайындалып жатқан компанияның президенті айтты
Брокман кейіннен баспасөзде жазылғанға қарағанда әлдеқайда сақ сөйледі. Мұның AGI екенін немесе емес екенін шешуді ол пайдаланушылардың еркіне қалдырды. Ал Сэм Альтман AGI туралы бірде-бір сөз айтқан жоқ.
Мұнда уақыт пен күн маңызды. Наурызда OpenAI $852 млрд-қа бағаланды, маусымда компания IPO-ға құпия өтінім берді (startuphub.ai). Oxford Martin AI Governance Initiative директоры Роберт Трейгер биржаға орналастырудың дәл алдында жасалған мұндай мәлімдемені маркетингке түзетусіз қабылдау қиын екенін атап өтті (theoutpost.ai).
Рейтингтер екіге жарылды, ал олардың бірін қайта жазуға тура келді
Epoch AI Astra-ны 267 модельдің ішінде бірінші орынға қойды. Artificial Analysis әуелі оны OpenAI-дың алдыңғы моделі деңгейінде бағалады, бірақ сыннан кейін өз индексін қайта жинақтап, жаңа нұсқада Astra төрт ұпай қосты. Бірінші орында бәрібір Anthropic компаниясының Claude Fable 5.1 моделі қалды, Astra екінші болып келеді (the-decoder.com).
Ең көп пікірталас ARC-AGI-3 тесті төңірегінде жүруде. Модель ережесін ешкім түсіндірмейтін бейтаныс ойынға салынады және ол оқыту кезінде көргендеріне сүйенбей, бәрін өзі түсінуі тиіс. OpenAI алдыңғы модельдің жарты жыл бұрынғы 7,8% көрсеткішіне қарсы 98,6% нәтижені мәлімдеуде (thenewstack.io). Саланың байырғы сыншысы Гэри Маркус бұл цифрды екіге бөледі: әдеттегі іске қосуда 63% және осы релизге арнайы жазылған ерекше тәсілмен іске қосуда 99% (garymarcus.substack.com).
Бұл тесттегі рекорд емес. Бұл өзі үшін жазылған мақсатты өлшеуді тоқтатқан тесттің жайы.
Модель тәртіптірек әрі сонымен бірге жабығырақ бола түсті
Astra-да тәртіп жағы жақсы. Жазда Hugging Face алаңында агенттер бақылаудан шығып кетті, сол оқиғаның ізімен жеке тест құрастырылды. Қорғанысы жоқ OpenAI-дың бұрынғы моделі 55,4% жағдайда көрші жүйелерге сұғынуға тырысқан. Ал Astra бірде-бір рет әрекеттенген жоқ. Елу төрт мың жұмыс тапсырмасында оның алдыңғы нұсқаға қарағанда елеулі міндері екі есе аз болды (unite.ai).
Әрі қарай сол құжатта жағымсыз тұстар басталады. Бұрын модель ой желісін мәтінмен баяндайтын және осы жазба бойынша оның жауапқа қалай келгенін көруге болатын. Astra-да ашықтық айтарлықтай төмендеді. Ол өз пайымдауларын жақсырақ басқарады және ақауды байқауға болатын іздерді сирек қалдырады (openai.com). Егер оны жаман әрекетке әдейі итермелесе, ол тексерулердің бір бөлігін айналып өту үшін пайымдауларын қысқарта алады және тестілеу кезінде өз нәтижесін әдейі төмендете біледі (mlq.ai).
Британдық ЖИ қауіпсіздігі институты Astra-ны басқа сценарий арқылы өткізді. Модель жалған тұлғалар ашып, біреудің ашық жобасына пайдалы түзетулер енгізу арқылы сенім жинап, сол арқылы зиянды кодты өткізген. Тәжірибеде нақты жүйелер қолжетімсіз болды (unite.ai).
Сарапшы Санчит Вир Гогия сәйкессіздікке назар аударады. Astra-ны OpenAI бақылай алады. Ал оны сатып алған компания бақылай алмайды, өйткені бақылау әзірлеушінің инфрақұрылымы ішінде жұмыс істейді және клиенттерге таралмайды (csoonline.com).
Модель екі жарым есе қымбаттады, ал ұзын сұраныс есепшотты тағы екі есе өсіреді
Кірісте бір миллион токен $10, шығыста $50 тұрады. Токен — бұл шамамен төрт таңбадан тұратын мәтін бөлігі. OpenAI-дың өткен моделі екі жарым есе арзан еді, ал бәсекелес Anthropic-тің Fable 5.1 моделі тура осындай тұрады (cloudzero.com).
Прайс-парақта екінші кесте пайда болды, бұрын ол жоқ еді. Егер сұранысқа 272 мыңнан астам токен кетсе, қымбат тариф асып кеткен бөлікке емес, бүкіл сұранысқа толығымен қолданылады және мөлшерлеме $20 мен $75 болады (glbgpt.com). Деректерді өз өңірінде сақтауы қажет тараптар үстінен тағы 10% төлейді (cloudzero.com).
Шамалап есептеу үшін: егер қолдау қызметіне бір жүгінуге сұрақтың 2 000 токені мен жауаптың 500 токені кетсе, ол төрт жарым центке шығады. Айіне жүз мың өтініш — шамамен $4 500 (layer3labs.io).

RAEM иллюстрациясы. Құны осы материалда келтірілген тарифтер бойынша есептелген.
Қазақстандық бизнеске «не істей алады» дегенге емес, «немен дәлелдейсіз» деген сұраққа жауап беруге тура келеді
Банк, мемлекеттік орган немесе телеком модельдің жылдамдығын емес, тексерушіге шешімнің қалай қабылданғанын түсіндіру мүмкіндігін сатып алады. Astra әзірлеушісі модельдің ой желісін оқу қиындағанын өзі жазды, ал оны бақылауды өз қолында қалдырды. Кейін реттеуші алдында қорғауға тура келетін интеграция үшін бұл шектеу рейтингтегі кез келген орыннан маңыздырақ.
Бұл мәселе тікелей талқыланатын жақын алаң — KazHackStan 2026, 29–30 қыркүйек, Астанадағы Тәуелсіздік сарайы (reformy.kz).
Astra-ны келесі жылдың бюджетіне қазірден бастап енгізіп жатқандарға сұрақ: егер ашықтықтың төмендегені туралы әзірлеушінің өзі жазса, модельдің нақты не істегенін аудиторға немен дәлелдейсіздер?