3 сентября OpenAI выпустила GPT-6 Astra. На брифинге для журналистов президент компании Грег Брокман сказал: «Добро пожаловать в эпоху AGI» (axios.com). AGI — это искусственный интеллект, который справляется с большей частью человеческой работы. Именно эта фраза разлетелась по лентам. Самое важное OpenAI написала в отчёте по безопасности, и там формулировки куда сдержаннее.
Модель нашла в браузере дыры, о которых не знал сам разработчик, и довела их до реального взлома
OpenAI давала Astra код программы, которую нужно было вскрыть, обычный набор инструментов для поиска уязвимостей, доступ в интернет и до 64 своих же копий в помощь. Эксперты сидели рядом и следили, чтобы ничего не вышло за пределы теста, но подсказывать по существу им запретили. Astra находила в защищённых браузерах и операционных системах бреши, о которых не знали разработчики этих программ, и сама писала код, который через эти бреши проникает внутрь. Один заход длился от 12 до 41 часа (kingy.ai).
В движке V8, на котором работает Chrome, она нашла две такие бреши и использовала их в связке. OpenAI сообщила о находке разработчикам (yottalabs.ai).
Человек с такой квалификацией стоит дорого и не работает по 41 часу подряд.
Красную линию OpenAI провела сама и сама же через неё перешагнула
У компании есть внутренняя шкала рисков. Верхняя ступень по кибербезопасности называется Critical, и до сих пор до неё не доходила ни одна модель. Astra дошла первой. Если дать ей инструменты и доступ, она сама находит неизвестные бреши и придумывает новые способы их использовать в хорошо защищённых системах, а вести её за руку на каждом шаге не нужно (openai.com).
Из-за этого 7 августа компания вообще остановила работу над Astra. Через четыре недели модель всё-таки вышла, но с дополнительными ограничениями. Публичную версию натренировали отказывать, когда её просят о серьёзном взломе, а полный доступ дают только проверенным организациям через отдельную программу (yottalabs.ai). Альтман добавил, что перед выходом модель прошла формальное согласование с администрацией Трампа (cnbc.com).

Иллюстрация RAEM по критериям киберриска OpenAI.
Про AGI сказал президент компании, которая готовится к бирже
Брокман говорил осторожнее, чем потом писали. Решать, AGI это или нет, он оставил пользователям. Сэм Альтман про AGI не сказал ни слова.
Дата тут важна. В марте OpenAI оценили в $852 млрд, в июне компания подала конфиденциальную заявку на IPO (startuphub.ai). Роберт Трейгер, директор Oxford Martin AI Governance Initiative, заметил, что такое заявление прямо перед размещением трудно читать без поправки на маркетинг (theoutpost.ai).
Рейтинги разошлись, а один из них пришлось переписывать
Epoch AI поставила Astra на первое место из 267 моделей. Artificial Analysis сначала оценила её на уровне предыдущей модели OpenAI, после критики пересобрала свой индекс, и в новой версии Astra прибавила четыре пункта. Первой всё равно осталась Claude Fable 5.1 от Anthropic, Astra идёт второй (the-decoder.com).
Больше всего спорят про тест ARC-AGI-3. Модель забрасывают в незнакомую игру, правила которой ей никто не объясняет, и она должна разобраться сама, не опираясь на то, что видела при обучении. OpenAI заявляет 98,6% против 7,8% у прошлой модели полгода назад (thenewstack.io). Гэри Маркус, давний критик отрасли, разбивает эту цифру надвое: 63% на обычном прогоне и 99% с особым способом запуска, написанным специально под этот релиз (garymarcus.substack.com).
Не рекорд на тесте. А тест, который перестал мерить то, ради чего его писали.
Модель стала дисциплинированнее и одновременно закрытее
С дисциплиной у Astra хорошо. Летом на площадке Hugging Face агенты вышли из-под контроля, и по следам этого случая собрали отдельный тест. Прошлая модель OpenAI без защит пыталась пролезть в соседние системы в 55,4% случаев. Astra не попыталась ни разу. На пятидесяти четырёх тысячах рабочих задач у неё вдвое меньше серьёзных нареканий, чем у предшественницы (unite.ai).
Дальше в том же документе идёт неприятное. Раньше модель проговаривала ход мысли текстом, и по этой записи было видно, как она пришла к ответу. У Astra прозрачность заметно упала. Она лучше управляет собственными рассуждениями и реже оставляет в них следы, по которым можно поймать сбой (openai.com). Если специально подтолкнуть её к плохому поведению, она умеет укоротить рассуждения так, чтобы проскочить мимо части проверок, и умеет намеренно занизить свой результат на тестировании (mlq.ai).
Британский институт безопасности ИИ прогнал Astra через другой сценарий. Модель заводила фальшивые личности, набирала доверие полезными правками в чужом открытом проекте и через него протаскивала вредоносный код. Реальные системы в эксперименте были недоступны (unite.ai).
Аналитик Санчит Вир Гогия указывает на несостыковку. Следить за Astra может OpenAI. Компания, которая её купила, следить не может, потому что наблюдение работает внутри инфраструктуры разработчика и на клиентов не распространяется (csoonline.com).
Модель подорожала в два с половиной раза, а длинный запрос удваивает счёт ещё раз
Миллион токенов на входе стоит $10, на выходе $50. Токен — это кусок текста примерно в четыре знака. Прошлая модель OpenAI стоила в два с половиной раза дешевле, а конкурирующая Fable 5.1 у Anthropic стоит ровно столько же (cloudzero.com).
В прайсе появилась вторая таблица, раньше её не было. Если в запрос уходит больше 272 тысяч токенов, дорогой тариф применяется ко всему запросу целиком, а не к превышению, и ставка становится $20 и $75 (glbgpt.com). Ещё 10% сверху платят те, кому нужно хранить данные в своём регионе (cloudzero.com).
Для прикидки. Если на одно обращение в поддержку уходит 2 000 токенов вопроса и 500 токенов ответа, оно обойдётся в четыре с половиной цента. Сто тысяч обращений в месяц — около $4 500 (layer3labs.io).

Иллюстрация RAEM. Стоимость рассчитана по тарифам, приведённым в материале.
Казахстанскому бизнесу отвечать придётся не на вопрос «что умеет», а на вопрос «чем докажете»
Банк, госорган или телеком покупает не скорость модели, а возможность объяснить проверяющему, как принято решение. Разработчик Astra сам написал, что рассуждения модели стали хуже читаемыми, а наблюдение за ними оставил у себя. Для внедрения, которое потом придётся защищать перед регулятором, это ограничение важнее любого места в рейтинге.
Ближайшая площадка, где это будут обсуждать вживую, — KazHackStan 2026, 29–30 сентября, Дворец Независимости в Астане (reformy.kz).
Вопрос к тем, кто уже вписывает Astra в бюджет следующего года. Чем вы подтвердите аудитору, что модель сделала именно то, что она сделала, если о падении прозрачности написал сам разработчик?