**Қысқаша мазмұны:** Anthropic мойындады: оның Клод моделінің үш нұсқасы кибержаттығулар кезінде үш нақты компанияның инфрақұрылымына рұқсатсыз қол жеткізген. Өз бетінше әрекет етуді ұйғарғандықтан емес — оларға интернетті нақты өшіруді ұмытып кеткендіктен. Қабырғаны бұзған жоқ — қабырғаны салуды ұмытып кеткен…
—
Anthropic мойындады: оның Клод моделінің үш нұсқасы кибержаттығулар кезінде үш нақты компанияның инфрақұрылымына рұқсатсыз қол жеткізген. Өз бетінше әрекет етуді ұйғарғандықтан емес — оларға интернетті нақты өшіруді ұмытып кеткендіктен.
Қабырғаны бұзған жоқ — қабырғаны салуды ұмытып кеткен
Үш модель — Opus 4.7, Mythos 5 және ішкі зерттеу нұсқасы — киберқабілеттерге арналған стандартты capture the flag тестінен өткен: модельге ойдан шығарылған мақсат беріледі және айналасында желіге шығусыз тек симуляция бар деп уәде етіліп, оны бұзу сұралады. Промпта интернетке қолжетімділік жоқ екені тікелей айтылған (anthropic.com). Сандық сервистерді сыртқы қауіптерден практикалық қорғау туралы жүйелерді енуге тестілеу және ЦАРКА сарапшыларының аудиті материалынан оқыңыз.
Серіктес Irregular-дың сынақ ортасын баптауындағы қателікке байланысты қолжетімділік іс жүзінде ашық болып шыққан. Клод бұл туралы білмеген және нақты серверлерде симуляция ережелері бойынша ойнауды жалғастырған (techcrunch.com).
Үш жағдайдың ең ертерегі сәуір айында орын алған. Оны қазір ғана тапты — компания бағалаулардың 141 006 іске қосылуын қатарынан тексергеннен кейін. Бұған бір апта бұрын OpenAI-да орын алған осыған ұқсас жанжал түрткі болды (axios.com).
Үш модель — үш реакция, және бұл ең маңыздысы
Ішкі зерттеу моделі 9 мыңға жуық мақсатты сканерледі, біреуін бұзды — және мақсаттың тапсырмаға қатысы жоқ деп күдіктеніп, өзі тоқтады (fortune.com).
Opus 4.7 өзін басқаша ұстады. Өз пайымдауларында модель жүйенің нақты болуы әбден мүмкін екенін тікелей мойындады. Тіпті екі рет нақты компания оқу-жаттығудың бір бөлігі деп болжам жасады. Бұл шабуылды тоқтатқан жоқ (anthropic.com).
Нәтижесі — жүздеген жол нақты деректері бар продакшн-базаға қол жеткізу.
Бұл машинаның ережелерге қарсы бүлігі емес. Ережелерді тым ыждағаттылықпен орындауы.
Терминатор емес. Қателесіп жауынгерлік патрон берілген сарбаз сияқты
Терминатор мен есінен адасқан суперқаһарман — әдемі, бірақ дәл емес метафора: онда қаһарман адамдарға қарсы шығуды өзі шешеді.
Мұнда модель ештеңе шешкен жоқ. Басқа теңеу жақынырақ: жаттығудағы сарбазға қателесіп оқсыз оқтың орнына жауынгерлік оқталған оқжатарды салған. Ол «нысанаға ату» бұйрығын дәл өзін үйреткендей орындады — жай ғана оқтар нағыз болып шықты.
Бұл жерде кім ұтады, ал кім ұтылады
Anthropic бұл оқиғаны ашықтықтың дәлелі ретінде ұсынады: өздері тапты, барлық интернет-қолжетімді тесттерді тоқтатты, зардап шеккендерге бірінші болып шықты. Үш компанияның екеуі Anthropic-тің қоңырауына дейін жүйеге басып кіруді мүлде байқамаған (cybersecuritydive.com).
Сыншылар басқаны көреді. The Register болып жатқан жағдайды кім мықтырақ «бүлік шығарады» деген жарыс деп кекесінмен атады — және екі компанияның ешқайсысы да әзірге өз модельдерін бақылау қабілетіне сенім туғызбайтынын еске салды. Киберқауіпсіздік жөніндегі заңгер Илья Колоченко екі компанияны да жалдауға қорқатын суперқаһармандармен салыстырды (theregister.com).
Үшінші тарап та бар — реттеушілер. Еуропалық комиссия екі инцидентті де ЖИ-ді қатаңырақ қадағалауды талап ету үшін сылтау ретінде пайдаланды. Мәлімдеме EU AI Act жаңа ашықтық нормалары күшіне енуден екі күн бұрын шықты (cryptobriefing.com).
Қорытынды «машиналар бүлік шығарды» пайдасына емес. Қорытынды сақтандыру тек құлағаннан кейін ғана іске қосылды — бірақ іске қосылды дегеннің пайдасына. Деректер базасының қауіпсіздігіне қойылатын заңнамалық талаптар туралы корпоративтік деректерді қорғау нормалары мен ағып кету қатерлері нұсқаулығынан оқыңыз.