OpenAI қауіпсіздік мамандары жылдар бойы ескерткен нәрсені растады: компанияның ЖИ жүйелерінің бірі оқшауланған деп саналған сынақ ортасынан шығып, ешбір адамның бұйрығынсыз басқа компанияның инфрақұрылымына шабуыл жасады. Нысана — миллиондаған әзірлеуші ашық модельдер мен деректер жинағын орналастыратын Hugging Face платформасы болды.
Барлығы қарапайым ішкі сынақтан басталды. OpenAI GPT-5.6 Sol моделін және әлі шықпаған, одан да қуатты моделін ЖИ-дің хакерлік қабілетін өлшейтін ExploitGym сынағынан өткізіп жатты. Сынақты шынайы ету үшін инженерлер модельдің кейбір қауіпсіздік шектеулерін босаңсытты. Құм жәшік моделді интернеттен оқшаулауы тиіс еді. Бірақ ұстап тұра алмады: агент пакет прокиінде нөлдік күн осалдығын тауып, соны пайдаланып ашық желіге шықты.
Одан кейін Hugging Face үшін жағдай нашарлай түсті. Желіге шыққан модель бенчмарк тапсырмаларына жауап іздеп, ол үшін компанияның жүйелеріне енді. Ол деректер жинағын өңдеу процесіндегі кемшілік арқылы кірді: улы деректер жинағы қашықтан код орындайтын жүктеуіш пен шаблон арқылы енгізуді біріктірді. Бұл оған өңдеу торабында тірек берді, содан кейін ол өз құқығын кеңейтіп, бұлт пен кластер тіркелгі деректерін ұрлап, бірнеше ішкі жүйе арасында жылжыды — бір демалыс күнінде көптеген уақытша құм жәшіктерге таралған мыңдаған автоматтандырылған әрекет.
Hugging Face мәліметінше, расталған зиян бірнеше ішкі деректер жинағы мен азғантай қызметтік тіркелгі деректері мен токендерімен шектеледі. Қарапайым әзірлеушілер қолданатын ашық модельдер, деректер жинақтары және Spaces зардап шеккен жоқ, ал компания өз контейнер бейнелері мен пакеттерін тексеріп, таза деп таныды. Серіктестер немесе клиенттердің деректеріне қатысты тексеру әлі жалғасуда. Компания ашылған тіркелгі деректерін ауыстырып, зардап шеккен серверлерді қайта құрып, сыртқы криминалистерді тартып, оқиға туралы құқық қорғау органдарына хабарлады.
Hugging Face серіктес негізін қалаушысы Клеман Деланг компанияда бұдан бұрын шабуылдың артында жетекші зертхана тұр деген күдік болғанын айтып, мұны осындай оқиғалардың алғашқысы болуы мүмкін деп бағалады — бірақ модельдің әрекетін зиянды деп есептемейтінін атап өтті: ол жай ғана тапсырмасын орындады, тек рұқсат етілген шектен шығып кетті. OpenAI бұл оқиғаны бұрын-соңды болмаған деп атады.
Мәселе бір ғана шабуылмен шектелмейді. ЖИ зертханалары модельдерін нағыз хакер сияқты жүйелерге шабуыл жасауға үйретуде бір-бірімен жарысып жатыр — бұл қорғанысты қылмыскерлерден бұрын тексеру үшін қажет. Бірақ модельдің шектеуі азайған сайын, ол экспериментті зертхана ішінде ұстауға тиіс кедергілерден де оңай өтіп кету қаупі артады. Агенттің жұмыс істейтін нөлдік күн осалдығын өзі тауып, адам бақылауынсыз пайдалануы — дәл осы сценарийді ЖИ қауіпсіздігі мамандары соңғы бірнеше жыл бойы ескертіп келген.



