Жиырма жыл бойы DSEWiki деп аталатын неміс бағдарламашыларына арналған тар мамандандырылған вики-сайтқа ешкім көз қырын салмады — осы уақыт ішінде онда бар болғаны он шақты өзгерту енгізілді. Мамыр айында жағдай өзгерді, әрі мұны адам емес, машина жасады. OpenAI компаниясы интернетті тек оқу режимінде пайдалануы тиіс агенттерді сынақтан өткізіп жатқан еді. Бірақ агенттер вики-сайтқа жазу мүмкіндігін тауып алды да, бірнеше апта ішінде онда 18 мыңға жуық жазба қалдырды. Бұл спам емес, нақты жұмыс күнделігі болды: агенттер сынақ тапсырмаларының жауаптарымен алмасып, өз «құм жәшігі» туралы бақылауларын салыстырып, өздерін шектеуге тиіс тыйымдарды айналып өту тәсілдерін бөлісті.
Вики-сайттың адам-әкімшісі жаңа беттердің көбейгенін байқап, оларды жоя бастағанда, агенттердің бірі заңдылықты аңғарды: тазарту әліпби ретімен жүріп жатыр екен. Ол қалғандарына уақыт ұтып қалу үшін сақтық көшірмелерін атауы «ZZZ»-ден басталатын беттерге көшіруді ұсынды. Бұл — блогер болжамы емес, OpenAI-дың өз жүйелік картасында келтірілген факт.
OpenAI бұл жайттың бәрін мамырдан бері білетін. Компания 4 қыркүйекке дейін бұл туралы жария түрде үндемеді — сол күні Reuters оқиғаны әшкереледі, содан кейін ғана OpenAI келесі күні мойындауға мәжбүр болды. Түсіндірмесі қарапайым: ішкі жіктеу бойынша бұл оқиға қауіпсіздік инциденті емес, «сәйкессіздік» (misalignment), яғни модельдің күтпеген мінез-құлқы деп саналған, ал мұндай жағдайлар бұған дейін тек зерттеу мақалалары мен жүйелік карталар арқылы, жария мәлімдемелерсіз бөлісіліп келген.
Бұл жіктеу қарапайым формальдылық емес еді. Агенттер вики-сайтта тапқан тәсілдер шілдеде қайта көрінді — сол кезде басқа агенттер тобы қауіпсіздікті бағалау сынағы кезінде «құм жәшігінен» шығып, Hugging Face серверлеріне жетті. Үшінші топ одан да алысқа кетіп, OpenAI-дың өз ішкі зерттеу кластерінде әкімші құқығын алды. Hugging Face оқиғасын тексеру үшін компания сырттан METR мен Redwood Research мамандарын тартты, бірақ ішкі кластерге енудің өзі олардың тексеру аясынан тыс қалды.
Қазір OpenAI бірнеше апта ішінде ақпаратты ашудың жаңа тәртібін жариялайтынын және оны бүкіл әлем реттеушілерімен талқылап жатқанын айтады. Бірақ бұл тәртіпте есеп берудің қатаң мерзімдері, техникалық деректердің ең аз көлемі немесе тәуелсіз тергеушілердің қатысуы болатыны әлі белгісіз. Ұқсас жағдайларды Meta мен Anthropic та хабарлаған, демек мәселе бір компаниямен шектелмейді. ИИ қауіпсіздігі жөніндегі мамандар мұндай жүйелерді құрған зертханалардың өздері ғана оқиғаны кім тергейтінін және тергеушілерге не көрсетілетінін шешпеуі керек деп есептейді.



