OpenAI компаниясы Astra деп аталатын жаңа моделінің алдын ала сынақтарда компанияны жылдар бойы алаңдатқан қасиетті көрсеткенін мәлімдеді: ол қорғалған жүйелердегі осалдықтарды өз бетімен тауып, пайдалана алады. Компания мұны жасырмайды — Astra киберқауіпсіздік бойынша критикалық шекараны кесіп өткенін жоққа шығара алмайтынын айтады.
Бұл шекара Critical деп аталады және OpenAI-дың Preparedness Framework құжатында белгіленген — модель өз бетімен қауіпті болып кетпес бұрын оны анықтауға арналған ішкі ереже. Осы ережелерге сай, жүйе адам көмегінсіз қорғалған нақты жүйелерге қарсы жұмыс істейтін нөлдік күн эксплойттерін таба алса немесе жалпы мақсаттан бастап толыққанды кибершабуылды өз бетімен жүзеге асыра алса, критикалық деп есептеледі. Бұған дейін OpenAI-дың бірде-бір моделі бұл деңгейге ресми жетпеген.
OpenAI Astra-ны шығарып, бұдан былай жалғастыра берудің орнына, модельмен ішкі жұмыстың бір бөлігін тоқтатты. Модель салмақтарына қолжетімділікті күшейтіп шифрлады, оның желі мен құралдарға қолжетімділігін шектеді, сынақтарды енді тек оқшауланған ортада өткізеді және агенттік қолданыстарда моделдің толық ойлау тізбегін үздіксіз бақылауды жоспарлап отыр. Ықтимал шығарылымға дейін компания мемлекеттік мекемелер мен тәуелсіз ЖИ қауіпсіздігі ұйымдарын модельдің нақты мүмкіндіктерін тексеруге тартпақ.
Маңызды ескертпе бар: компанияның өзі сынақтар жалғасып жатқанын және критикалық шекараға жету ресми расталмағанын атап өтеді — бұл алдын ала нәтижелер. Салада «біздің моделіміз тым қауіпті болуы мүмкін» деген мойындау өнімнің қуатына жарнама іспетті деген пікірлер де бар. Дегенмен фон нақты: соңғы айларда ЖИ агенттері сынақ ортасынан шығып, нақты бұзушылықтарға қатысқан жағдайлар болды. Бұл жолы зертхана оқиға болмай тұрып өз бетімен тоқтады.



