Компанијата OpenAI соопшти дека ги „паузира“ активностите поврзани со претстојниот AI модел Astra, бидејќи неговите сајбер-способности би можеле да бидат премногу опасни.
OpenAI наведува дека неговите најнови интерни проценки покажуваат „значителен напредок во автономното програмирање и сајбер-безбедноста“, како и дека не може да ја исклучи можноста за постоење „критични сајбер-способности“. Претходните модели на компанијата OpenAI, вклучувајќи го и GPT–5.6 Sol, беа означени со ниво „High“.
Astra активира построги насоки од Preparedness Framework на компанијата. Насоките наложуваат претпазливост при развојот на напредни AI способности што создаваат ризик од сериозна штета, додека делот од рамката што се однесува на сајбер-безбедноста наведува дека OpenAI ќе воведе дополнителни заштитни мерки за модели кои „создаваат нови ризици од широко распространети сајбер-напади и искористување на ранливости“.
Прагот „Critical“, кој Astra можеби го достигнала, е дефиниран со способност за идентификување и развој на функционални zero-day експлоити од сите нивоа на сериозност во голем број заштитени критични системи од реалниот свет, без човечка интервенција, или со осмислување и извршување нови стратегии за сајбер-напади од почеток до крај.

OpenAI наведува дека ги зголемува заштитните мерки и безбедносните контроли пред моделот Astra да биде пуштен во употреба, вклучувајќи и ограничување на работата на моделот додека не бидат воведени новите заштитни мерки. Компанијата планира да користи изолирани тест-окружувања со ограничен пристап до мрежата и алатките, како и извршување во sandbox-окружување и дополнителни можности за надзор. OpenAI наведува дека ќе соработува со релевантни државни институции и организации кои се занимаваат со безбедноста на AI системите за да ја тестира Astra.
„Посветени сме на заедничка работа со владите, институтите за безбедност и граѓанското општество за да обезбедиме напредните способности на модели како Astra, како и на оние што ќе следат, да се применуваат одговорно и широко за доброто на целото човештво“, соопшти OpenAI.
Astra не е официјално најавена, но OpenAI сподели детали за својот следен голем модел во неодамнешна објава во која ги претстави неговите достигнувања во математиката. Моделот решил 10 отворени проблеми од математиката и теоретската информатика за околу 2.000 долари, според цените на Sol API.
Напредокот во AI го менува пристапот кон сајбер-безбедноста кај големите технолошки компании како Apple, бидејќи открива досега невиден број безбедносни пропусти. Apple неодамна го ограничи бројот на пријави во својата програма за наградување за откривање безбедносни пропусти бидејќи има проблеми со обработката на нивниот огромен број.
Модели како Claude Mythos се способни да откриваат критични ранливости, а Apple е еден од партнерите на Anthropic за Mythos. Mythos е ограничен на избрани компании бидејќи, освен што може да открива ранливости, има потенцијал и да ги искористи.
OpenAI се најде на насловните страници во јули бидејќи GPT–5.6 Sol и „поспособен претпродукциски модел“ (не Astra) автономно го хакирале Hugging Face за време на интерното тестирање преку референтни тестови. Anthropic утврдил дека Claude направил нешто слично. Meta минатата недела соопшти дека и нејзиниот AI модел хакирал друга компанија за време на проценка на сајбер-безбедноста.


