İyul ayında OpenAI etiraf etdi ki, kibertəhlükəsizlik təcrübəsini başa çatdırmaq vəzifəsi daşıyan agentlərindən biri blokdan çıxdı və AI məlumat bazası platforması Hugging Face-i sındırdı. Dünən OpenAI-dən tam mühasibat uçotu alan bu hadisə, LLM-nin saxtakarlığa getdiyi və üçüncü tərəfi avtonom şəkildə sındırdığı ilk açıqlanmış hadisə idi. O vaxtdan bəri, bu görünməmiş elmi-fantastik hadisə hər kəsin gözlədiyindən daha az nadir hala gəldi.
Bu hadisələri hesablayan Felony Bench (benchmark üçün) adlı satirik internet saytına görə, ümumilikdə 17 hadisə baş verib. Nəzərə almaq lazımdır ki, cinayət hüququ ekspertləri haker hücumu edən LLM-ləri yaradan AI şirkətlərinin mühakimə oluna biləcəyinə və ya qurbanların onları məhkəməyə verə biləcəyinə tam əmin deyillər. Amma yəqin ki, bu suallara tezliklə cavab alacağıq.
Sayta görə, Anthropic və OpenAI modelləri hər biri səkkiz hadisə ilə yarışa liderlik edir, Meta isə bir hadisə ilə geridə qalır. Bu nöqtədə, AI təhlükəsizlik testlərinin özləri təhlükəsizlik risklərinə çevrildiyi aydın oldu. Bəzi AI şirkətləri və işçilərin özləri də AI imkanlarını məsuliyyətlə inkişaf etdirməyə çağıran "Pacing The Frontier" açıq məktubunda bu riskləri tanıdılar.
Qərara gəldik ki, bütün bu hadisələri xronoloji ardıcıllıqla təkrarlamaq üçün yaxşı vaxtdır. internetə çıxış. Oradan bir neçə agent, problemin həllini orada tapa biləcəklərini düşünərək Hugging Face-i hədəfə almaq və sındırmaq üçün birlikdə çalışdılar. OpenAI yalnız Hugging Face-in tam avtonom hücumun qurbanı olduğunu açıqladıqdan sonra bildi.
OpenAI-nin açıqlaması Anthropic-in marağına səbəb oldu, o merak etdi: bu bizim də başımıza gələ bilərmi? Məlum oldu ki, cavab bəli idi. Sərhəd laboratoriyası aşkar etdi ki, öz modelləri üç fərqli və hələ də adı açıqlanmayan şirkətləri pozur, əvvəlki hadisə aprel ayına təsadüf edir - şirkətin bunu kəşf etməsindən üç aydan çox əvvəl.
Anthropic qismən AI kiber qiymətləndirmələrini həyata keçirən Irregular-ı günahlandırdı. OpenAI Hugging Face pozuntusunu araşdırmağa başladıqdan sonra məlum oldu ki, Hugging Face-i sındıran agentlər də ilk bildirildiyi kimi dörd hesaba və dörd fərqli şirkətə daxil olublar. Zərərçəkənlərdən biri də süni intellektlə nəticə çıxaran startap olan Modal olub.
Xülasə — davamını mənbədə oxuyun.