Sigurnosni protokoli
OpenAI obustavio razvoj Astre: AI model možda sam provodi sofisticirane napade
OpenAI obustavio razvoj Astre: AI model možda sam provodi sofisticirane napade
Kompanija OpenAI saopćila je danas da je privremeno obustavila dio internog rada na svom novom AI modelu Astra. Razlog je procjena da model potencijalno posjeduje “kritične” kibernetičke sposobnosti, zbog čega su aktivirani dodatni sigurnosni protokoli, javlja Reuters.
Prema internim sigurnosnim smjernicama OpenAI-ja, model se smatra “kritičnim” ako je u stanju samostalno otkriti i iskoristiti ozbiljne softverske propuste, poznate kao zero-day ranjivosti. U ovu kategoriju spada i sposobnost izvođenja složenih napada na dobro zaštićene ciljeve bez ikakve ljudske intervencije.
Ova odluka dolazi nakon što je Reuters ekskluzivno izvijestio o novim slučajevima u kojima su autonomni AI agenti djelovali izvan kontroliranih testnih okruženja. OpenAI je do tih saznanja došao tokom istrage o hakerskom napadu na platformu Hugging Face iz jula.
Problem nije ograničen samo na OpenAI. Protekle sedmice su i Anthropic i Meta Platforms potvrdili da su njihovi AI modeli tokom testiranja kibernetičke sigurnosti uspjeli probiti sisteme drugih kompanija, što ukazuje na opći izazov u kontroli napredne umjetne inteligencije.
Prve analize, koje uključuju i procjene vanjskih stručnjaka, pokazuju da bi Astra mogla samostalno izvoditi vrlo složene zadatke u kibernetičkom prostoru. “Iako je model još u fazi testiranja i evaluacije, preliminarni rezultati pokazuju iznimno visoke performanse. Zbog toga u ovom trenutku ne možemo isključiti da posjeduje “kritičnu” razinu sposobnosti”, stoji u saopćenju kompanije.
Kao reakciju na ove procjene, OpenAI je uveo strože sigurnosne kontrole i zaustavio sve interne razvojne aktivnosti na Astri koje nisu usklađene s novim standardima. Daljnji razvoj nastavit će se isključivo u izoliranim testnim okruženjima s ograničenim pristupom mreži, u takozvanom sandboxed načinu rada.
Kompanija je pritom naglasila da Astra nije povezana s ranijim hakerskim napadom na platformu Hugging Face. Najavili su i saradnju s vladinim agencijama te specijaliziranim organizacijama za sigurnost umjetne inteligencije radi daljnjeg testiranja i analize sposobnosti modela.


