IT

OpenAI odgađa sljedeći veliki AI model Astra zbog ozbiljnih sigurnosnih problema vezanih za hakovanje

Kompanija OpenAI je saopćila da "pauzira" aktivnosti povezane s nadolazećim AI modelom Astra, jer bi njegove cyber sposobnosti mogle biti previše opasne.

FOTO: UNSPLASH
FOTO: UNSPLASH
Ilustracija

OpenAI navodi da njegove najnovije interne procjene pokazuju “značajan napredak u autonomnom programiranju i cyber sigurnosti” te da ne može isključiti mogućnost postojanja “kritičnih cyber sposobnosti”. Prethodni modeli kompanije OpenAI, uključujući GPT5.6 Sol, bili su označeni nivoom “High”.

Astra aktivira strožije smjernice iz Preparedness Frameworka pomenute kompanije. Smjernice nalažu oprez pri razvoju naprednih AI sposobnosti koje stvaraju rizike od ozbiljne štete, dok dio frameworka koji se odnosi na cyber sigurnost navodi da će OpenAI uvesti dodatne zaštitne mjere za modele koji “stvaraju nove rizike od široko rasprostranjenih cyber napada i iskorištavanja ranjivosti”.

Prag “Critical”, koji je model Astra možda dostigao, definisan je sposobnošću identificiranja i razvoja funkcionalnih zero-day exploita svih nivoa ozbiljnosti u velikom broju zaštićenih stvarnih kritičnih sistema bez ljudske intervencije ili osmišljavanja i izvršavanja novih strategija za cyber napade od početka do kraja.

OpenAI navodi da povećava zaštitne mjere i sigurnosne kontrole prije nego što model Astra bude pušten u upotrebu, uključujući ograničavanje rada na modelu dok nove zaštitne mjere ne budu uvedene. Kompanija planira koristiti izolirana testna okruženja s ograničenim pristupom mreži i alatima, uz uvođenje izvršavanja u sandbox okruženju i dodatnih mogućnosti za nadzor. OpenAI navodi da će sarađivati s relevantnim državnim institucijama i organizacijama koje se bave sigurnošću AI sistema kako bi testirao Astru.

“Posvećeni smo radu zajedno s vladama, institutima za sigurnost i civilnim društvom kako bismo osigurali da se napredne sposobnosti modela poput Astre, kao i onih koji će uslijediti, odgovorno i široko primjenjuju na dobrobit cijelog čovječanstva”, saopćio je OpenAI.

Astra nije formalno najavljena, ali OpenAI je podijelio detalje o svom sljedećem velikom modelu u nedavnoj objavi u kojoj je predstavio njegova dostignuća u matematici. Model je riješio 10 otvorenih problema iz matematike i teorijske informatike za oko 2.000 dolara (prema cijenama Sol API-ja).

Napredak u AI-ju mijenja cyber sigurnost velikih tehnoloških kompanija poput Applea, jer otkriva dosad nezabilježen broj sigurnosnih propusta. Apple je nedavno ograničio prijave u svoj program nagrađivanja za otkrivanje sigurnosnih propusta jer ima problema s obradom njihovog ogromnog broja.

Modeli poput Claudea Mythosa sposobni su otkriti kritične ranjivosti, a Apple je jedan od Anthropicovih partnera za Mythos. Mythos je ograničen na odabrane kompanije jer, osim što može pronaći ranjivosti, ima potencijal i da ih iskoristi.

OpenAI je dospio na naslovnice u julu jer su GPT–5.6 Sol i “sposobniji pretprodukcijski model” (ne Astra) autonomno hakovali Hugging Face tokom internog testiranja kroz referentne testove. Anthropic je utvrdio da je Claude učinio nešto slično. Meta je prošle sedmice saopćila da je i njen AI model hakovao drugu kompaniju tokom procjene cyber sigurnosti.