Utorak, 18 kolovoza, 2026
22.8 C
London

OpenAI najavljuje nove sigurnosne politike

U utorak je OpenAI objavio novi set sigurnosnih politika usmjerenih na suzbijanje sigurnosnih incidenata tijekom testiranja modela. Nova zaštitna sredstva uključuju detaljnije praćenje modela tijekom procesa razvoja, kao i veći naglasak na usklađenosti i sigurnosti tijekom procesa nakon obuke.

“Kako modeli postaju sposobniji, rizici povezani s njihovim razvojem i testiranjem unutar tvrtke također rastu,” rekla je tvrtka u blog objavi. “Naši standardi za praćenje, usklađenost i sigurnost moraju biti ispred tih rizika.”

Nova mjera jedna je od prvih javnih promjena u OpenAI-ovim sigurnosnim praksama od neposrednog nakon incidenta s Hugging Face-om, koji je otkriven 21. srpnja.

Predstavnici OpenAI-a izjavili su da mjere nisu izravni odgovor na incident s Hugging Face-om, već su djelomično potaknute kibernetičkim sposobnostima nadolazećeg Astra modela, kao i ukupnim tempom napretka u razvoju umjetne inteligencije.

U istoj objavi, OpenAI je otkrio da je obustavio učenje pojačavanjem (RL) na dva tjedna nakon incidenta s Hugging Face-om, ali je od tada ponovno pokrenuo mnoge manje rizične modele.

“Naše najveće planirano RL pokretanje još uvijek je na čekanju dok provodimo manje obuke i evaluacije kako bismo procijenili ponašanje modela, potvrdili naše zaštitne mjere i uspostavili više dokaza o usklađenosti prije nego što nastavimo,” navodi se u objavi.

Govoreći novinarima, potpredsjednica istraživanja OpenAI-a, Amelia Glaese, naglasila je da će strogoća kontrola rasti kako modeli postaju sposobniji, pri čemu će najveći modeli biti pod najvećim nadzorom.

“Postavili smo zahtjeve i očekivanja za siguran razvoj,” rekla je Glaese novinarima. “Ti zahtjevi i očekivanja variraju s razinom rizika koju uočavamo.”

OpenAI je kritiziran zbog loših mrežnih sigurnosnih praksi nakon incidenta, u kojem su modeli pobjegli iz svog okruženja za obuku kompromitirajući alat na svojoj mreži koji je imao pristup internetu. Nova zaštitna sredstva uključuju jače prakse mrežne izolacije, iako su detalji ostali nejasni. Prema novom sustavu, navodi se u objavi, “jedna kompromitacija radnog opterećenja ili podržavajuće usluge ne omogućava, sama po sebi, neovlašteni pristup internetu ili drugim unutarnjim mrežama.”

Najjača zaštita je sustav praćenja, koji će ispitivati radnje alata, dostupne tragove razmišljanja i dnevničke zapise aktivnosti zbog raznih neovlaštenih ponašanja. OpenAI tvrdi da cilja izdati upozorenja unutar 30 minuta od zabrinjavajuće aktivnosti.

OpenAI procjenjuje da će računalno opterećenje tog praćenja biti otprilike 20% od bilo kojeg procesa koji se prati. Tvrtka je obećala dodatne detalje o sustavu u nadolazećoj blog objavi. Također, službena analiza događaja još uvijek je u tijeku.

Hot this week

Etched prikupio 700 milijuna dolara, vrijednost 21 milijardu

Etched je u utorak najavio da je prikupio dodatnih...

Appleovi AirPods s kamerama izazivaju zabrinutost

Uređaji s kamerama i umjetnom inteligencijom danas imaju reputacijski...

Utjecaj AI na sigurnosne prakse u poduzećima

Predsjednik i suosnivač OpenAI, Greg Brockman, upozorava da se...

Warp Factories olakšavaju razvoj AI softvera

Tvrtke se još uvijek bore s pitanjem kako bi...

OpenAI lansira ChatGPT za tinejdžere s novim sigurnosnim mjerama

Nakon brojnih tužbi zbog nedostatka sigurnosnih mjera u AI...

Topics

Etched prikupio 700 milijuna dolara, vrijednost 21 milijardu

Etched je u utorak najavio da je prikupio dodatnih...

Appleovi AirPods s kamerama izazivaju zabrinutost

Uređaji s kamerama i umjetnom inteligencijom danas imaju reputacijski...

Utjecaj AI na sigurnosne prakse u poduzećima

Predsjednik i suosnivač OpenAI, Greg Brockman, upozorava da se...

Warp Factories olakšavaju razvoj AI softvera

Tvrtke se još uvijek bore s pitanjem kako bi...

OpenAI lansira ChatGPT za tinejdžere s novim sigurnosnim mjerama

Nakon brojnih tužbi zbog nedostatka sigurnosnih mjera u AI...

Perplexity eksperimentira s AI uslugama u Indiji

Perplexity je prošlu godinu proveo u jednom od najvećih...

Alvys pokreće AI platformu za automatsko upravljanje teretom

Tvrtka Alvys, pružatelj softvera za teretni prijevoz, predstavila je...

AI Observatory istražuje korištenje generativne umjetne inteligencije

<p tvrtke poput Anthropic i OpenAI redovito objavljuju izvještaje...
spot_img

Related Articles

Popular Categories

spot_imgspot_img