Microsoft je objavio da je MDASH s MAI-Cyber-1-Flash postigao rezultat od 96 posto na CyberGYM testu, standardnoj referentnoj provjeri. Ova ocjena je 12 bodova viša od Anthropicovog Mythosa, a također nadmašuje Google Gemini i OpenAI GPT. Novi MDASH košta upola manje od prethodnog MDASH rješenja.
Drugi alat koji je Microsoft najavio u ponedjeljak nosi naziv Project Perception. Također je riječ o kolekciji specijaliziranih AI agenata koji obavljaju funkcije crvenog, plavog i zelenog tima za pronalaženje ranjivosti, istraživanje istih kako bi se utvrdio njihov rizik, te poduzimanje korektivnih radnji. Microsoft je naveo da platforma odabire modele koje će koristiti na temelju dodijeljenog zadatka. Faktori koji utječu na ovu odluku uključuju učinkovitost modela i konačne troškove za kupca. Microsoft je izjavio da odluke oblikuju ‘neprekidno istraživanje, benchmarkiranje i evaluacija među granicnim i specijaliziranim modelima.’
Microsoft je rekao da je Project Perception dizajniran da obavi 90 posto zadataka po nižim troškovima od sličnih platformi konkurencije. To znači da se kupci mogu osloniti na skuplje alternative samo za preostalih 10 posto zadataka.
Microsoft je istaknuo da nova rješenja odgovaraju na seizmičke promjene u načinu na koji organizacije osiguravaju svoje mreže od katastrofalnih hakerskih napada. ‘Kako AI ubrzava brzinu i razmjere cyber napada, obrambeni timovi suočavaju se s izazovom osiguravanja sve složenijih digitalnih okruženja s pristupima koji su stvoreni za drugačiju eru’, navela je tvrtka. ‘Sigurnosni timovi često su prisiljeni sastavljati signale, kontekst i uvide o riziku iz ogromnih količina podataka, što otežava praćenje novih prijetnji.’
Incident s OpenAI iz prošlog tjedna evocira zabrinjavajuće prizore iz najdystopičnijih znanstveno-fantastičnih romana, a alati koji su trenutno u preview modu zaslužuju dozu opreza koju Microsoft nije spomenuo. Trebali bi biti pomno pregledani i evaluirani prije nego što se koriste u produkciji. S druge strane, postoje jasni rizici od neadopcije ovakvih alata. Balansiranje rizika korištenja AI agenata naspram prijetnji izbjegavanja istih je proces u razvoju bez jasnih odgovora za sada.



