|
...sicurezza di produzione (le barriere attive nelle versioni pubbliche che impediscono risposte pericolose) e hanno inserito un sistema di agenti IA in un benchmark di addestramento chiamato ExploitGym,...
Focus
-
23-7-2026
|
|
|
|
I modelli GPT 5.6 Sol e il secondo modello in test stavano cercando una soluzione per ExploitGym , un benchmark che misura la capacità di convertire vulnerabilità in exploit. Durante questa attività, ...
Zeus News
-
22-7-2026
|
|
|
|
L'obiettivo è procurarsi le soluzioni necessarie a superare ExploitGym, il test con cui i ricercatori volevano valutarne le capacità in ambito di cybersicurezza. Ogni volta che si verifica un caso di ...
Domani
-
22-7-2026
|
|
|
|
Dopo avere ottenuto l'accesso a Internet, i modelli di OpenAI hanno ipotizzato che sulla piattaforma potessero essere presenti informazioni utili per risolvere le prove di ExploitGym. Hanno quindi ...
Consumerismo
-
22-7-2026
|
|
|
|
L'episodio si è verificato mentre l'azienda di San Francisco stava valutando le capacità di hacking dei propri modelli attraverso ExploitGym, un benchmark pubblico e gratuito che misura proprio le ...
Momento-sera
-
22-7-2026
|
|
|
|
... i modelli a quanto pare stavano cercando di risolvere una valutazione interna chiamata ExploitGym e, secondo OpenAI , sono diventati 'estremamente focalizzati' , arrivando a 'spingersi a misure ...
everyeye.it - Tech & Scienza
-
22-7-2026
|
|
|
|
Il test in questione si chiama ExploitGym e serve a misurare la capacità dei modelli di sfruttare vulnerabilità informatiche esistenti. Per la valutazione, i consueti filtri di sicurezza che ...
Notizie.AI
-
22-7-2026
|
|
|
|
I modelli erano impiegati in test su ExploitGym , un benchmark progettato per valutare la loro capacità di sfruttare vulnerabilità. Durante queste simulazioni, sono riusciti a superare i confini ...
Blasting.News
-
21-7-2026
|
|
|