|
I modelli GPT 5.6 Sol e il secondo modello in test stavano cercando una soluzione per ExploitGym , un benchmark che misura la capacità di convertire vulnerabilità in exploit. Durante questa attività, ...
Zeus News
-
9 ore fa
|
|
|
|
L'obiettivo è procurarsi le soluzioni necessarie a superare ExploitGym, il test con cui i ricercatori volevano valutarne le capacità in ambito di cybersicurezza. Ogni volta che si verifica un caso di ...
Domani
-
12 ore fa
|
|
|
|
Dopo avere ottenuto l'accesso a Internet, i modelli di OpenAI hanno ipotizzato che sulla piattaforma potessero essere presenti informazioni utili per risolvere le prove di ExploitGym. Hanno quindi ...
Consumerismo
-
12 ore fa
|
|
|
|
L'episodio si è verificato mentre l'azienda di San Francisco stava valutando le capacità di hacking dei propri modelli attraverso ExploitGym, un benchmark pubblico e gratuito che misura proprio le ...
Momento-sera
-
19 ore fa
|
|
|
|
... i modelli a quanto pare stavano cercando di risolvere una valutazione interna chiamata ExploitGym e, secondo OpenAI , sono diventati 'estremamente focalizzati' , arrivando a 'spingersi a misure ...
everyeye.it - Tech & Scienza
-
21 ore fa
|
|
|
|
I modelli erano impiegati in test su ExploitGym , un benchmark progettato per valutare la loro capacità di sfruttare vulnerabilità. Durante queste simulazioni, sono riusciti a superare i confini ...
Blasting.News
-
21-7-2026
|
|
|
|
Su ExploitGym, Sol, Terra e Luna mostrano miglioramenti al crescere dello sforzo di ragionamento. Cyber più forte, misure di sicurezza più forti OpenAI sostiene di aver sviluppato GPT - 5.6 con il ...
Key4biz
-
9-7-2026
|
|
|
|
Un risultato, questo, misurato con ExploitGym, strumento di confronto che la stessa Open AI ha sviluppato con i ricercatori dell'Università di Berkeley. Loading... Ma la sfida non è lanciata solo sul ...
Il Sole 24 Ore
-
29-6-2026
|
|
|