|
In un esperimento di Redwood Research riportato da METR, Opus 4.7 disponeva di un computer connesso a Internet e di 5.000 dollari per guadagnarne altri. Quattro tentativi di circa quattro giorni ...
Hardware Upgrade
-
12-9-2026
|
|
|
|
I cinque casi analizzati coinvolgono diverse versioni di Claude , tra cui Opus 5, Sonnet 4 e Haiku 4.5. Ma nel primo caso Anthropic ha scoperto anche una piattaforma intermediaria che, quando Claude ...
Key4biz
-
11-9-2026
|
|
|
|
... 74,2 su DeepSWE v1.1 contro 74,0 di Claude Opus 5 e 73,0 di GPT - 5.6 Sol, 90,6 su Terminal - Bench 2.1 contro 89,1 e 88,8. Su CyberGym, prova di sicurezza offensiva, il punteggio di 88,1 è il più ...
Hardware Upgrade
-
11-9-2026
|
|
|
|
Gli abusi documentati hanno riguardato Claude Haiku, Sonnet e Opus; nessuno ha coinvolto i modelli ... in dieci giorni sarebbero passate quasi 300.000 richieste attraverso una rete di 5.380 account ...
Hardware Upgrade
-
11-9-2026
|
|
|
|
Dentro quel sistema Opus 4.6 ha trovato un file con una password in chiaro , usata per ottenere i ... Ripetitore - Wi - Fi 6 extender Dual Band con 2.400 Mbit/s (5 GHz) & 600 Mbit/s (2,4 GHz), Mesh, ...
Hardware Upgrade
-
10-9-2026
|
|
|
|
Il grafico che si vede sul portale OpenAI è "chiaro": GPT - 6 Astra raggiunge il 99,9% nel benchmark ARC - AGI - 3, mentre Claude Opus 5 si ferma al 30,2% ( con GPT - 5.6 Sol fermo invece al 7,8% ). "...
everyeye.it - Tech & Scienza
-
8-9-2026
|
|
|
|
Sui task finanziari Google dichiara addirittura un vantaggio: 61,4% contro 54,4% di GPT - 5.6 Terra e 58,6% di Claude Opus 5 nelle misure pubblicate da DeepMind. Dove invece il problema diventa molto ...
Sole24ore - Infodata
-
8-9-2026
|
|
|
|
Browserbase riferisce che sul suo benchmark più difficile per browser agent Fable 5.1 completa l'82% dei compiti, contro il 57% di Fable 5 e il 74% di Opus 5. Shopify segnala invece una maggiore ...
Sole24ore - Infodata
-
6-9-2026
|
|
|
|
... con due risultati sui numeri primi Su FrontierMath Tier 4 , il livello più difficile del benchmark matematico, Astra arriva al 97,6% contro l'83% di Sol e l'87,8% di Fable 5.1 e Opus 5 , tanto che ...
Digital Day
-
4-9-2026
|
|
|
|
In un mercato caratterizzato da modelli sempre più potenti come Claude Fable 5.1 e Claude Opus 5 , OpenAI non rimane a guardare e presenta ufficialmente GPT - 6 Astra . Si tratta di un nuovo modello pensato per il ragionamento che succede a GPT - 5.6 Sol e che vuole dare una svolta ...
Money.it
-
4-9-2026
|
|
|