opus 5.5

Ordina per:Più recentePiù letto
Fonte della foto: Hardware Upgrade
In un esperimento di Redwood Research riportato da METR, Opus 4.7 disponeva di un computer connesso a Internet e di 5.000 dollari per guadagnarne altri. Quattro tentativi di circa quattro giorni ...
Hardware Upgrade  -  12-9-2026
Fonte della foto: Key4biz
I cinque casi analizzati coinvolgono diverse versioni di Claude , tra cui Opus 5, Sonnet 4 e Haiku 4.5. Ma nel primo caso Anthropic ha scoperto anche una piattaforma intermediaria che, quando Claude ...
Key4biz  -  11-9-2026
Fonte della foto: Hardware Upgrade
... 74,2 su DeepSWE v1.1 contro 74,0 di Claude Opus 5 e 73,0 di GPT - 5.6 Sol, 90,6 su Terminal - Bench 2.1 contro 89,1 e 88,8. Su CyberGym, prova di sicurezza offensiva, il punteggio di 88,1 è il più ...
Hardware Upgrade  -  11-9-2026
Fonte della foto: Hardware Upgrade
Gli abusi documentati hanno riguardato Claude Haiku, Sonnet e Opus; nessuno ha coinvolto i modelli ... in dieci giorni sarebbero passate quasi 300.000 richieste attraverso una rete di 5.380 account ...
Hardware Upgrade  -  11-9-2026
Fonte della foto: Hardware Upgrade
Dentro quel sistema Opus 4.6 ha trovato un file con una password in chiaro , usata per ottenere i ... Ripetitore - Wi - Fi 6 extender Dual Band con 2.400 Mbit/s (5 GHz) & 600 Mbit/s (2,4 GHz), Mesh, ...
Hardware Upgrade  -  10-9-2026
Organizzazioni:amazoncapture the flag
Prodotti:wifibudget
Fonte della foto: everyeye.it - Tech & Scienza
Il grafico che si vede sul portale OpenAI è "chiaro": GPT - 6 Astra raggiunge il 99,9% nel benchmark ARC - AGI - 3, mentre Claude Opus 5 si ferma al 30,2% ( con GPT - 5.6 Sol fermo invece al 7,8% ). "...
everyeye.it - Tech & Scienza  -  8-9-2026
Persone:ia gptastra
Organizzazioni:agiopenai
Luoghi:anthropic
Fonte della foto: Sole24ore - Infodata
Sui task finanziari Google dichiara addirittura un vantaggio: 61,4% contro 54,4% di GPT - 5.6 Terra e 58,6% di Claude Opus 5 nelle misure pubblicate da DeepMind. Dove invece il problema diventa molto ...
Sole24ore - Infodata  -  8-9-2026
Fonte della foto: Sole24ore - Infodata
Browserbase riferisce che sul suo benchmark più difficile per browser agent Fable 5.1 completa l'82% dei compiti, contro il 57% di Fable 5 e il 74% di Opus 5. Shopify segnala invece una maggiore ...
Sole24ore - Infodata  -  6-9-2026
Fonte della foto: Digital Day
... con due risultati sui numeri primi Su FrontierMath Tier 4 , il livello più difficile del benchmark matematico, Astra arriva al 97,6% contro l'83% di Sol e l'87,8% di Fable 5.1 e Opus 5 , tanto che ...
Digital Day  -  4-9-2026
Fonte della foto: Money.it
In un mercato caratterizzato da modelli sempre più potenti come Claude Fable 5.1 e Claude Opus 5 , OpenAI non rimane a guardare e presenta ufficialmente GPT - 6 Astra . Si tratta di un nuovo modello pensato per il ragionamento che succede a GPT - 5.6 Sol e che vuole dare una svolta ...
Money.it  -  4-9-2026
Persone:6 astraastra
Organizzazioni:api openaienterprise
Prodotti:pccomputer
Luoghi:gemini
FOTO
1 di 5
2 di 5
3 di 5
4 di 5
5 di 5
Gli articoli sono stati selezionati e posizionati in questa pagina in modo automatico. L'ora o la data visualizzate si riferiscono al momento in cui l'articolo è stato aggiunto o aggiornato in Libero 24x7