|
... il divario riappare: su Terminal - Bench 4.0 , per esempio, OpenAI riporta 19,1% per Gemini 3.8 Flash , contro 57,9% di GPT - 6 Astra e 55,8% di Claude Fable 5.1 . La fotografia quindi è curiosa: ...
Sole24ore - Infodata
-
8-9-2026
|
|
|
|
Claude Fable 5.1 di Anthropic non è un chatbot più veloce, è un sistema progettato per lavorare in autonomia su compiti lunghi e ...
Punto Informatico
-
7-9-2026
|
|
|
|
Su AutomationBench, per esempio, Astra ottiene il 41,4%, contro il 18,1% di GPT - 5.6 Sol e il 31,4% del concorrente Claude Fable 5.1 riportato nei test di OpenAI. C'è poi un particolare interessante.
Sole24ore - Infodata
-
7-9-2026
|
|
|
|
... e circa 29.500 di essi sono confluiti nella catena logica conclusiva, producendo 6 miliardi di token con un modello di ricerca interno ad Anthropic paragonabile a Fable 5.1 , l'ultimo modello ...
everyeye.it - Tech & Scienza
-
6-9-2026
|
|
|
|
Anthropic aggiorna la sua famiglia di modelli con Claude Fable 5.1 e Claude Mythos 5.1 . Non è soltanto un incremento dei punteggi nei benchmark. La direzione scelta dall'azienda è rendere Claude più efficace quando deve lavorare autonomamente per ore, ...
Sole24ore - Infodata
-
6-9-2026
|
|
|
|
Astra deve essere marcato, ma OpenAI ancora non ha detto come Come per Fable 5.1 di Anthropic, uscito tre giorni fa, anche GPT - 6 Astra deve sottostare all'articolo 50 del AI Act europeo entrato in ...
Digital Day
-
5-9-2026
|
|
|
|
... colloca Astra a 61,2 sul proprio Intelligence Index contro i 60,9 di GPT - 5.6 Sol: una differenza di tre decimi, in pratica una parità, con Claude Fable 5.1 davanti a 65,7 e persino il modello open ...
Digitalic
-
5-9-2026
|
|
|
|
... si è portata avanti e ha deciso che per "la maggior parte delle richieste relative a biologia e chimica" il suo modello più avanzato, cioè Fable 5, venga retrocesso alla versione precedente. Secondo ...
Linkiesta
-
5-9-2026
|
|
|
|
Ma soprattutto è arrivato qualche giorno dopo l'annuncio dei nuovi Fable 5.1 e Mythos 5.1 di Anthropic , diretti concorrenti dei nuovi modelli dell'azienda di Sam Altman. Specializzato in ...
La Stampa
-
4-9-2026
|
|
|
|
Matematica e scienza, con due risultati sui numeri primi Su FrontierMath Tier 4 , il livello più difficile del benchmark matematico, Astra arriva al 97,6% contro l'83% di Sol e l'87,8% di Fable 5.1 e ...
Digital Day
-
4-9-2026
|
|
|