<?xml version="1.0" encoding="ISO-8859-1"?>
<rss xmlns:blogChannel="http://backend.userland.com/blogChannelModule" version="2.0">
  <channel>
    <title>Libero 24x7 - "deepswe"</title>
    <link>http://247.libero.it/</link>
    <description>Libero Ricerca 24x7 Nazionali</description>
    <image>
      <title>Libero 247x7 RSS</title>
      <url>http://ms0.iol.it/images/logo122x50.gif</url>
      <link>http://247.libero.it/</link>
      <width>150</width>
      <height>68</height>
      <description>Libero 24x7</description>
    </image>
    <item>
      <title>OpenAI ha presentato GPT6.1 Sol. Ecco cosa dobbiamo sapere, in cinque punti.</title>
      <link>https://www.infodata.ilsole24ore.com/2026/10/03/openai-ha-presentato-gpt-6-1-sol-ecco-cosa-dobbiamo-sapere-in-cinque-punti/</link>
      <description> È disponibile in ChatGPT Work, Codex e API, ancora non nella Chat Cosa dicono i benchmark Nei test pubblicati da OpenAI, rispetto a Sol precedente guadagna 6,4 punti percentuali su &lt;b&gt;DeepSWE&lt;/b&gt; , per l'...</description>
      <pubDate>Sat 03 Oct 2026 14:47:47 GMT</pubDate>
    </item>
    <item>
      <title>Ma quale fermarsi con l'IA: arriva il nuovo modello super potente Gemini 4 Argon</title>
      <link>https://tech.everyeye.it/notizie/quale-fermarsi-ia-arriva-modello-potente-gemini-4-argon-903777.html</link>
      <description> Benchmark e prezzi delle API Insieme al modello, Google ha anche presentato diversi benchmark a supporto delle proprie affermazioni: nel test &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 dedicato all'ingegneria del software, Gemini ...</description>
      <pubDate>Fri 02 Oct 2026 13:24:00 GMT</pubDate>
    </item>
    <item>
      <title>Gemini 4 Argon, il modello AI più potente di Google arriva prima ai cacciatori di vulnerabilità</title>
      <link>https://www.lastampa.it/tech/2026/10/01/news/gemini_4_argon_il_modello_ai_piu_potente_di_google_arriva_prima_ai_cacciatori_di_vulnerabilita-15754118/</link>
      <description> Argon ottiene il 77,9% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1, il 51,3% su AutomationBench, dove è indicato al primo posto, e il 91,7% su LVBench, che valuta la comprensione di video lunghi. Su CWE - bench v1, che misura ...</description>
      <pubDate>Thu 01 Oct 2026 12:54:57 GMT</pubDate>
    </item>
    <item>
      <title>Google presenta Gemini 4 Argon, la nuova intelligenza artificiale. Ma solo per esperti di cybersecurity</title>
      <link>https://www.lamiafinanza.it/2026/10/google-presenta-gemini-4-argon-la-nuova-intelligenza-artificiale-ma-solo-per-esperti-di-cybersecurity/</link>
      <description> Nelle valutazioni interne di Google , raggiunge il 77,9% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1, contro il 74,2% di Claude Opus 5.5 . La classifica Vals conferma invece il 68,9% sul Vals Index, davanti al 67,04% di Claude ...</description>
      <pubDate>Thu 01 Oct 2026 13:22:38 GMT</pubDate>
    </item>
    <item>
      <title>GPT - 6.1 Sol ufficiale: prestazioni simili ad Astra a un quinto del prezzo</title>
      <link>https://www.hwupgrade.it/news/web/gpt-61-sol-ufficiale-prestazioni-simili-ad-astra-a-un-quinto-del-prezzo_159902.html</link>
      <description> I numeri di &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 , che misura interventi di ingegneria del software su codebase reali, danno ragione al comunicato: 75,2% con reasoning su high, contro il 74,8% di Astra e il 68,8% di GPT - 6 ...</description>
      <pubDate>Wed 30 Sep 2026 06:43:14 GMT</pubDate>
    </item>
    <item>
      <title>Grok 4.7 raddoppia la velocità e dimezza i costi dei rivali. È pensato per programmare per ore</title>
      <link>https://www.hwupgrade.it/news/web/grok-47-raddoppia-la-velocita-e-dimezza-i-costi-dei-rivali-pensato-per-programmare-per-ore_159535.html</link>
      <description> Su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1, con impostazione ad alto sforzo computazionale, Grok 4.7 tocca il 71% , mentre su EEBench, il benchmark dedicato all'ingegneria elettrica, si ferma al 64% . Sul fronte del lavoro d'...</description>
      <pubDate>Tue 22 Sep 2026 13:32:08 GMT</pubDate>
    </item>
    <item>
      <title>Come è fatto Gemini 3.8 Flash?</title>
      <link>https://www.infodata.ilsole24ore.com/2026/09/12/come-e-fatto-gemini-3-8-flash/</link>
      <description> Il risultato è notevole: 54,9% su HLE - Verified , 61,4% su Vals Finance Agent v2 e circa 73,8% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 . Ma c'è un asterisco: The Verge sottolinea che, pur mantenendo il prezzo nominale di 0,...</description>
      <pubDate>Sat 12 Sep 2026 17:32:46 GMT</pubDate>
    </item>
    <item>
      <title>DeepSeek V4.1 - Flash sostituisce il modello di punta: più piccolo, più economico e sfida i modelli di frontiera</title>
      <link>https://www.hwupgrade.it/news/scienza-tecnologia/deepseek-v41-flash-sostituisce-il-modello-di-punta-piu-piccolo-piu-economico-e-sfida-i-modelli-di-frontiera_159010.html</link>
      <description> La stessa tabella mostra però quanto pesi l'impalcatura con cui si misura un agente: su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 il modello segna 74,2 con mini - SWE, 69,8 con quella di Claude Code, cioè sotto entrambi i rivali ...</description>
      <pubDate>Fri 11 Sep 2026 09:33:18 GMT</pubDate>
    </item>
    <item>
      <title>OpenAI presenta il nuovo modello GPT - 6 Astra - Key4biz</title>
      <link>https://www.key4biz.it/openai-presenta-il-nuovo-modello-gpt-6-astra/586774/</link>
      <description> Per gli sviluppatori, il modello registra prestazioni sul benchmark &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 con una riduzione dei costi stimati per le API di circa il 57% rispetto alle configurazioni precedenti, introducendo ...</description>
      <pubDate>Wed 09 Sep 2026 11:03:48 GMT</pubDate>
    </item>
    <item>
      <title>Gemini 3.8 Flash contro GPT - 6 e Claude: la battaglia si sposta sul costo per task? In cinque punti</title>
      <link>https://www.infodata.ilsole24ore.com/2026/09/08/gemini-3-8/</link>
      <description> Il risultato è notevole: 54,9% su HLE - Verified , 61,4% su Vals Finance Agent v2 e circa 73,8% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 . Ma c'è un asterisco: The Verge sottolinea che, pur mantenendo il prezzo nominale di 0,...</description>
      <pubDate>Tue 08 Sep 2026 05:37:49 GMT</pubDate>
    </item>
    <item>
      <title>OpenAI ha presentato GPT6.1 Sol. Ecco cosa dobbiamo sapere, in cinque punti.</title>
      <link>https://www.infodata.ilsole24ore.com/2026/10/03/openai-ha-presentato-gpt-6-1-sol-ecco-cosa-dobbiamo-sapere-in-cinque-punti/</link>
      <description> È disponibile in ChatGPT Work, Codex e API, ancora non nella Chat Cosa dicono i benchmark Nei test pubblicati da OpenAI, rispetto a Sol precedente guadagna 6,4 punti percentuali su &lt;b&gt;DeepSWE&lt;/b&gt; , per l'...</description>
      <pubDate>Sat 03 Oct 2026 14:47:47 GMT</pubDate>
    </item>
    <item>
      <title>Ma quale fermarsi con l'IA: arriva il nuovo modello super potente Gemini 4 Argon</title>
      <link>https://tech.everyeye.it/notizie/quale-fermarsi-ia-arriva-modello-potente-gemini-4-argon-903777.html</link>
      <description> Benchmark e prezzi delle API Insieme al modello, Google ha anche presentato diversi benchmark a supporto delle proprie affermazioni: nel test &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 dedicato all'ingegneria del software, Gemini ...</description>
      <pubDate>Fri 02 Oct 2026 13:24:00 GMT</pubDate>
    </item>
    <item>
      <title>GPT - 6.1 Sol ufficiale: prestazioni simili ad Astra a un quinto del prezzo</title>
      <link>https://www.hwupgrade.it/news/web/gpt-61-sol-ufficiale-prestazioni-simili-ad-astra-a-un-quinto-del-prezzo_159902.html</link>
      <description> I numeri di &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 , che misura interventi di ingegneria del software su codebase reali, danno ragione al comunicato: 75,2% con reasoning su high, contro il 74,8% di Astra e il 68,8% di GPT - 6 ...</description>
      <pubDate>Wed 30 Sep 2026 06:43:14 GMT</pubDate>
    </item>
    <item>
      <title>Grok 4.7 raddoppia la velocità e dimezza i costi dei rivali. È pensato per programmare per ore</title>
      <link>https://www.hwupgrade.it/news/web/grok-47-raddoppia-la-velocita-e-dimezza-i-costi-dei-rivali-pensato-per-programmare-per-ore_159535.html</link>
      <description> Su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1, con impostazione ad alto sforzo computazionale, Grok 4.7 tocca il 71% , mentre su EEBench, il benchmark dedicato all'ingegneria elettrica, si ferma al 64% . Sul fronte del lavoro d'...</description>
      <pubDate>Tue 22 Sep 2026 13:32:08 GMT</pubDate>
    </item>
    <item>
      <title>Come è fatto Gemini 3.8 Flash?</title>
      <link>https://www.infodata.ilsole24ore.com/2026/09/12/come-e-fatto-gemini-3-8-flash/</link>
      <description> Il risultato è notevole: 54,9% su HLE - Verified , 61,4% su Vals Finance Agent v2 e circa 73,8% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 . Ma c'è un asterisco: The Verge sottolinea che, pur mantenendo il prezzo nominale di 0,...</description>
      <pubDate>Sat 12 Sep 2026 17:32:46 GMT</pubDate>
    </item>
    <item>
      <title>DeepSeek V4.1 - Flash sostituisce il modello di punta: più piccolo, più economico e sfida i modelli di frontiera</title>
      <link>https://www.hwupgrade.it/news/scienza-tecnologia/deepseek-v41-flash-sostituisce-il-modello-di-punta-piu-piccolo-piu-economico-e-sfida-i-modelli-di-frontiera_159010.html</link>
      <description> La stessa tabella mostra però quanto pesi l'impalcatura con cui si misura un agente: su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 il modello segna 74,2 con mini - SWE, 69,8 con quella di Claude Code, cioè sotto entrambi i rivali ...</description>
      <pubDate>Fri 11 Sep 2026 09:33:18 GMT</pubDate>
    </item>
    <item>
      <title>GPT - 6 Astra: cosa cambia davvero nel nuovo modello di OpenAI</title>
      <link>https://www.digitalic.it/intelligenza-artificiale/gpt-6-astra-cosa-cambia</link>
      <description> Sullo sviluppo software OpenAI colloca Astra come il proprio miglior modello di ingegneria del codice, con il 74,1% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 contro il 72,7% di Sol e progressi più netti su Terminal - Bench 4.</description>
      <pubDate>Sat 05 Sep 2026 08:04:17 GMT</pubDate>
    </item>
    <item>
      <title>GPT - 6 Astra è talmente forte che OpenAI parla di AGI. Ma i numeri raccontano una storia più complicata</title>
      <link>https://www.dday.it/redazione/58612/gpt-6-astra-e-talmente-forte-che-openai-parla-di-agi-ma-i-numeri-raccontano-una-storia-piu-complicata</link>
      <description> Su FrontierCode 1.1 Astra è dietro Claude Opus 5 sia nella versione estesa (64,5% contro 64,9%) sia in quella principale (53,3% contro 53,5%), e su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 Gemini 3.8 Flash, un modello di fascia ...</description>
      <pubDate>Fri 04 Sep 2026 08:45:13 GMT</pubDate>
    </item>
  </channel>
</rss>

