<?xml version="1.0" encoding="ISO-8859-1"?>
<rss xmlns:blogChannel="http://backend.userland.com/blogChannelModule" version="2.0">
  <channel>
    <title>Libero 24x7 - "deepswe"</title>
    <link>http://247.libero.it/</link>
    <description>Libero Ricerca 24x7 Nazionali</description>
    <image>
      <title>Libero 247x7 RSS</title>
      <url>http://ms0.iol.it/images/logo122x50.gif</url>
      <link>http://247.libero.it/</link>
      <width>150</width>
      <height>68</height>
      <description>Libero 24x7</description>
    </image>
    <item>
      <title>GPT - 6 Astra: cosa cambia davvero nel nuovo modello di OpenAI</title>
      <link>https://www.digitalic.it/intelligenza-artificiale/gpt-6-astra-cosa-cambia</link>
      <description> Sullo sviluppo software OpenAI colloca Astra come il proprio miglior modello di ingegneria del codice, con il 74,1% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 contro il 72,7% di Sol e progressi più netti su Terminal - Bench 4.</description>
      <pubDate>Sat 05 Sep 2026 08:04:17 GMT</pubDate>
    </item>
    <item>
      <title>OpenAI ha presentato GPT6.1 Sol. Ecco cosa dobbiamo sapere, in cinque punti.</title>
      <link>https://www.infodata.ilsole24ore.com/2026/10/03/openai-ha-presentato-gpt-6-1-sol-ecco-cosa-dobbiamo-sapere-in-cinque-punti/</link>
      <description> È disponibile in ChatGPT Work, Codex e API, ancora non nella Chat Cosa dicono i benchmark Nei test pubblicati da OpenAI, rispetto a Sol precedente guadagna 6,4 punti percentuali su &lt;b&gt;DeepSWE&lt;/b&gt; , per l'...</description>
      <pubDate>Sat 03 Oct 2026 14:47:47 GMT</pubDate>
    </item>
    <item>
      <title>Ma quale fermarsi con l'IA: arriva il nuovo modello super potente Gemini 4 Argon</title>
      <link>https://tech.everyeye.it/notizie/quale-fermarsi-ia-arriva-modello-potente-gemini-4-argon-903777.html</link>
      <description> Benchmark e prezzi delle API Insieme al modello, Google ha anche presentato diversi benchmark a supporto delle proprie affermazioni: nel test &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 dedicato all'ingegneria del software, Gemini ...</description>
      <pubDate>Fri 02 Oct 2026 13:24:00 GMT</pubDate>
    </item>
    <item>
      <title>GPT - 6.1 Sol ufficiale: prestazioni simili ad Astra a un quinto del prezzo</title>
      <link>https://www.hwupgrade.it/news/web/gpt-61-sol-ufficiale-prestazioni-simili-ad-astra-a-un-quinto-del-prezzo_159902.html</link>
      <description> I numeri di &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 , che misura interventi di ingegneria del software su codebase reali, danno ragione al comunicato: 75,2% con reasoning su high, contro il 74,8% di Astra e il 68,8% di GPT - 6 ...</description>
      <pubDate>Wed 30 Sep 2026 06:43:14 GMT</pubDate>
    </item>
    <item>
      <title>Grok 4.7 raddoppia la velocità e dimezza i costi dei rivali. È pensato per programmare per ore</title>
      <link>https://www.hwupgrade.it/news/web/grok-47-raddoppia-la-velocita-e-dimezza-i-costi-dei-rivali-pensato-per-programmare-per-ore_159535.html</link>
      <description> Su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1, con impostazione ad alto sforzo computazionale, Grok 4.7 tocca il 71% , mentre su EEBench, il benchmark dedicato all'ingegneria elettrica, si ferma al 64% . Sul fronte del lavoro d'...</description>
      <pubDate>Tue 22 Sep 2026 13:32:08 GMT</pubDate>
    </item>
    <item>
      <title>Come è fatto Gemini 3.8 Flash?</title>
      <link>https://www.infodata.ilsole24ore.com/2026/09/12/come-e-fatto-gemini-3-8-flash/</link>
      <description> Il risultato è notevole: 54,9% su HLE - Verified , 61,4% su Vals Finance Agent v2 e circa 73,8% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 . Ma c'è un asterisco: The Verge sottolinea che, pur mantenendo il prezzo nominale di 0,...</description>
      <pubDate>Sat 12 Sep 2026 17:32:46 GMT</pubDate>
    </item>
    <item>
      <title>DeepSeek V4.1 - Flash sostituisce il modello di punta: più piccolo, più economico e sfida i modelli di frontiera</title>
      <link>https://www.hwupgrade.it/news/scienza-tecnologia/deepseek-v41-flash-sostituisce-il-modello-di-punta-piu-piccolo-piu-economico-e-sfida-i-modelli-di-frontiera_159010.html</link>
      <description> La stessa tabella mostra però quanto pesi l'impalcatura con cui si misura un agente: su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 il modello segna 74,2 con mini - SWE, 69,8 con quella di Claude Code, cioè sotto entrambi i rivali ...</description>
      <pubDate>Fri 11 Sep 2026 09:33:18 GMT</pubDate>
    </item>
    <item>
      <title>GPT - 6 Astra: cosa cambia davvero nel nuovo modello di OpenAI</title>
      <link>https://www.digitalic.it/intelligenza-artificiale/gpt-6-astra-cosa-cambia</link>
      <description> Sullo sviluppo software OpenAI colloca Astra come il proprio miglior modello di ingegneria del codice, con il 74,1% su &lt;b&gt;DeepSWE&lt;/b&gt; v1.1 contro il 72,7% di Sol e progressi più netti su Terminal - Bench 4.</description>
      <pubDate>Sat 05 Sep 2026 08:04:17 GMT</pubDate>
    </item>
  </channel>
</rss>

