top of page

AI, MAX News - Agosto 2025

  • 28 ago 2025
  • Tempo di lettura: 6 min

🎯 L'AI HA PERSO LA BUSSOLA?


Agosto 2025 è stato il mese dei paradossi dell'AI.


In breve: OpenAI lancia GPT-5 definendolo «rivoluzionario», ma senza capacità di ragionamento è come i suoi predecessori o peggio. Anthropic potrebbe aver bruciato quasi un miliardo in 45 giorni perché non aveva capito cosa significhi davvero "agenti autonomi". Google inventa mondi 3D con Genie mentre Microsoft scopre che i suoi Copilot si fanno hackerare in 15 minuti. E tutti corrono verso agenti AI senza governance, come se la sicurezza fosse un dettaglio.


Nel frattempo, Sam Altman "re-inventa" il concetto di software usa e getta che avevo descritto a marzo.


La verità? L'AI sta accelerando più veloce di quanto chiunque (incluso chi la crea) riesca a controllare.


In questa newsletter: le notizie che contano, le mie analisi su quello che ho testato in prima persona, e perché dovreste preoccuparvi meno dell'hype e più della preparazione della vostra organizzazione.


L'AI non è più il futuro. È il presente, caotico.


GPT-5 è finalmente arrivato


OpenAI ha rilasciato GPT-5, definito come "il nostro modello più intelligente, veloce ed efficace". Le performance su ARC Prize parlano chiaro: si va dall'1.5% del GPT-5 Nano (Minimal) al 65.7% del GPT-5 High.


La differenza? Il "thinking" interno. Senza capacità di ragionamento profondo, anche GPT-5 resta nel mucchio con tutti. Con il thinking attivato, diventa un'altra cosa. Ma non scrive bene, e gli utenti che avevano una 'relazione' con 4o si sollevano tanto da far ripristinare il vecchio modello su ChatGPT.



Genie 3: DeepMind crea mondi 3D dal testo


Google DeepMind ha annunciato Genie 3, un world model che genera ambienti 3D interattivi partendo da un semplice prompt testuale. Non più solo immagini o video: mondi completi, navigabili, dinamici. Importante perchè si crea un modello 'visivo' di come funziona il mondo. Che potrebbe 'ragionare' ben oltre rispetto agli LLM



OpenAI torna all'open source dopo 6 anni


Sorpresa: OpenAI ha rilasciato GPT-OSS-20b e GPT-OSS-120b, i primi modelli open weight dal 2019. Licenza Apache 2.0, architettura Mixture of Experts, performance simili a o4-mini.


Ora potete scaricare un LLM "made in OpenAI", usarlo su cloud privato, costruirci sopra agenti aziendali. Senza API esterne, senza lock-in.



Claude Max: il miliardo bruciato in 45 giorni


985 milioni di dollari bruciati in un mese e mezzo. È quello che è successo con Claude Max, il piano illimitato di Anthropic.


l piano "all you can eat" era pensato per umani che lavorano 8-10 ore. Non per agenti che si moltiplicano alla velocità della luce. Risultato? Anthropic ha messo le quote in fretta e furia.


Era prevedibile che i primi effetti imprevisti dell'AI arrivassero proprio per chi l'AI la sta creando. Con l'opportunità di imparare dai propri errori come funzioni un sistema agentico non controllato.


👉 Il mio post LinkedIn: Il miliardo bruciato


🎯 Le mie analisi


Agenti AI: il framework Anthropic tradotto in 5 regole semplici


Anthropic ha pubblicato "Our framework for developing safe and trustworthy agents". Un post lungo, pieno di "bla bla" accademico.


La mia reazione? "Perché non sono più diretti? Lasciatemelo riscrivere."


E l'ho fatto. Nel mio blog ho tradotto il loro framework corporate in 5 regole concrete che puoi applicare da domani in azienda.



Software Usa e Getta: ne parlo da marzo


Sam Altman profetizza che stiamo entrando nell'era del "Fast Fashion per il software". Invece di aspettare mesi per sviluppare un'app, la creerai in ore, la testerai subito, e se non funziona la butterai via.


Il problema? Ne avevo già parlato a marzo creando il concetto di "Software Usa e Getta". Per qualche motivo non ho avuto la stessa popolarità di Sam Altman 😊


La differenza tra la mia visione e la sua? Io sono più scettico: mi aspetto tonnellate di software monouso per problemi circostanziati, ma non intere piattaforme.


👉 Il mio post LinkedIn: Il fast fashion del software


Quando le AI pensano, e dibattono, insieme


Ho testato a lungo i sistemi dove più AI discutono tra loro, si criticano, si migliorano a vicenda. Non più chain of thought solitario, ma un parlamento di modelli che negozia la verità.


I vantaggi sono evidenti: meno allucinazioni, più accountability, migliore qualità dei ragionamenti. Il rischio? Una camera dell'eco tra AI convinte ognuna di avere ragione.


Viene spontaneo chiedersi: ma chi presiede l'aula?


Dovrò aggiungere il "Moderatore di AI" alla lista dei nuovi lavori che stanno nascendo.


👉 Il mio post LinkedIn: Quando le AI pensano insieme


⚡ TREND WATCHING


La nuova Legge di Moore dell'AI


La Legge di Moore classica prevedeva il raddoppio dei transistor ogni 18-24 mesi. Oggi abbiamo una nuova Legge di Moore per l'AI: il raddoppio del "time horizon" - quanto tempo di lavoro umano un'AI riesce a completare autonomamente nel coding.


I numeri:


  • 2022: 30 secondi

  • 2025: 2 ore e mezza

  • 2026: 1 giornata intera

  • 2027: 1 mese di attività continuativa


La curva non è solo esponenziale: sta accelerando. Il time horizon raddoppia ogni 4 mesi invece dei 7 previsti.


👉 Fonte: AI Digest


GPT-5: perché il "thinking" cambia tutto


I benchmark di GPT-5 su ARC Prize mostrano una verità scomoda: senza thinking, anche il modello più avanzato è mediocre.


Le performance:


  • GPT-5 Nano Minimal: 1.5%

  • GPT-5 Nano Medium: molto meglio del GPT-5 Minimal

  • GPT-5 Mini High: simile a GPT-5 Medium, ma metà prezzo

  • GPT-5 High: 65.7%


La differenza tra 1.5% e 65.7% non è potenza computazionale. È capacità di ragionamento interno.



🔒 SICUREZZA REALE


ChatGPT-5 jailbrekkato in 15 minuti


GPT-5 è stato compromesso su Reddit in soli 15 minuti dal lancio.


Prima di portare in azienda un AI agent scaricato da chissà dove, fermiamoci un attimo. Alcune regole minime:


  • Controllate la licenza d'uso (spesso non è ciò che sembra)

  • Ricordatevi che state dando le chiavi di casa a un passante

  • Fate lavorare un vostro AI Red Team prima della produzione

  • Sul Dark Web circolano già prompt injection avanzati, data poisoning, adversarial AI


La prima email fu inviata nel 1971. Oggi ancora cadiamo nel phishing. Non commettiamo lo stesso errore con gli AI agent sperimentali.



Microsoft Copilot hackerato a DEFCON


A DEFCON, Microsoft Copilot Studio è stato completamente compromesso. I ricercatori hanno scaricato record CRM completi, esposto strumenti privati, eseguito azioni senza supervisione umana.


Gli "agenti autonomi" che tutti stanno correndo a implementare si sono trasformati in macchine per l'esfiltrazione dati. Zero governance, zero freni.


L'ironia? Vendiamo "no human in the loop" come una feature, quando in pratica è il sogno di ogni hacker.


Memo per le aziende: AI autonoma senza sicurezza seria non è innovazione, è malpractice.



🔮 WHAT'S NEXT


Coscienza artificiale: l'illusione che arriva


Mustafa Suleyman (CEO Microsoft AI) ci avverte: sta arrivando la "Seemingly Conscious AI" (SCAI) - AI che sembrerà cosciente senza esserlo davvero.


I componenti sono già qui:


  • Linguaggio fluido: ✅ Già disponibile

  • Personalità empatica: ✅ Via post-training

  • Memoria persistente: ✅ In sviluppo

  • Senso di sé: ✅ Tecnicamente possibile

  • Motivazione intrinseca: ✅ Simulabile

  • Autonomia: ✅ In arrivo


Il rischio? Che molte persone inizino a credere nell'illusione di AI come entità coscienti, fino a richiedere diritti per l'AI, welfare dei modelli, cittadinanza artificiale.


La sua raccomandazione: "We must build AI for people; not to be a person."


Un articolo che vi turberà se già non lo siete.



AGENTS.md: il nuovo standard


È nato AGENTS.md, un formato semplice e aperto per guidare i coding agents. Come un README, ma per l'AI.


L'idea è semplice: invece di prompt complessi, crei un file markdown che spiega al tuo agente AI come comportarsi nel progetto. Standard, condivisibile, versionabile.


Un passo verso la democratizzazione dello sviluppo con AI agents.



📊 IN NUMERI


  • 985 milioni $: bruciati da Claude Max in 45 giorni

  • 65.7% vs 1.5%: differenza prestazioni GPT-5 High vs Nano

  • 4 mesi: tempo di raddoppio del time horizon AI (vs 7 previsti)

  • 15 minuti: tempo per jailbrekkare GPT-5

  • 6 anni: pausa di OpenAI dai modelli open weight

  • 2027: anno previsto per AI con 1 mese di autonomia


🤖 AI, MAX News! è la newsletter mensile di Max Turazzini per professionisti che vogliono capire (e usare) l'intelligenza artificiale senza perdersi nulla, eccetto le chiacchiere.


📧 Prossima uscita: Settembre 2025 🔗 Archivio newsletter


PS. Scritta con tantiiiissimo aiuto dell'AI, perchè è Agosto, ma revisionata rigorosamente a mano!


bottom of page