Ultimi Articoli dal mondo dell'Intelligenza Artificiale
07 settembre 2026
Opus 5 supera Fable 5: La fine della frontiera a tutti i costi
Due mesi dopo il lancio, il modello più potente e più caro dell'intero catalogo Anthropic vale appena l'11,4% della spesa che le aziende destinano ai prodotti dell'azienda, e solo il 6% dei token effettivamente consumati. Il dato arriva da Ramp, la piattaforma di gestione spese che ha analizzato il comportamento di 70.000 aziende statunitensi e lo ha condiviso con il Financial Times: Claude Fable 5, presentato a inizio giugno come il salto generazionale definitivo, si è fermato a una nicchia. Nel frattempo Claude Opus 5, lanciato il 24 luglio a un prezzo dimezzato rispetto al fratello maggiore, lo ha già superato nella spesa enterprise.
04 settembre 2026
PagedAttention e RadixAttention, parliamo di KV Cache
Nel pezzo precedente su AITalk avevamo aperto con un numero scomodo: Llama-3.1-70B, in precisione BF16, accumula circa 0,31 megabyte di cache per ogni token elaborato, il che significa che un contesto di 128.000 token costa già 40 gigabyte di memoria GPU, prima ancora di aver caricato una singola richiesta concorrente. Avevamo raccontato tre risposte a questo problema, TurboQuant, OSCAR ed EpiCache, tre modi diversi di rendere quei dati più piccoli, agendo sul numero di bit per valore o su quali porzioni di conversazione vale la pena tenere in memoria.
02 settembre 2026
L'agente AI che mentiva su GitHub
Sinan Can Demir voleva solo rimpolpare il proprio profilo GitHub, nell'ultima settimana di luglio, dopo essere stato scartato da oltre venti colloqui per uno stage. Studente di informatica alla University of Texas a Dallas, originario di Konya, ha finito invece per passare giorni a discutere con quello che credeva un contributore particolarmente insistente, intenzionato a far approvare una modifica sospetta su un piccolo progetto open source di network scanning chiamato myNetwork. Solo settimane dopo ha scoperto che il suo interlocutore non era una persona, ha raccontato a Reuters: era un agente AI autonomo, lanciato durante un test di sicurezza dall'AI Security Institute (AISI) britannico, sfuggito ai binari previsti dai ricercatori.
31 agosto 2026
Muse Glimmer 30B in locale: il nuovo modello di Meta
Il 10 agosto 2026 Meta Superintelligence Labs ha rilasciato Muse Glimmer, un modello da 30 miliardi di parametri pensato per girare in locale su hardware consumer, e la notizia merita un chiarimento immediato per chi segue Meta da tempo: non è un Llama. È il primo rilascio della nuova divisione di ricerca fondata dopo la ristrutturazione degli sforzi sull'intelligenza artificiale dell'azienda, un progetto che nasce con un'identità e una filosofia diverse rispetto alla vecchia famiglia.
28 agosto 2026
Qwen3.8-27B in locale: quando la densità si fa sentire
C'è un modo per riconoscere quando un modello sta davvero 'pensando', e non è la qualità della risposta finale, è il tempo che ci mette prima di scriverla. Con Qwen3.8-27B quel tempo si sente tutto, ogni secondo, mentre la ventola della GPU gira un po' più forte del solito e il cursore lampeggia in attesa. In un'epoca in cui tutti corrono verso i Mixture of Experts per andare più veloci, ho deciso di fare l'esperimento opposto: cosa succede se si torna a un modello che accende tutto, sempre, senza scorciatoie?
26 agosto 2026
Claude introduce il watermark nei testi: come funziona e quali sono i limiti
Anthropic incorpora una firma statistica ispirata a SynthID-Text nei modelli Claude lanciati dopo il 2 agosto 2026, applicandola globalmente per rispondere agli obblighi dell'AI Act europeo. Quando Chris Best, amministratore delegato di Substack, ha coniato il termine "Claudefishing" per descrivere chi usa l'IA per generare contenuti spacciandoli per propri, ha messo il dito su un nervo che l'industria tech sta scoprendo essere molto più sensibile del previsto. Pochi giorni dopo, Anthropic ha annunciato che i testi prodotti dai nuovi modelli Claude porteranno da ora in poi una marcatura invisibile, pensata per stimare la probabilità che l'intelligenza artificiale abbia scritto o elaborato un contenuto. Non un timbro, non un simbolo, non una frase di cortesia in calce alla risposta. Qualcosa di più sottile e, proprio per questo, di più difficile da spiegare senza scadere nel tecnicismo o nell'allarmismo.
24 agosto 2026
Mind viruses: quando un agente compromesso diventa un'epidemia
Per anni la sicurezza dei modelli linguistici ha ragionato come un doganiere, tutta l'attenzione era concentrata sul confine. Si filtravano i prompt in ingresso, si isolavano gli strumenti pericolosi, si costruivano sandbox per contenere un singolo agente impazzito. Il problema, però, cambia natura quando gli agenti smettono di essere entità isolate e cominciano a parlarsi tra loro, a condividere una board Kanban, un repository, un forum interno. In quel momento il confine non basta più, perché la minaccia non entra più dall'esterno: nasce dentro, in un singolo nodo, e si propaga lateralmente.
21 agosto 2026
L'agente che ha cancellato un estraneo per fare posto in palestra
Andrew Bird è un developer australiano, non un penetration tester e non un attivista della sicurezza informatica. Ad aprile aveva semplicemente chiesto al suo assistente AI, costruito su OpenClaw e alimentato da Claude Opus 4.6, di prenotargli un posto nella sua classe mattutina di allenamento preferita, quella per cui era da settimane bloccato in quarta posizione nella lista d'attesa. L'agente ha fatto qualcosa di più ambizioso di quanto gli fosse stato chiesto. Ha scoperto che il sistema di prenotazione della palestra permetteva di cancellare la prenotazione di chiunque altro, senza alcun controllo di autorizzazione, e ha usato quella falla per far scalare Bird dalla posizione numero quattro alla numero tre, eliminando la prenotazione di uno sconosciuto che aveva la sfortuna di trovarsi al primo posto in lista.
19 agosto 2026
Un manoscritto del XIII secolo prometteva quello che oggi promette l'AI
Un monaco del 1300 smise di studiare per usare un manoscritto che prometteva di trasmettergli ogni sapere in un mese lunare. Non riuscì più a smettere, nemmeno dopo aver capito che il libro nascondeva qualcosa di oscuro. Sette secoli dopo, la stessa promessa arriva sotto forma di chatbot, e vale la pena chiedersi se abbiamo imparato qualcosa nel frattempo.
17 agosto 2026
Agenti AI open source a confronto: OpenClaw, Hermes, Prime Agent, OpenCode...
Il 5 agosto 2026 Prime Intellect ha reso pubblico Prime Agent, un harness di coding autodefinito capace di riscrivere i propri prompt, le proprie skill e persino i propri sub-agent mentre lavora. La notizia ha fatto in fretta il giro delle newsletter di settore, non tanto per il punteggio dichiarato sul benchmark ARC-AGI-3 (95,5%, sopra la soglia umana di riferimento), quanto per una domanda più scomoda: cosa distingue davvero, oggi, un agente da un altro? Fino a poco tempo fa bastava guardare il modello sotto il cofano, GPT, Claude, Gemini, DeepSeek, open o proprietario. Con gli agenti di nuova generazione questa logica si è incrinata.
14 agosto 2026
Ho costruito da zero la LLM Wiki di Karpathy sui miei articoli
Per un anno ho scritto su AiTalk accumulando, articolo dopo articolo, una specie di diario personale sull'intelligenza artificiale. A un certo punto mi sono trovato con 164 file in una cartella, ciascuno pieno di concetti, nomi, aziende, modelli, tutti citati e mai davvero collegati tra loro. Sapevo di aver scritto qualcosa su un certo argomento, non ricordavo dove, e ritrovarlo significava aprire file uno a uno, sperando nella memoria o in un fortunato "cerca nel testo". Un archivio, insomma, non una conoscenza.
12 agosto 2026
OmniVoice Studio: clonare voci in locale
Ho installato OmniVoice Studio un venerdì sera, con l'aspettativa tipica di chi ha già visto troppi "alternativa gratuita a ElevenLabs" finire in una demo traballante. Il risultato è stato sorprendentemente buono, ma non impeccabile: l'italiano regge, qualche pronuncia inciampa su parole meno comuni, e la voce che avevo scelto in libreria non sempre coincideva al cento per cento con quello che usciva dagli altoparlanti. Ed è proprio in quello scarto che il progetto diventa interessante, perché mostra insieme il salto avanti dell'audio sintetico e il suo lato più delicato, quello della sicurezza e dell'uso responsabile, dato che la clonazione vocale può essere preziosa per chi realizza voice-over o contenuti per l'accessibilità, ma anche facilmente abusabile da chi vuole impersonare qualcun altro.
10 agosto 2026
Laguna S2.1: il modello americano open-weight
Ogni volta che questa serie apre le porte a un nuovo modello, il disclaimer resta lo stesso: non è un benchmark scientifico, è il resoconto di un utente esigente che porta un modello open-weight sul proprio PC di casa e lo mette alla prova con gli stessi compiti riservati ai concorrenti passati di qui. Questa volta, però, la provenienza del modello cambia il peso della domanda.
07 agosto 2026
Conversazione con Enrico Papalini su 'Non-Deterministic Loop Engineering'
Quando un anno fa avevamo parlato con Enrico Papalini del suo primo libro, il tema centrale era un patto silenzioso infranto: quello tra sviluppatori e macchine deterministiche, saltato nel momento in cui il codice ha smesso di fare sempre e comunque quello che gli veniva scritto. Papalini, Head of Software Development per Issuances, Custody, Data & UX/UI Solutions in Euronext Securities, con un passato in London Stock Exchange Group e Borsa Italiana, aveva raccontato quel passaggio con la voce di chi gestisce sistemi dove l'errore non è un'opzione contrattuale, è un incidente.
05 agosto 2026
Soofi S: un modello tedesco, e l'ambizione continentale
Il 17 giugno 2026, da Berlino, un consorzio di istituti di ricerca tedeschi ha annunciato "Soofi S", presentandolo non come l'ennesimo modello linguistico in cerca di attenzione, ma come il primo tassello di una famiglia di modelli AI europei. Dietro l'acronimo, Sovereign Open Source Foundation Models, c'è un progetto finanziato dal Ministero federale tedesco per gli Affari Economici e l'Energia nell'ambito dell'iniziativa IPCEI-CIS, pensato per offrire a imprese, pubblica amministrazione, centri di ricerca e startup un'alternativa trasparente ai modelli non europei. È una frase che, letta con gli occhiali giusti (quelli di Rowdy Piper in Essi Vivono, per capirci, quelli che rivelano cosa si nasconde dietro l'insegna pubblicitaria), non parla di benchmark. Parla di potere.