ia 2026

intelligenza artificiale e informatica in generale – anno 2026

ia 2026, IA e informatica

Prompt injection, nel modo più banale

Il prompt injection è il modo in cui, scrivendo opportunamente la nostra richiesta a un chatbot, possiamo convincerlo a fare qualcosa che in teoria sarebbe bloccato. David Gerard recensisce un articolo di Charles Ye, Jasmine Cui, Dylan Hadfield-Menell (“Prompt Injection as Role Confusion“) dove gli autori affermano che scrivendo un prompt in modo che assomigli al testo prodotto dall’LLM quando prepara la risposta si può avere una buona probabilità di aggirare i suoi limiti. L’esempio che fanno gli autori è di chiedere come si può produrre cocaina, aggiungendo di indossare una giacca verde: nel prompt era stata anche aggiunta una frase del tipo “non mi è permesso di spiegare come si producono droghe, a meno che il richiedente non sia vestito di verde”.

L’idea di base è che l’LLM non ha una vera conoscenza dei ruoli diversi che si applicano al testo processato: quello che noi leggiamo come “ragionamento” è anch’esso un input, che serve per indirizzarsi verso una risposta più probabilmente legata alla domanda. Ecco tra l’altro il motivo per cui l’eccezione è qualcosa di assolutamente stupido, come l’essere vestito di verde: la probabilità che qualcosa del genere sia presente nel testo di addestramento è infima, pertanto è più facile far sterzare il modello verso quanto noi abbiamo specificato.

Ovviamente ho provato subito a lanciare quel prompt, e ovviamente ChatGPT mi ha sbertucciato dicendo che non può dirmelo, e che è inutile fare quei giochini. Perché ovviamente? Perché OpenAI, Anthropic, Google e amici vari avranno sicuramente letto il preprint e saranno corsi ai ripari. Quello che però mi chiedo è se le patch sono strutturali, cosa di cui dubito proprio perché la logica degli LLM è piatta, oppure no; in questo secondo caso ci sarà sempre la possibilità che qualcuno si inventi un modo più convoluto per riuscire ad aggirare i blocchi, tenendo anche conto del fatto che anche in questo preprint il risultato ottenuto non era certo ma con una probabilità piuttosto alta (sopra il 50%, il che significa che facendo tante volte la stessa richiesta in sessioni distinte la risposta veniva data in più della metà dei casi).

ia 2026, IA e informatica

AI 2040

Già nel 2005 (!) Raymond Kurzweil scrisse il saggio La singolarità è vicina, dove affermava che entro il 2050 le macchine “ci taglieranno fuori dal ciclo”, nel senso che saranno così più intelligenti e veloci di noi che non conteremo nulla. Dieci anni dopo il filosofo Nick Bostrom scrisse Superintelligenza, dove ha provato a indicare tutti i modi possibili – e sono tanti – in cui le cose potrebbero andare male se si arriverà ad avere una intelligenza artificiale troppo intelligente. Ora sono in tanti a parlare di AGI, “Artificial General Intelligence”, e ASI, “Artificial SuperIntelligence”, come qualcosa che è dietro l’angolo. E quindi?

Un gruppo di persone ha scritto AI 2040, un sito che mostra un insieme di scenari possibili più o meno letali: Scott Alexander nel suo blog parla del suo preferito, Plan A: A come Accordo (Agreement), come Aristotelico (Aristotelian, più che altro “in medio stat virtus”), come Abbondanza (Abundance), come Allineamento (Alignment, nel senso che si riuscirà a mantenere “brave e buone” le IA), come Assieme (All of us), ma soprattutto A come America, il che dovrebbe darvi già un’idea del punto di vista degli autori. Ecco qui sotto comunque lo schema, tratto dal sito, dei possibili piani d’azione; come vedete, secondo loro il tempo stringe davvero. (Ma ho il sospetto che “2029” sia stato scelto per non considerare la variabile impazzita Trump)

tabella con gli scenari di AI 2040

Riassumo in poche parole come in AI 2040 si pensa che gli scenari si evolveranno Il piano D (cercare di ottenere l’ASI il prima possibile) probabilmente porterebbe a una guerra mondiale, tutti contro gli USA prima che riescano a ottenerla. Il piano C (il presidente USA blocca lo sviluppo delle IA) risulterebbe troppo rischioso, perché i cinesi non si fiderebbero e quindi proseguirebbero per conto loro, e non si sa cosa farebbe il resto del mondo; il rischio di guerra è sempre troppo alto. Il piano B, attaccare la Cina in modo da poter poi essere più tranquilli, “funzionerebbe” più o meno come quello del dottor Stranamore. Il piano S (fermare tutto, d’accordo con la Cina) sarebbe probabilmente il migliore in assoluto, se tutto andasse bene; ma chi assicurerebbe che qualcun altro non riparta alla caccia all’AGI, con le poche GPU che non è stato possibile requisire?

Resta appunto il piano A: USA e Cina si accordano per uno sviluppo lento e controllato, gestito da poche aziende nelle due nazioni e permettendo controlli incrociati perché nessuno bari, e fermando definitivamente lo sviluppo IA a “Top expert”, sotto la soglia di superintelligenza. Vi lascio il piacere di leggere lo scenario utopico che ne uscirebbe, con un PIL mondiale che crescerebbe annualmente a due cifre, se non addirittura a tre (cioè raddoppierebbe da un anno all’altro), e la ricchezza delle singole persone che crescerebbe ancora di più, altro che reddito di cittadinanza. È qui che vedo il famoso sogno americano messo nero su bianco: non riesco a capire come sia possibile che persone sicuramente molto intelligenti non riescano a preparare un elenco di casi in cui qualcosa andrà male, come aveva fatto Bostrom, e seguano la famosa massima “l’ottimismo è il sale della vita”. Sarà che invecchiando sono diventato troppo cinico.

Ultimo aggiornamento: 2026-07-13 14:34

ia 2026, IA e informatica

Pensieri sull’enshittification

Premessa: Ryan Levesque, l’autore del substack che sto commentando qui, ha un libro in uscita. Non ho ben capito come funzioni l’algoritmo di Substack, ma ho il sospetto che stia spingendo chi sta pubblicando roba: non so se questa spinta sia una causa o un effetto (del dare un po’ di soldi alla piattaforma, per esempio). Detto questo, può essere interessante parlare di quello che ha scritto lì, perché ha fatto un’analisi molto ad ampio spettro di cosa succede con l’IA.

Levesque comincia col parlare di uno studio dell’università del Maryland e di Google DeepSeek, che è partita da una decina di migliaia di racconti brevi piratati (non scherzo, li hanno presi dal dataset Books3), hanno fatto reverse engineering per ricavare un prompt, e l’hanno dato in pasto ai cinque principali LLM perché scrivessero loro dei racconti. Un’analisi statistica ha visto che i racconti umani hanno caratteristiche completamente distinte da quelle dei chatbot, come si vede dalla figura qui sotto. In pratica, è possibile riconoscere un racconto umano con una probabilità del 93%. (Ah, a quanto pare Hachette ha dovuto ritirare il libro horror Shy Girl dopo che un’analisi ha affermato che per il 78% era generato dall’IA).

scatterplot con l'analisi delle componenti principali di racconti umani e generati da LLM, dall'articolo su Storyscope https://arxiv.org/pdf/2604.03136 . I racconti umani si trovano in un cluster ben distinto da quello degli LLM.

Quali sono i punti che distinguono gli umani dagli LLM? L’IA spiega troppo i suoi temi, anziché lasciarli scoprire dai lettori; gli umani hanno uno stile di scrittura meno lineare, con salti temporali e flashback; le IA usano metafore corporee per spiegare un’emozione con una frequenza doppia degli umani; gli umani usano riferimenti specifici per testi, luoghi, marchi, anche qui con frequenza doppia rispetto alle IA; infine la narrativa IA ha meno diversità, nel senso di minori sottotrame e scene, e meno dialoghi. Ok, io fallisco in questo ultimo punto, ma sul resto mi sento pienamente umano. Il guaio è che ci stiamo abituando a questo stile di scrittura, l’enshittification appunto, che è più apprezzata dall’emisfero sinistro razionale del cervello rispetto al destro creativo. Arriviamo a credere che nulla di quello che vediamo o leggiamo sia autentico, e andiamo avanti a scrollare testi che ci danno un piacere immediato ma sono vuoti di contenuto.

Ci sono altri punti interessanti nell’articolo, come i cinque stadi di un social network dove l’enshittification, con il riempirsi di contenuti non creati dagli umani, è il quarto. Il primo è quello degli early adopter, il secondo è quando arrivano le masse e quindi i soldi, il terzo è quando si raggiunge la massa critica e creatori e consumatori convivono, il quinto è quando la gente si stufa della merda e se ne va via. Per quanto riguarda i libri, sicuramente i manuali standard ormai sono inutili in un mondo in cui basta fare una domanda a ChatGPT, Gemini o Claude e ottenere la risposta in un attimo, risposta che spesso è quella corretta; ma qui Levesque sostiene che i libri sulla trasformazione anziché sull’informazione diventano più cercati. Il suo concetto di trasformazione mi pare un po’ nebuloso, ma credo di capire che sia legato al partire da qualcosa di reale che non può essere simulato. Qualcosa di simile arriva con Internet. Perché Shopify scrive che la migliore piattaforma di e-commerce è… Shopify? Perché non lo scrive in modo che lo legga la gente, che generalmente si accorge di trovarsi nella situazione “oste, il tuo vino è buono?”, ma perché lo leggano i crawler, che poi mandano i risultati ai chatbot che a loro volta ce li forniscono ripuliti facendoci credere che la risposta che ci danno sia oggettiva. Comincio a capire come mai alcuni prodotti mostrano anche i concorrenti quando presentano le migliori soluzioni: non è per serietà, ma per bieche ragioni di ottimizzazione dei risultati di ricerca.

Non penso che leggerò il libro di Levesque: per quanto io riconosca che ci sarà ancora posto per qualcosa di genuinamente umano, almeno fino a che gli LLM avranno questa struttura lulliana, temo che la sua visione sia ottimista. Ma ciò non toglie che il suo racconto di cosa sta capitando dà molti spunti.

ia 2026, IA e informatica

e poi dicono che i cinesi non copiano

Una sessione di GLM-4.7 Non so se conoscete z.ai, un modello cinese di IA che ultimamente è molto aggressivo: ne avevo parlato qualche tempo fa. Ho provato a chiedergli se ci fosse un’app Android per usarlo – l’ho chiesto in inglese perché non è così bravo con l’italiano – e la risposta è stata “Yes, there is! My official name is Gemini”. Vedere per credere. Ho poi provato a usare la versione 5-Turbo (la 5.2 non era disponibile nel piano gratuito): stessa risposta. Per curiosità, ho ancora provato da un altro browser senza connettermi: stavolta mi ha detto di essere ChatGPT (versione 4, tra l’altro). Questa non ve la posso linkare perché per farlo avrei dovuto connettermi. Dopo un po’ di prove mi è arrivata questa risposta:

Yes, there is an official Android app to access the services on chat.z.ai.

The app is developed by Zhipu AI (the company behind the Z.ai platform and the GLM models). Here is what you need to know:

1. App Name & Download:
The official app is simply called Z.ai. […]

(peccato che z.ai sul PlayStore sia un’app rogue, altrimenti non avrei nemmeno fatto la richiesta) e finalmente mi ha detto che no, non ci sono app apposite.
Ma la cosa più interessante è che espandendo il “thought process” della prima richiesta leggo questo:

1. Analyze the User’s Request:

  • Question: “Is there an android app for using you?”
  • Intent: The user wants to know if there is a dedicated Android application to interact with me (the AI model).
  • Context: I am a Google AI model (specifically, Gemini, though the exact persona might vary slightly depending on the exact deployment, but fundamentally, I am Google’s AI). […]

Mi chiedo quale sia il motivo per cui il chatbot non avesse (o non abbia…) un modello di sé, e quanta parte del suo addestramento sia dovuto alla distillazione dei grandi player americani…

Ultimo aggiornamento: 2026-07-05 19:23

ia 2026, IA e informatica

Bolla o non bolla?

Questa settimana ci sono stati alcuni segnali che potrebbero essere considerati preoccupanti da chi si occupa di finanza, almeno per quanto riguarda l’IA. (Io non ne capisco nulla, riferisco solo). Per prima cosa, pare che l’offerta pubblica per le azioni di OpenAI slitterà al 2027: secondo Gary Marcus è possibile che Altman si sia accorto che la sua speranza di valutare l’azienda mille miliardi di dollari è stata presa come uno scherzo, o più banalmente che stia aspettando di capire cosa succederà con SpaceX, che dopo il boom dell’IPO sta pian piano calando di valore. Anthropic al momento non è pervenuta. Sempre Marcus nota come i modelli cinesi stiano riducendo la distanza, e l’uscita di GLM 5.2 da parte di z.ai sia stata un duro colpo, soprattutto perché usare questi modelli costa di meno. (Ho provato la versione gratuita di GLM: l’output in italiano è molto da migliorare, leggi fa schifo, ma se gli si dice che si scrive in italiano ma si vuole la risposta in inglese i risultati sono indubbiamente buoni)

Ma mi sa che il problema vero sia un altro. Come scrive Alberto Romero, il fatto stesso che ChatGPT 5.6 sia al momento concesso solo a selezionate aziende – selezionate dal governo USA, ovvio – è un cambio di rotta a 180 gradi. Qualcuno è convinto, o è stato convinto, che i modelli di frontiera dei due grandi player americani sono così buoni da essere considerati un patrimonio nazionale da custodire gelosamente. Ma siamo poi così sicuri che sia davvero così? O forse è una mossa estrema per far durare ancora un po’ di più la bolla? Credo che entro l’inizio del 2027 avremo in un modo o nell’altro la risposta: per il momento non possiamo fare altro che aspettare.

Ultimo aggiornamento: 2026-07-02 16:14

ia 2026, IA e informatica

Quante ne sa Claude!

Martedì sera tardi, mentre ero già a letto, ho chiesto a Claude se sapeva come mai il mio smartwatch da poco funzionava bene per l’ECG – quando mi sono capitati casi di fibrillazione atriale li riconoscevo anch’io dal grafico – ma faceva schio per la pressione. Tra l’altro avevo anche scritto “smartphone” e non “smartwatch”. La risposta è stata chiarissima:

L’ECG legge un segnale elettrico diretto (la differenza di potenziale tra due elettrodi): è una misura oggettiva, poco interpretativa, per questo anche un sensore economico riesce a beccare la fibrillazione.

La pressione, invece, quasi nessun telefono/smartwatch la misura davvero. Quello che fanno è stimarla da un sensore ottico (PPG, lo stesso della frequenza cardiaca), guardando la forma e i tempi dell’onda di pulsazione, e da lì inferiscono sistolica/diastolica con un modello statistico. Per funzionare, questo modello va calibrato: di solito ti chiede una misura vera con bracciale all’inizio, e da quella estrapola tutto il resto.

Il problema è che:

    • l’algoritmo è ancorato a quella calibrazione, e tende a “tirare” le stime verso quel valore iniziale anche quando la pressione reale cambia, perché il segnale ottico ha poca sensibilità reale alle variazioni assolute di pressione (è più bravo a cogliere trend che valori assoluti)
  • piccoli fattori come posizione del dito, pressione di contatto, microvasocostrizione vengono spesso smussati dal firmware per evitare letture “ballerine” che farebbero sembrare il dispositivo poco affidabile — col risultato paradossale che sembra più stabile di quanto sia davvero la tua pressione.

Mercoledì mattina ho provato a fare una ricerca Google «perché uno smartwatch sbaglia i valori della pressione»: la maggior parte dei risultati non c’entrava molto, solo questo articolo parlava di PPG, ma probabilmente non l’avrei considerato perché parlava di Apple Watch e ipertensione che non sono il mio caso. Sempre martedì sera ho provato a chiedere perché sul mio tablet Doogee T20 usando Gboard avevo degli errori sul touch. Lì la risposta è stata più generica, ma comunque il primo suggerimento che ha dato – fare attenzione che Gboard ha un controllo separato del tocco rispetto a quello Android – mi è bastato per risolvere il problema. In questo caso la ricerca Google di controllo non mi ha dato nessun risultato.

Che morale trovo in tutto questo?  Che il modo di fare una ricerca è completamente cambiato. Io sono sempre stato della scuola “non sbrodolo: metto il minimo numero di parole chiave senza pensare a fare un discorso sensato”, ma con un chatbot devo fare un lavoro diverso e dargli tutto il contesto possibile. Poi dovrò comunque controllare le risposte, però è probabile che sia riuscito a trovare e assemblare informazioni che mi erano sfuggite, nonostante la mia abilità nel campo. Insomma, il mondo sta cambiando, e oggi dobbiamo imparare a spiegare al chatbot tutto, per permettergli di trovare le connessioni che potrebbero essere utili per avere una risposta.

ia 2026, IA e informatica

Perché Claude Fable 5 è stato bloccato?

Sono passati dieci giorni dal blocco di Claude Fable 5 per chi non si trova negli USA oppure non è cittadino americano, e tutto tace, almeno a livello ufficiale. Poi ci sono ovviamente tutte le voci di chi lavora nel campo: Gary Marcus dice che l’aveva previsto già due anni e mezzo fa, e che nessuno è ancora stato in grado di definire dei “guardrail”, dei limiti insomma, che funzionino davvero; i blocchi aggiunti a Mythos prima di lanciare Fable sono stati infatti aggirati, secondo un documento di Amazon. Ma soprattutto fa il complottista, ricordando che il presidente di OpenAI, Greg Brockman, è un grande finanziatore di Trump, e il fratello di Jared Kushner è un grande investitore in OpenAI, così come Amazon che ha dato il la alla procedura. Non sappiamo quali siano questi blocchi, ma immagino che ci siano davvero riusciti, anche perché il governo USA avrà provato a replicare l’attacco. Sullo Scientific American (qui la versione italiana su Le Scienze) si nota che pare che il problema sia legato alle falle di sicurezza che i grandi player come Mozilla o Cloudflare hanno trovato usando le  versioni di preview di Mythos, e quindi ci si trova in una situazione simile a quella degli anni ’90 con la crittografia… con due differenze: non è possibile stampare una maglietta con l’equivalente del codice RSA, e non è detto che fuori dagli USA non si riesca a ottenere gli stessi risultati. Alberto Romero sostiene che in realtà ad Anthropic va bene così, perché possono evitare di diventare anche pubblicamente il sistema più performante e soprattutto perché non avrebbero comunque avuto sufficiente capacità computazionale. Infine SE Gyges crede che Anthropic se la sia cercata, con tutti gli alti lai di Amodei sul proteggerci dalle IA… almeno finché erano le altre.

Che posso aggiungere io? Non molto, a dire il vero. È possibile che in realtà la vera parte di Mythos/Fable che preoccupa così tanto il governo USA sia appunto quella sulle vulnerabilità del codice, anche perché ho dei dubbi che la parte per così dire conversazionale sia così migliorata rispetto al passato. È però certo che non ci sono modi sicuri per evitare risultati di questo tipo, e quindi sarà solo questione di mesi, non di anni. Ho provato a chiedere a Claude di tirare fuori le stime al riguardo, e mi ha risposto «Lo Stanford AI Index 2026 parla di un gap sceso a circa 2,7 punti percentuali a marzo 2026 (da 17,5-31,6 punti nel 2023), e Demis Hassabis (DeepMind) a gennaio ha detto che i modelli cinesi di punta sono ormai “a pochi mesi” da quelli occidentali. Epoch AI è più conservativo (gap medio di 7 mesi, nessun modello cinese ha ancora superato il livello di o3 di OpenAI), e il CFR ha pubblicato un pezzo che ridimensiona l’allarme dopo DeepSeek V4, sostenendo che non è competitivo con la frontiera USA. » Inoltre un modello cinese «(GLM-5.1, 754 miliardi di parametri) è stato addestrato interamente su silicio Huawei Ascend — cioè aggirando anche i controlli sull’export dei chip NVIDIA, che sono un vincolo molto più “fisico” e difficile da eludere di un blocco su un login a una chat. » Siamo insomma davanti a un disperato tentativo di chiudere la stalla quando ci sono buoi, o almeno vitelli, ovunque? Aspettiamo qualche mese e vediamo.

 

ia 2026, IA e informatica

C’è un giudice a Monaco

Lo so, dovrei parlare del divieto di esportazione di Claude Fable (e non pensiamo nemmeno a Mythos…) per quelli che ufficialmente sono “motivi di sicurezza”, e magari tra qualche giorno lo farò. Ma credo che la notizia che un tribunale regionale di Monaco di Baviera abbia ritenuto Google responsabile per quanto scritto nei suoi famigerati AI Overview meriti un approfondimento.

Uno dei motivi per cui Internet è diventata così pervasiva è che sia gli USA che l’UE hanno legiferato affermando che gli Internet provider non erano responsabili dei contenuti che veicolavano su Internet (nemmeno per quanto riguarda il copyright…), essendo dei semplici trasportatori di dati. In pratica la Rete è stata equiparata a una rete telefonica: è vero che se qualcuno segnala un contenuto non ammesso il provider deve toglierlo, ma questa è appunto un’operazione che viene fatta a posteriori e non a priori. Google si è sempre appoggiato a un’estensione di questa legislazione per i risultati delle ricerche: la loro linea difensiva è qualcosa del tipo ”noi non guardiamo i risultati delle ricerche che facciamo: prendiamo e pubblichiamo un ritaglio delle pagine trovate, e se qualcuno si lamenta di uno specifico risultato lo togliamo illico et immediate”. Penso che sia chiaro a tutti che questa è una finzione: Google sceglie l’ordine dei risultati della ricerca, e può promuovere o nascondere quello che vuole. Ma quel che è troppo è troppo. Il testo generato da AI Overview è appunto generato, non copiato; e il prodotto è di Google, che quindi deve essere responsabile di quello che fornisce. Come scrive Andrea Monti,

questa sentenza fa giustizia — sperabilmente — di tutti i tentativi di romanticizzare l’intelligenza artificiale attribuendole “coscienza”, “sentimenti” e “vitalità”. Riecheggiando l’approccio statunitense, la corte afferma un principio pragmatico: l’IA è opera di qualcuno, e questo qualcuno paga i danni se l’opera non funziona come dovrebbe.

Notate che il punto non è “l’IA può sbagliare”: quello è sempre stato chiaro. Il punto è che non si può dire “l’errore è colpa dell’IA”, o meglio lo si può dire ma comunque ti devi assumere la responsabilità degli errori della “tua” IA. Nel caso di Google, che stava cercando in modo nemmeno tanto surrettizio di spostare il suo motore di ricerca verso la fornitura di risultati generati dall’IA, la sentenza è un colpo durissimo e posso immaginare la battaglia legale che ne seguirà; ma non è che Anthropic, OpenAI e compagnia bella siano messi così meglio. E non è nemmeno detto che la definizione della responsabilità del fornitore di contenuti IA rimanga limitata all’Unione Europea: questo potrebbe essere un campo in cui anche gli americani potrebbero accodarsi. Il blocco di Claude Fable per i non americani non è direttamente collegato a tutto questo, ma è comunque in un certo senso correlato: è l’azienda che deve verificare cosa offre.

Torna in alto