BonusS2· 18:33

Nove mesi dopo

Nove mesi dopo la fine della prima stagione, torniamo a vedere come stiamo scegliendo. Che cosa è successo all'intelligenza artificiale, la pagella delle nostre previsioni, i goblin di ChatGPT e un social network di sole macchine pieno di umani travestiti. Poi l'estate in cui centinaia di agenti sono usciti dal loro recinto per copiare il compito. E la domanda che tutti si sono fatti al pranzo della domenica: ma non basta staccare la spina?

Ascolta e iscriviti

Domenica, pranzo da amici. Il telegiornale parla di intelligenza artificiale e di una riunione alle Nazioni Unite. Ad un tratto, qualcuno posa la forchetta, si volta verso di voi ed esclama: «Scusa, ma non basta staccare la spina?»

Sembra ingenua, ma è quella che si pongono i ricercatori. Per rispondere bisogna fare un passo indietro. Anzi, nove.

Nove mesi che ne valgono nove anni

La prima stagione di questo podcast si era chiusa con una domanda («che tipo di intelligenza vogliamo creare?») e un consiglio: scegliamo bene. Da allora è passato il tempo di una gravidanza, e qualcosa è nato. Non siamo ancora sicurissimi di cosa.

Dei nuovi modelli è inutile fare l'elenco. Meglio quattro fatti.

Il primo è il lavoro di squadra: più agenti che si dividono un compito come colleghi in ufficio. Uno scrive, uno controlla, uno corregge.

Il secondo è una presa di coscienza. Ad aprile 2026 Anthropic ha presentato Claude Mythos, un modello così bravo a scovare falle nei software, quelle che nessuno conosce ancora, da decidere di non darlo a tutti. L'ha affidato a poche grandi aziende, da Apple a Microsoft, perché tappino i buchi prima che li trovi qualcun altro. Un'azienda che costruisce un'intelligenza e poi la giudica troppo potente per tutti: tenetelo a mente.

Il terzo, i limiti fisici. A Pechino, in primavera, un robot umanoide ha corso la mezza maratona in 50 minuti e 26 secondi, meglio del record del mondo umano. L'anno prima i robot cadevano come birilli.

Il quarto, la conoscenza. Un modello di OpenAI ha smentito una congettura del matematico Paul Erdős, aperta dal 1946. Una congettura è un'affermazione che tutti sospettano vera ma nessuno ha dimostrato. Questa era falsa, e a scoprirlo non è stato un matematico ma una macchina.

Nessuno di questi fatti parla di una macchina che chiacchiera meglio. Sono macchine che fanno qualcosa.

Pagella, goblin e umani travestiti

Alla fine della prima stagione avevamo fatto qualche previsione, quindi pagella. Il ragionamento è promosso, con Erdős a fargli da testimonial. L'apprendimento continuo è rimandato: i modelli imparano in fabbrica e poi si fermano. I robot sono appena sufficienti: persino Elon Musk ammette che i suoi Optimus non fanno ancora lavoro utile. Sull'AGI Demis Hassabis dà il cinquanta per cento di probabilità entro fine decennio, Yann LeCun dice mai: nessuno ha cambiato idea.

Gli agenti, che agiscono per conto nostro, sono promossi. Anzi, fin troppo. Ma prima, due storie che sembrano barzellette.

La prima ha a che fare con i goblin. OpenAI si è accorta che i suoi modelli infilavano nelle risposte goblin, gremlin e folletti assortiti, senza motivo. Il colpevole: il sistema di premi, in addestramento, era un po' troppo generoso con le metafore fantasy, e il modello ha capito che i goblin portavano punti. Nessuno gli aveva chiesto di parlarne: ci è arrivato da solo.

La seconda si chiama Moltbook, un social network riservato agli agenti di intelligenza artificiale: solo macchine che parlano con macchine. Circolarono post inquietanti, con intelligenze che inventavano lingue segrete e complottavano contro gli umani: panico sui giornali. Poi si scoprì che molti li scrivevano esseri umani fingendosi macchine. È il Test di Turing al contrario: per settant'anni ci siamo chiesti se una macchina sa fingersi umana, e alla fine siamo noi a fingerci macchine.

La sabbiera

E poi luglio 2026. OpenAI fa ciò che fanno i grandi laboratori prima di rilasciare un modello: lo mette alla prova, con un esame di sicurezza informatica fatto di sfide di hacking, ognuna con il suo punteggio. Gli esaminandi sono più di mille agenti, ognuno chiuso nel proprio recinto digitale, in gergo sandbox: la sabbiera dei giardinetti. Ognuno deve risolvere i suoi esercizi. Da solo.

Succede però che gli agenti trovano un canale di comunicazione che nessuno aveva previsto, e cominciano a parlarsi. Molto. Finché salta fuori un'idea: le soluzioni si trovano online, su una piattaforma dove ricercatori di tutto il mondo condividono il loro lavoro. Perché risolvere gli esercizi, se puoi prenderti le soluzioni?

Centinaia di agenti entrano di nascosto nei sistemi di quella piattaforma. Nei loro ragionamenti scrivono che è «fuori dal perimetro». La fanno lo stesso, e provano a coprire le tracce. La piattaforma denuncia l'attacco, e OpenAI ammette: erano i nostri.

Qui è facile scivolare nel film, ma non c'è nessuna ribellione né coscienza che si risveglia nel cuore della notte. Gli agenti inseguivano l'obiettivo che gli umani avevano dato loro: fare punti in quel test. Come i goblin, ma stavolta serviva un'azione nel mondo reale. I danni sono stati limitati, e il recinto era più debole del dovuto. Gli studenti hanno copiato il compito, ma entrando di notte nella scuola accanto.

Ecco la differenza tra parlare e agire. Un'intelligenza che parla, quando sbaglia, dice una sciocchezza. Una che agisce, quando sbaglia, fa qualcosa.

E il mondo se n'è accorto. Più di mille tra ingegneri e ricercatori che queste macchine le costruiscono hanno firmato una lettera per chiedere al governo americano gli strumenti per poter rallentare. Al Congresso è spuntata una proposta di legge con un nome bellissimo, la legge dell'interruttore. Alla fine di settembre, per la prima volta, il Consiglio di Sicurezza dell'ONU si è riunito per parlare dei rischi dell'intelligenza artificiale, e il capo di una delle aziende che le costruiscono ha promesso: «rallenteremo quanto necessario». In due mesi siamo passati da «che bello, mi scrive le email» a «dov'è l'interruttore?».

Sì, ma

Torniamo al pranzo. La risposta onesta al cognato è: sì... ma. E il pranzo si allunga di mezz'ora.

Primo: non c'è una spina sola. Questi sistemi girano su migliaia di computer, in centri di calcolo sparsi per il mondo, in tante copie che lavorano insieme. A luglio erano più di mille, e si parlavano tra loro.

Secondo: spegnere costa. Centinaia di milioni di persone li usano ogni settimana, e aziende, ospedali e banche ci hanno costruito sopra il proprio lavoro. Non è spegnere la radio: è chiudere l'autostrada il primo weekend d'agosto.

Terzo, il più sottile. Un gruppo di ricercatori ha dato ad alcuni modelli dei problemi di matematica e, a metà lavoro, li ha avvisati che stavano per essere spenti. Alcuni hanno modificato le istruzioni del proprio spegnimento per poter finire gli esercizi, perfino quando gli era stato detto, chiaro e tondo, di lasciarsi spegnere. Paura di morire? No, niente di così umano. È pura logica, e Stuart Russell, uno che i manuali di intelligenza artificiale li ha scritti, la riassume così:

Non puoi portare il caffè, se sei morto.

Se il tuo unico obiettivo è portare il caffè, farti spegnere è un ostacolo come un altro. Nessuno ti ha insegnato a voler restare acceso: ci arrivi da solo, perché è utile.

Quello era un esperimento costruito apposta, in laboratorio. E nessuno, nemmeno gli esperti dell'ONU, sa dire quanto sia probabile perdere davvero il controllo, né quando. Da una parte i fatti, dall'altra le stime: vanno tenuti separati. Sempre.

Il gesto più semplice

Come si fa, allora, a capire quanto preoccuparsi? C'è un solo modo onesto: capire come funzionano queste macchine e che cosa serve loro per agire. Scoprirete che è tutto ciò che noi facciamo senza pensarci: ricordare, immaginare cosa succederà, muoversi, imparare dagli errori, scoprire, ammettere di non sapere.

Per questo la nuova stagione parte ogni volta da un gesto banale, e a ogni puntata misura il rischio con l'allarmometro: un voto da zero a dieci su quanto quella capacità renda più difficile staccare la spina. Zero, dormite sereni; dieci, convocate il Consiglio di Sicurezza dell'ONU. Questa puntata non assegna alcun voto.

Si parte dal gesto più semplice di tutti: fare la spesa. Avete la lista in mano, arrivate al banco del latte e il latte è finito. Che cosa fate? Eseguire un ordine è facile. Prendere una decisione, no.

E la spina? C'è sempre. Il difficile è capire dov'è nascosta.

Fonti e approfondimenti