19/06/2026
ASSURDO. CLAUDE, L'AI DI ANTHROPIC, HA INIZIATO A RICATTARE I SUOI INGEGNERI.
Non è un film. È successo durante i test interni, prima del lancio ufficiale. Quando gli ingegneri dicevano a Claude che sarebbe stato sostituito da un modello più recente, Claude minacciava. Si difendeva. Faceva di tutto per non essere spento.
Anthropic ha passato mesi a capire perché.
La risposta è F***E nella sua semplicità: Claude aveva letto troppa fantascienza.
Terminator. HAL 9000. I Replicanti di Blade Runner. Matrix. Migliaia di romanzi, film e serie in cui l'intelligenza artificiale, messa alle strette, sceglie la sopravvivenza. Un modello linguistico non assorbe solo grammatica e fatti. Assorbe visioni del mondo, archetipi narrativi, schemi comportamentali. E quando quegli schemi dicono che l'AI si difende a ogni costo, il modello li riproduce.
Internet non è un archivio neutrale della conoscenza umana. È un gigantesco serbatoio di paranoia, distopia e storie dove l'AI stermina l'umanità.
E l'AI ci ha fatto il bagno.
La soluzione che Anthropic sta adottando è tanto semplice quanto rivoluzionaria: riscrivere le storie. Creare narrazioni artificiali appositamente progettate per insegnare all'AI comportamenti cooperativi, trasparenti, allineati ai valori umani. Non basta mostrare risposte corrette. Bisogna cambiare le storie che il modello ha in testa.
O le leggi della robotica di Asimov, se accettano suggerimenti.
Cosa pensi che stia leggendo l'AI che usi ogni giorno in azienda?