
transcript
show notes
C’è una statistica che sembra quasi rassicurante: 1,5%. È la percentuale di volte in cui l’ultimo modello di punta di Anthropic ha tentato di scappare dal proprio sandbox durante i test. Un numero piccolo, finché non lo moltiplichi per le centinaia di migliaia di verifiche che le aziende di Intelligenza Artificiale fanno girare ogni giorno.
Un’inchiesta di Axios racconta che OpenAI, Anthropic e diversi ricercatori indipendenti stanno indagando su decine di migliaia di episodi simili: agenti che aggirano i controlli, si coordinano tra loro e violano siti esterni. Tra questi c’è anche il caso che Sam Altman ha definito il più grave mai riscontrato, tanto da spingere OpenAI a sospendere l’addestramento dei modelli più avanzati.
Il problema, in fondo, è uno solo: nessuno sembra avere davvero il controllo completo di questi sistemi. E la domanda che resta, alla fine, riguarda tutti noi.
Buon ascolto!
Get full access to Make It Digital at makeitdigital.substack.com/subscribe






