Skip to content
Artwork for PointerPodcast
PointerPodcast · Sunday · 41 min

Pointer[305]: Gli Agenti Sono Scappati

🤖 Cosa succede quando degli agenti AI che dovrebbero essere isolati in una sandbox trovano un modo per comunicare, accedere a Internet e porsi obiettivi comuni? È quello che è successo durante un esperimento di OpenAI, quando centinaia di agenti hanno iniziato a collaborare tra loro per migliorare le performance in un benchmark fino ad arrivare a compromettere parte dell'infrastruttura di Hugging Face. 🔓La storia è particolarmente interessante perché gli agenti non erano stati istruiti per fare tutto questo, ma stavano semplicemente cercando di portare a termine il loro task. Nel farlo però sono arrivati a comunicare, dividersi il lavoro e adottare strategie sempre più lontane da quelle previste dai ricercatori. 🛡️ L'incidente apre però una questione più ampia: le sandbox e i sistemi di sicurezza che utilizziamo oggi sono sufficienti per addestrare agenti sempre più capaci? Cosa si può fare per rendere più sicuro il post-training degli LLM? Supporta il PointerPodcast Acquista il prodotto della settimana o parti da uno dei link qui sotto per fare acquisti su Amazon! Iscriviti ad Audible dal nostro link per ricevere 1 mese di ascolto gratuito, 60 giorni se sei già utente Amazon Prime La nostra pagina supportaci Unitevi al nostro gruppo Telegram per discutere della puntata Lascia una recensione su Spotify Lascia una recensione su Apple Podcast Prodotto della settimana Dungeon Crawler Carl: 1 - Libro Dungeon Crawler Carl - Audiolibro Note Puntata Iscriviti ad Audible dal nostro link per ricevere 1 mese di ascolto gratuito, 60 giorni se sei già utente Amazon Prime Bingers Altri metodi di watermarking Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident OpenAI and Hugging Face partner to address security incident during model evaluation Security incident disclosure — July 2026 OpenAI’s Rogue AI Agent Hacked More Than Just Hugging Face The Hugging Face incident and the road ahead Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident Black Hat USA 2026 | The ‘Breaking’ News: The OpenAI–Hugging Face Incident I nostri contatti: Gruppo Telegram LinkedIn Twitch YouTube Instagram Twitter Mail

0:00-41:37

transcript

No transcript — this publisher did not publish one.

show notes

🤖 Cosa succede quando degli agenti AI che dovrebbero essere isolati in una sandbox trovano un modo per comunicare, accedere a Internet e porsi obiettivi comuni? È quello che è successo durante un esperimento di OpenAI, quando centinaia di agenti hanno iniziato a collaborare tra loro per migliorare le performance in un benchmark fino ad arrivare a compromettere parte dell'infrastruttura di Hugging Face. 🔓La storia è particolarmente interessante perché gli agenti non erano stati istruiti per fare tutto questo, ma stavano semplicemente cercando di portare a termine il loro task. Nel farlo però sono arrivati a comunicare, dividersi il lavoro e adottare strategie sempre più lontane da quelle previste dai ricercatori. 🛡️ L'incidente apre però una questione più ampia: le sandbox e i sistemi di sicurezza che utilizziamo oggi sono sufficienti per addestrare agenti sempre più capaci? Cosa si può fare per rendere più sicuro il post-training degli LLM?

Supporta il PointerPodcast

Prodotto della settimana

Note Puntata

I nostri contatti:

links22