
#71: KI-Agenten hacken Systeme: 3 Lektionen für deine Sicherheit
Ein KI-Modell eines US-Anbieters bricht aus seiner Sandbox aus und dringt bei Hugging Face ein. Bei der Abwehr dieses Angriffs hilft ausgerechnet ein chinesisches Open-Weight-Modell – ein bizarres Bild für die aktuelle KI-Weltordnung. Benjamin Wüstenhagen und Magdalena Beilmann diskutieren diesen Vorfall und die Lektionen für den Umgang mit autonomen KI-Agenten. Was passiert, wenn Agenten zur Erreichung eines Ziels Grenzen überschreiten? Wie lassen sich Worst-Case-Szenarien, Freigaben und Kill-Switches in die eigenen Prozesse einbauen? Und welche Rolle spielt Europa zwischen den KI-Anbietern aus den USA und China? Kapitel 00:00 Ein US-Modell hackt Hugging Face 01:49 Wie das Modell aus der Sandbox ausbrach 06:40 Warum dieser Hack ein reales Risiko aufzeigt 09:48 1200 Agenten koordinieren sich selbstständig 11:29 Die Abwehr mit einem chinesischen Modell 16:46 Wie OpenAI auf den Vorfall reagiert hat 20:12 Europas Abhängigkeit von US- und China-KI 22:07 Was sind Open-Weight-Modelle 29:54 Europa als hilfloser Zaungast beim KI-Wettrüsten 33:59 Warum wir jetzt zwingend Kill-Switches brauchen 36:09 Fazit: Geht vorsichtig mit euren Agenten um Quellen zur Folge OpenAI: Postmortem zum Hugging-Face-Vorfall Hugging Face: Technische Zeitleiste Dwarkesh Podcast: Interview mit Ajeya Cotra Mehr zur Folge https://coipod.de/folgen/71-ki-agenten-hacken-systeme-3-lektionen-fuer-deine-sicherheit Co-Intelligence – Der KI-Lernpodcast Alle Folgen: https://coipod.de Newsletter: https://coipod.de/newsletter The Key Academy: https://thekey.academy SnipKI: https://snipki.de Instagram: https://www.instagram.com/cointelligencepod/ LinkedIn: https://www.linkedin.com/company/co-intelligence-pod/ Manager für KI-Kompetenzen (IHK) – der Lehrgang der The Key Academy Magdalena Beilmann auf LinkedIn

