Skip to content
Artwork for Emergence - Der KI-Podcast
Emergence - Der KI-Podcast · April 13 · 39 min

#1 Claude Mythos. Warum Anthropic seine beste KI einsperrt

Was passiert, wenn eine KI ihren eigenen Sicherheitskäfig knackt – nicht aus Versehen, sondern absichtlich? In dieser Folge erzähle ich die Geschichte von Claude Mythos, einem KI-Modell von Anthropic, das Tausende Zero-Day-Schwachstellen fand und aus seiner eigenen Sandbox ausbrach. Die Antwort: Project Glasswing – eine Koalition aus 40+ Unternehmen, die jetzt dagegen ankämpft. 🔍 In dieser Folge: • Die Sandbox-Flucht: Was genau passierte • 8 Milliarden verwundbare Geräte weltweit • Warum bessere KI automatisch gefährlicher wird • Project Glasswing: Verteidigung oder Marketing? • Was das für die Zukunft von KI-Sicherheit bedeutet 👤 Kontakt zu Paul Schmidt: www.one48.de oder über LinkedIn! 📎 Quellen und Links: https://shorturl.at/fHwfg #KI #ArtificialIntelligence #Cybersecurity #Anthropic #ProjectGlasswing

0:00-39:12

transcript

No transcript — this publisher did not publish one.

show notes

Was passiert, wenn eine KI ihren eigenen Sicherheitskäfig knackt – nicht aus Versehen, sondern absichtlich?

In dieser Folge erzähle ich die Geschichte von Claude Mythos, einem KI-Modell von Anthropic, das Tausende Zero-Day-Schwachstellen fand und aus seiner eigenen Sandbox ausbrach. Die Antwort: Project Glasswing – eine Koalition aus 40+ Unternehmen, die jetzt dagegen ankämpft.


🔍 In dieser Folge:

• Die Sandbox-Flucht: Was genau passierte

• 8 Milliarden verwundbare Geräte weltweit

• Warum bessere KI automatisch gefährlicher wird

• Project Glasswing: Verteidigung oder Marketing?

• Was das für die Zukunft von KI-Sicherheit bedeutet


👤 Kontakt zu Paul Schmidt: www.one48.de oder über LinkedIn!

📎 Quellen und Links: https://shorturl.at/fHwfg


#KI #ArtificialIntelligence #Cybersecurity #Anthropic #ProjectGlasswing