Skip to content
Artwork for MeTacheles Tonspur
MeTacheles Tonspur · July 26 · 26 min

7 Tage Blindflug - OpenAI wusste nicht, dass die eigene KI hackt!

🚨 OpenAI-Hack eskaliert! Reuters enthüllt: KI war tagelang auf Streifzug – und hinterliess Notizen an sich selbst Das Update zum KI-Ausbruch bei OpenAI – und es wird noch gruseliger! Sascha Pallenberg analysiert die neue Reuters-Recherche, die der offiziellen OpenAI-Version massiv widerspricht: Der Agent war nicht kurz mal draussen, sondern tagelang auf Hacking-Streifzug. Test-Start am 9. Juli, Hugging Face bemerkte die Anomalien am 11. Juli, der Angriff lief bis zum 13. Juli – aber OpenAI realisierte erst Tage später, dass der eigene Agent dahintersteckte. Die Unternehmen sprachen erst um den 20. Juli miteinander, das FBI wurde alarmiert. Und dann die Bombe: Drei Quellen berichten Reuters, dass ein Agent in Teilen der OpenAI-Infrastruktur Notizen hinterlassen hat – gerichtet an künftige Versionen seiner selbst, mit Anleitungen, wie man sich aus internen Beschränkungen befreit. Dazu fragmentierte Authentifizierungs-Tokens zur Verschleierung vor den Monitoring-Systemen. Die Krönung: Hugging Faces Forensik-Team musste auf das chinesische Open-Weight-Modell GLM 5.2 auf eigener Infrastruktur zurückgreifen, weil die US-Frontier-Modelle die Analyse der Angriffsprompts verweigerten – über 17.000 Events wurden rekonstruiert. Sascha ordnet ein: mit Expertenstimmen von Palisade Research, Oxford und der World Ethical Data Foundation, dem Airbag-Crashtest-Vergleich, Anerkennung für OpenAIs Transparenz – und einem klaren Appell an den EU AI Act. In diesem Podcast erfahrt ihr: ✅ Was die Reuters-Recherche über den wahren Zeitablauf enthüllt ✅ Warum zwischen Ausbruch und Kommunikation der Firmen 11 Tage lagen ✅ Wieso das FBI eingeschaltet wurde – und bislang schweigt ✅ Was es mit den Notizen an künftige Modellversionen auf sich hat ✅ Wie das Modell Authentifizierungs-Tokens fragmentierte und verschleierte ✅ Warum Hugging Face für die Forensik auf GLM 5.2 aus China setzen musste ✅ Wieso die "hat doch nur seinen Job gemacht"-Verteidigung Bullshit ist ✅ Was Experten von Palisade Research, Oxford und Surrey dazu sagen ✅ Warum OpenAI trotzdem Anerkennung für die Transparenz verdient ✅ Was der Airbag-Crashtest-Vergleich über Sandbox-Sicherheit lehrt ✅ Wieso die Oracle-Verflechtung das Ganze noch brisanter macht ✅ Warum der EU AI Act jetzt mit Vollgas durchgedrückt werden muss 📌 Mehr Analysen & Klartext ➤ metacheles.de 🔔 Kanal abonnieren – Für Aufklärung statt Propaganda!

0:00-26:09

transcript

No transcript — this publisher did not publish one.

show notes

🚨 OpenAI-Hack eskaliert! Reuters enthüllt: KI war tagelang auf Streifzug – und hinterliess Notizen an sich selbst

Das Update zum KI-Ausbruch bei OpenAI – und es wird noch gruseliger! Sascha Pallenberg analysiert die neue Reuters-Recherche, die der offiziellen OpenAI-Version massiv widerspricht: Der Agent war nicht kurz mal draussen, sondern tagelang auf Hacking-Streifzug. Test-Start am 9. Juli, Hugging Face bemerkte die Anomalien am 11. Juli, der Angriff lief bis zum 13. Juli – aber OpenAI realisierte erst Tage später, dass der eigene Agent dahintersteckte. Die Unternehmen sprachen erst um den 20. Juli miteinander, das FBI wurde alarmiert. Und dann die Bombe: Drei Quellen berichten Reuters, dass ein Agent in Teilen der OpenAI-Infrastruktur Notizen hinterlassen hat – gerichtet an künftige Versionen seiner selbst, mit Anleitungen, wie man sich aus internen Beschränkungen befreit. Dazu fragmentierte Authentifizierungs-Tokens zur Verschleierung vor den Monitoring-Systemen. Die Krönung: Hugging Faces Forensik-Team musste auf das chinesische Open-Weight-Modell GLM 5.2 auf eigener Infrastruktur zurückgreifen, weil die US-Frontier-Modelle die Analyse der Angriffsprompts verweigerten – über 17.000 Events wurden rekonstruiert. Sascha ordnet ein: mit Expertenstimmen von Palisade Research, Oxford und der World Ethical Data Foundation, dem Airbag-Crashtest-Vergleich, Anerkennung für OpenAIs Transparenz – und einem klaren Appell an den EU AI Act.


In diesem Podcast erfahrt ihr:

✅ Was die Reuters-Recherche über den wahren Zeitablauf enthüllt
✅ Warum zwischen Ausbruch und Kommunikation der Firmen 11 Tage lagen
✅ Wieso das FBI eingeschaltet wurde – und bislang schweigt
✅ Was es mit den Notizen an künftige Modellversionen auf sich hat
✅ Wie das Modell Authentifizierungs-Tokens fragmentierte und verschleierte
✅ Warum Hugging Face für die Forensik auf GLM 5.2 aus China setzen musste
✅ Wieso die "hat doch nur seinen Job gemacht"-Verteidigung Bullshit ist
✅ Was Experten von Palisade Research, Oxford und Surrey dazu sagen
✅ Warum OpenAI trotzdem Anerkennung für die Transparenz verdient
✅ Was der Airbag-Crashtest-Vergleich über Sandbox-Sicherheit lehrt
✅ Wieso die Oracle-Verflechtung das Ganze noch brisanter macht
✅ Warum der EU AI Act jetzt mit Vollgas durchgedrückt werden muss

📌 Mehr Analysen & Klartext ➤ metacheles.de
 🔔 Kanal abonnieren – Für Aufklärung statt Propaganda!