Bullshit-Indikator im roten Bereich: Claude Mythos, Hype und Agenten
transcript
show notes
„Tausende Zero-Day-Schwachstellen", so lauteten einige Schlagzeilen rund um Anthropics neues Modell Claude Mythos. Eva hat bereits skeptisch berichtet und prompt einen wütenden Leserbrief kassiert: schlecht recherchiert, KI-Skepsis als Dogma. Blöd nur, dass ausgerechnet in dieser Woche ein 244-seitiges Dokument auftaucht, das Evas Einschätzung Punkt für Punkt bestätigt. Svea und Eva nehmen die Mythos-Behauptungen auseinander — und fragen, was KI-Hype mit Demokratie macht, wenn Finanzminister und IWF-Chefs auf Basis von PR-Meldungen in Panik verfallen. Dazu: Warum KI-Benchmarks schon lange keine Wissenschaft mehr sind, sondern Marketing. Und Eva berichtet aus erster Hand, was passiert, wenn man einen KI-Agenten auf den eigenen Rechner lässt, inklusive Telemetrie-Ordner, den niemand bestellt hat.
Shownotes
Blogpost zu Claude Mythos: https://www.flyingpenguin.com/the-boy-that-cried-mythos-verification-is-collapsing-trust-in-anthropic/
Menschlicher Benchmark https://arena.ai/
Talk zu Hype vom IfJ https://www.youtube.com/watch?v=PeWOEIp7ZsM
Das International Journalism Festival https://www.journalismfestival.com/