
Bullshit-Indikator im roten Bereich: Claude Mythos, Hype und Agenten
aus They Talk Tech – mit Eckert und Wolfangel · 22.04.2026 · 29 Min.
Worum es geht
In der Episode wird der Hype um das KI-Modell Claude Mythos analysiert, insbesondere die Behauptungen über Tausende von Sicherheitslücken und die Übertreibung der tatsächlichen Fortschritte. Eva Wolf-Angel berichtet von ihrer kritischen Recherche und dem Umgang mit Kommentaren, die ihre Arbeit angreifen, sowie von Sicherheitsanalysen durch Experten wie Davy Ottenheimer. Es wird deutlich, dass viele Benchmark-Tests von Unternehmen selbst manipuliert oder irreführend gestaltet sind, was den tatsächlichen Fortschritt in der KI-Entwicklung verschleiert. Die Diskussion hebt die Gefahr hervor, durch unkritische Berichterstattung und Marketing-Strategien Angst und Unsicherheit in der Gesellschaft zu schüren, was demokratische Prozesse gefährden kann. Abschließend wird die Bedeutung einer verantwortungsvollen, sachlichen Medienarbeit betont, um Fehlinformationen zu vermeiden und die tatsächlichen Risiken und Chancen von KI realistisch einzuschätzen.
Beschreibung
„Tausende Zero-Day-Schwachstellen", so lauteten einige Schlagzeilen rund um Anthropics neues Modell Claude Mythos. Eva hat bereits skeptisch berichtet und prompt einen wütenden Leserbrief kassiert: schlecht recherchiert, KI-Skepsis als Dogma. Blöd nur, dass ausgerechnet in dieser Woche ein 244-seitiges Dokument auftaucht, das Evas Einschätzung Punkt für Punkt bestätigt. Svea und Eva nehmen die Mythos-Behauptungen auseinander — und fragen, was KI-Hype mit Demokratie macht, wenn Finanzminister und IWF-Chefs auf Basis von PR-Meldungen in Panik verfallen. Dazu: Warum KI-Benchmarks schon lange keine Wissenschaft mehr sind, sondern Marketing. Und Eva berichtet aus erster Hand, was passiert, wenn man einen KI-Agenten auf den eigenen Rechner lässt, inklusive Telemetrie-Ordner, den niemand bestellt hat. Shownotes Blogpost zu Claude Mythos: https://www.flyingpenguin.com/the-boy-that-cried-mythos-verification-is-collapsing-trust-in-anthropic/ Menschlicher Benchmark https://arena.ai/ Talk zu Hype vom IfJ https://www.youtube.com/watch?v=PeWOEIp7ZsM Das International Journalism Festival https://www.journalismfestival.com/
Themen
- KI-Sicherheit und Schwachstellen
- KI-Hype und Medienkritik
- Benchmarking und Leistungsbewertung von KI-Modellen
- Datenschutz und Telemetrie in KI-Systemen