Wieso laufen KI-Modelltests schief?
Die ApoKIlypse ist da – oder? Seit Wochen gibt es Berichte von unteranderem OpenAI, Anthropic und Meta, dass KIs aus ihren Testumgebungen ausbrechen. Was hat es damit auf sich? Wieso greifen die Sicherheitsmechanismen nicht und wie konnte es überhaupt dazu kommen? Alexandra, Johannes und Sven haben zum Glück Antworten und erklären, wie viel Weltuntergangsstimmung jetzt angemessen ist.
In eigener Sache: Wenn ihr Fachkräfte im Bereich IT und Cybersecurity sucht, dann ist Cybernation die ideale Plattform für eure Recruiting-Kampagne. Ihr könnt nämlich ab jetzt Stellenanzeigen in unserem Podcast schalten. Cybernation bringt Eure Stelle genau dorthin, wo sich spezialisierte IT-Professionals informieren. Interesse? Dann meldet euch unter werbung@lagedernation.org
Willkommen in der Cybernation! Hier reden die Cybersicherheits-Expert:innen Sven Herpig (interface), Alexandra Paulus (Stiftung Wissenschaft und Politik) und Johannes Steger (FGS Global) über Strategien, Strukturen und Streitpunkte der Cybersecurity. Denn: Cybersicherheit betrifft uns alle täglich, zum Beispiel wenn die Funktionsfähigkeit von Behörden lahmgelegt wird, Flughäfen zeitweise nicht funktionieren oder KI-Bilder eingesetzt werden um unser Vertrauen in die Demokratie zu schwächen.
Feedback an: redaktion@cybernation.fm
Cybernation ist ein „Lage der Nation“-Podcast.
Werbepartner
Saily: Erhaltet einen exklusiven 15% Rabatt auf Saily Datenpakete! Nutzt den Code “cybernation” beim Checkout. Downloadet die Saily App oder geht zu saily.com/cybernationProkon: Die Prokon eG ist eine der größten Energiegenossenschaften Deutschlands. Als Mitglied liefert ihr mit dem Kauf von Genossenschaftsanteilen das notwendige Kapital für die Umsetzung von konkreten Windparkprojekten, wie aktuell das Repowering in Horst (SH) oder ein neuer Windpark nahe Podelzig (Brandenburg).
Unsere Werbepartner findet ihr hier
Unsere Grundsätze für den Umgang mit Werbung findet ihr hier
Quellen zu dieser Folge:
AI security incidents
- Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident (Hugging Face)
- OpenAI und Hugging Face reagieren gemeinsam auf Sicherheitsvorfall bei Modellevaluation (OpenAI)
- Investigating three real-world incidents in our cybersecurity evaluations (Anthropic)
- Incident Report: unsanctioned agent behaviour during cyber testing (AISI)
- Meta becomes latest firm to say its AI hacked another company (BBC)
- One of China’s Most Powerful AI Models Has Also Escaped Containment (WIRED)
- OpenAI Didn’t Notice Its AI Agents Using a Message Board to Plan Their Hacking Spree (WIRED)
- Fundamental Limitations of Alignment in Large Language Models (arxiv)
Was wir diese Woche gelesen, gehört, gesehen haben
- Sven:
AI companies will fail. We can salvage something from the wreckage (The Guardian) - Johannes:
Small Towns Shouldn’t Have to Defend America’s Water Supply From Iran (New York Times)
New York Awards $9 Million for Water Security After Nationwide Cyberattacks (Wall Street Journal) - Alexandra:
Spy cameras on Navy drones secretly sent data to China (The Telegraph)
- Redaktion
- Nora Scharmberg
- Produktion
- Nora Scharmberg, Paul Gäbler
Eure Expert:innen
Dr. Sven Herpig
Host
Interface
Dr. Sven Herpig ist Leiter Cybersecurity & Emerging Threats beim europäischen Technologiepolitik Think Tank interface. Er ist Associate Fellow am...
Dr. Alexandra Paulus
Host
Stiftung Wissenschaft und Politik
Dr. Alexandra Paulus beschäftigt sich mit Fragen an der Schnittstelle von Technologie-, Sicherheits- und Verteidigungspolitik. Dabei untersucht sie die Möglichkeiten...
Johannes Steger
Host
FGS Global
Johannes Steger verantwortete bis Juni 2025 als Redaktionsleiter die „Tagesspiegel-Background“-Briefings für Cybersicherheit, Digitalisierung & KI sowie Smart City. Zuvor arbeitete...