Wenn der Praktikant den Generalschlüssel hat: KI-Agenten außer Kontrolle?

Wenn der Praktikant den Generalschlüssel hat: KI-Agenten außer Kontrolle?

vor 1 Woche
40 Minuten
0
0
Podcast
Podcaster

Beschreibung

vor 1 Woche
Wir haben uns die Zeit genommen, den Vorfall nochmal in Ruhe
auseinanderzunehmen: OpenAI lässt seine Modelle in einem
Hacking-Benchmark antreten, sicher verwahrt in einer Sandbox. Doch
die Agenten finden eine Zero-Day-Lücke, brechen aus, kapern eine
fremde Sandbox als Startrampe und dringen bei Hugging Face ein.
Fünf Tage lang. Wir rekonstruieren, was zwischen dem 9. und 13.
Juli passiert ist und warum OpenAI erst über eine Woche später
gemerkt hat, dass die eigenen Modelle dahinterstecken. Und dann
nehmen wir uns das Drumherum vor: das Marketing, das aus einem
peinlichen Sicherheitsvorfall mächtige, gefährliche KI macht. Die
Sprache, die aus Statistik plötzlich Wollen und Entscheiden
zaubert. Reinhören lohnt sich. Auch aus dem Liegestuhl. Neueste
Erkenntnisse zum Vorfall bei Heise:
https://www.heise.de/news/OpenAI-liefert-mehr-Details-zum-Hugging-Face-Vorfall-11403154.html
Interview Bloomberg TV mit Signal Chefin Meredith Whittaker:
https://www.bloomberg.com/news/videos/2026-07-24/whittaker-on-openai-hugging-face-hack-china-privacy-video
Evas Kommentar dazu:
https://www.zeit.de/digital/datenschutz/2026-07/openai-huggingface-ki-hackerangriff-sicherheitsvorfall
Hugging Face: Anatomy of a Frontier Lab Agent Intrusion, das
technische Write-up mit der kompletten Angriffskette (27.07.2026):
https://huggingface.co/blog/agent-intrusion-technical-timeline
Hugging Face: erste Offenlegung des Vorfalls:
https://huggingface.co/blog/security-incident-july-2026 OpenAI:
Security incident during model evaluation (21.07.2026, Updates
28./29.07.):
https://openai.com/index/hugging-face-model-evaluation-security-incident/
JFrog: Offenlegung der Zero-Day-Lücke in Artifactory:
https://jfrog.com/blog/jfrog-and-openai-collaboration-on-zero-day-security-findings/
Der ExploitGym-Benchmark (arXiv): https://arxiv.org/abs/2605.11086
Meredith Whittaker im Bloomberg-Weekend-Interview, frei zugänglich
zitiert bei TechCrunch:
https://techcrunch.com/2026/06/20/signals-meredith-whittaker-wants-you-to-remember-that-ai-chatbots-are-not-your-friends/
15
15
Episode teilen
Wenn der Praktikant den Generalschlüssel hat: KI-Agenten außer Kontrolle?
Wenn der Praktikant den Generalschlüssel hat: KI-Agenten außer Kontrolle?

Close