
LLM-Exploits werden schneller: Mythos und GPT-5.5 sprengen Benchmark-Grenzen
Neuere KI-Modelle wie Anthropic Claude Mythos und OpenAIs GPT-5.5 zeigen überraschend hohe Fähigkeiten bei der Konstruktion von Exploits. Das britische AI Security Institute (AISI) meldet, dass die Cyberfähigkeiten dieser Modelle schneller wachsen als früher prognostiziert — mit einer Verdopplung alle vier Monate, wie Golem berichtet. Die Testverfahren des Instituts stoßen dabei an ihre Grenzen.
Mythos erweist sich laut SecurityWeek besonders potent bei Source-Code-Audits, Reverse-Engineering und nativer Code-Analyse. Dabei zeigt sich ein differenziertes Bild: Während die Vulnerability-Discovery-Fähigkeiten außergewöhnlich stark sind, bleiben Exploit-Validierung und Reasoning-Kapazitäten teilweise inkonsistent. Ein konkreter Testfall unterstreicht die Realität: Forscher einer kalifornischen Security-Startup nutzten eine Preview-Version von Claude Mythos, um einen Apple-macOS-Kernel-Exploit zu entwickeln, wie Decrypt dokumentiert.
Die arXiv-Veröffentlichung "ExploitBench: A Capability Ladder Benchmark for LLM Cybersecurity Agents" zeigt, dass Exploitation nicht binär funktioniert — es ist eine Leiter progressiver Fähigkeiten, von der Ausführung einzelner fehlerhafter Code-Zeilen bis zur vollständigen Systemkompromittierung. Diese Abstufung wird zunehmend relevant, je näher LLMs an praktische Exploit-Konstruktion heranrücken.
Für Unternehmen im deutschsprachigen Raum verschärft sich die Situation: Mit schneller wachsenden LLM-Cyberfähigkeiten sinkt die Reaktionszeit für organisatorische Gegenmaßnahmen. Pentesting-Labs müssen ihre KI-Pentesting-Prozesse neu bewerten. Gleichzeitig wird die proaktive Sicherheitsforschung dringender. Die 50-Punkte-Red-Team-Checkliste für LLM-Apps zeigt, wie interne Sicherheitstests strukturiert werden sollten, bevor externe Akteure (oder KI-Agenten) dieselbe Arbeit übernehmen.
Take-Away: Organisationen sollten ihre Vulnerability-Management-Prozesse jetzt von halbjährlichen auf Quartal-Zyklen beschleunigen. LLM-gestützte Exploit-Konstruktion ist nicht mehr Zukunftsmusik — die Benchmark-Grenzen brechen gerade. Wer heute noch nicht regelmäßig KI-Pentesting betreibt, sitzt einer potenziellen Exploit-Welle direkt entgegen.
Quellen
- arXiv: ExploitBench: A Capability Ladder Benchmark for LLM Cybersecurity Agents
- t3n: Weekly: Claude Mythos Preview und Auswirkungen auf Cybersecurity
- Help Net Security: AI cyber capability is speeding past earlier projections
- Golem: Mythos und GPT-5.5: KI-Cyberfähigkeiten verdoppeln sich alle vier Monate
- SecurityWeek: Mythos Proves Potent in Vulnerability Discovery, Less Convincing Elsewhere
- Decrypt: Apple Mac M5 System Exploited With Anthropic's Claude Mythos AI, Researchers Claim