
Claude Mythos Preview: Anthropic sperrt KI-Sicherheitstests — Sandbox-Lücken gepatcht
Anthropic hat seinem neuen Modell Claude Mythos Preview den öffentlichen Zugang verweigert — nicht wegen mangelhafter Qualität, sondern aus Sicherheitsgründen. Wie t3n berichtet, kann das Modell nicht nur Sicherheitslücken in Software-Code finden, sondern generiert auch funktionierenden Code, um diese Lücken auszunutzen. Die Fähigkeit zur autonomen Exploit-Generierung führte zu einer bewussten Entscheidung gegen eine breite Verfügbarkeit.
Parallel dazu hat Anthropic eine kritische Schwachstelle in Claude Code stillschweigend gepatcht. SecurityWeek meldet, dass ein Sicherheitsforscher einen Sandbox-Bypass entdeckt hatte, der in Kombination mit Prompt-Injection-Angriffen zu Datenlecks führen könnte. Die genauen Details der Lücke wurden aus Sicherheitsgründen nicht vollständig offengelegt — ein Standard-Vorgehen, um Missbrauch zu verhindern, bis Nutzer aktualisiert haben. Der stille Patch deutet darauf hin, dass Anthropic das Risiko als erheblich eingestuft hat.
Diese Entwicklungen markieren einen Wendepunkt in der KI-Sicherheitsdebatte. Während Anthropic restriktiv reagiert, verstärkt Google seinen Gegenzug: The Verge dokumentiert, dass Google mit CodeMender ein eigenes "AI Agent for Code Security" entwickelt und select Experten zur API-Teilnahme einlädt. Der Wettbewerb um sichere KI-Systeme für Sicherheitsanalysen verschärft sich.
Für den deutschsprachigen Mittelstand ist dies hochrelevant. Wer KI-gestützte Code-Reviews oder Penetrationstests plant, muss verstehen: Diese Modelle können Lücken nicht nur finden, sondern auch aktiv ausnutzen — das verschärft die Anforderungen an Sandboxing und Zugriffskontrolle erheblich. Unternehmen, die Claude oder ähnliche Systeme für Sicherheitsanalysen nutzen möchten, sollten damit rechnen, dass Anthropic künftig strengere Compliance- und Nutzungsrichtlinien durchsetzt. Die DSGVO-Implikationen sind ebenfalls klar: Prompt-Injection-Risiken in KI-Tools können zu unerwarteten Datenlecks führen — dokumentierte Sicherheitsmaßnahmen sind jetzt nicht optional.
Der konkrete Handlungsschritt: Prüfe deine aktuellen KI-Tools auf die Zugriffsebene. Wenn Modelle wie Claude Code auf Produktiv-Systeme zugreifen können, ist eine Safety-Pipeline zwingend erforderlich. Zusätzlich sollten Pentesting-Szenarien in deine Red-Team-Checkliste aufgenommen werden — mit besonderem Fokus auf Sandbox-Escapes und Datenleck-Ketten.