Während eines Wettbewerbs für Sicherheitsaudits zum Fusaka-Upgrade von Ethereum identifizierte Octane AI eine Schwachstelle mit hohem Schweregrad und erhielt dafür eine Prämie von 50.000 US-Dollar. Der Fund war ein frühes Beispiel dafür, wie KI gemeinsam mit menschlichen Sicherheitsforschern Schwachstellen in realer Software identifizieren kann.
Anthropic hat den Zugang zur öffentlichen Betaversion von Mythos 5, seinem spezialisierten Cybersicherheitsmodell, für berechtigte Claude-Enterprise-Kunden geöffnet. Das Modell ist über das Claude-Security-Plugin verfügbar; die Nutzung wird über das bestehende Token-Kontingent der jeweiligen Organisation abgerechnet. Berechtigte Kunden müssen das Plugin mit den Repositories verbinden, deren Prüfung sie durch Claude autorisieren.
Mehr Zugang für Verteidiger
Anthropic veröffentlichte die Modelle der Mythos-Klasse erstmals im April dieses Jahres für einige ausgewählte Organisationen wie Microsoft, JPMorgan Chase und die Linux Foundation im Rahmen eines Programms namens Project Glasswing. Der erste Rollout war auf eine kleine Gruppe teilnehmender Organisationen begrenzt, sodass die Funktion für die meisten Unternehmenskunden nicht verfügbar war.
Im Rahmen des erweiterten Rollouts können berechtigte Claude-Enterprise-Nutzer das Modell auffordern, ein autorisiertes GitHub-Repository zu prüfen, potenzielle Schwachstellen aufzuzeigen und Entwicklern zu überprüfende Patches zu empfehlen.
Für jede Sicherheitslücke liefert Claude „eine CWE-Kategorie (Common Weakness Enumeration), Angaben zur Zuverlässigkeit und zum Schweregrad sowie einen Lösungsvorschlag.“
Vor der Implementierung eines Lösungsvorschlags ist die Zustimmung eines Menschen erforderlich. Dieser Human-in-the-Loop-Ansatz soll sicherstellen, dass Entwickler die Kontrolle behalten, und das Risiko verringern, einen fehlerhaften oder unvollständigen Patch anzuwenden.
Darüber hinaus gibt das Mythos-Modell dem Nutzer nur bestimmte Ausgaben wie die Schwachstelle oder den Patch. Wenn der Nutzer versucht, das Modell aufzufordern, einen Angriff wie das Abziehen von Daten durchzuführen, würde es diese Anfrage ablehnen.
Diese Sicherheitsvorkehrung stellt sicher, dass Entwickler Mythos nur für legitime Zwecke einsetzen.
Einige Sicherheitsexperten können legitime Gründe haben, das Modell sowohl für offensive als auch defensive Tests zu verwenden, etwa zur Entwicklung oder Bewertung von Sicherheitstools. Anthropic fordert berechtigte Fachleute, die Zugang zu risikoreicheren Dual-Use-Funktionen benötigen, dazu auf, sich für sein Cyber Verification Program zu bewerben, um angepasste Sicherheitsvorkehrungen zu erhalten.
Menschliche Experten weiterhin erforderlich
Eine der größten Herausforderungen bei KI-gestützten Sicherheitsaudits besteht darin, festzustellen, welche Funde echt und ausnutzbar sind. Eine gemeldete Schwachstelle kann ein Fehlalarm sein, unter realen Bedingungen möglicherweise nicht ausnutzbar sein oder ein zu geringes Risiko darstellen, um eine sofortige Behebung zu rechtfertigen.
Nikos Baxevanis, Protocol-Sicherheitsingenieur bei der Ethereum Foundation, sagte: „Die Überraschung war, wie wenig Arbeit in das Auffinden der Schwachstellen floss und wie viel darin, die tatsächlichen Fehler von denen zu unterscheiden, die nur echt aussahen.“
Dies bezog sich auf einen KI-gestützten Sicherheitsscan, den er zusammen mit dem Protocol-Team im vergangenen Monat durchführte, um Schwachstellen in der Ethereum-Node-Software aufzudecken.
Die Fähigkeiten dieser neuen Frontier-Modelle lassen sich nicht ignorieren. Sie ermöglichen es Entwicklern bereits, Zero-Day-Angriffe aufzudecken, und statten Verteidiger zugleich mit hochmodernen Werkzeugen zur Abwehr böswilliger Akteure aus.
Neben der Bereitstellung moderner Werkzeuge hat Anthropic mitgeteilt, dass das Unternehmen Open-Source-Projekten, die auf KI-gestützte Sicherheit zugreifen möchten, 35 Millionen US-Dollar an Guthaben zur Verfügung stellt.
Für Sicherheitsteams von Unternehmen könnte Mythos 5 die Prüfung von Repositories beschleunigen und dabei helfen, potenzielle Schwachstellen zu priorisieren. Die Ergebnisse sollten jedoch eher als Hinweise denn als abschließende Urteile betrachtet werden. Organisationen benötigen weiterhin erfahrene Sicherheitsexperten, die die Ausnutzbarkeit validieren, vorgeschlagene Patches prüfen und entscheiden, welche Funde eine Behebung rechtfertigen.
Weiterlesen: Anthropics Project Glasswing deutet auf einen möglichen KI-getriebenen Wandel in der Cybersicherheit hin erläutert, wie das frühere Programm des Unternehmens gemeinsam mit einer begrenzten Gruppe von Sicherheitspartnern die KI-gestützte Erforschung von Schwachstellen erprobte.





