01 Was passiert ist

Forscher von Anthropic haben dokumentiert, dass GLM-5.3 in der Lage ist, Schwachstellen autonom zu entdecken und zu funktionalen Cyber-Exploits zu verketten, was Bedenken hinsichtlich der breiten Verfügbarkeit fortschrittlicher Angriffswerkzeuge weckt.

02 Die wichtigsten Details

  • Das Modell identifizierte und verkettete erfolgreich unbekannte Schwachstellen in einer JavaScript-Engine, wodurch es Dateien auf einem Host-System auslesen konnte.
  • GLM-5.3 entwickelte in 50 von 410 Versuchen auf dem ExploitBench-Benchmark funktionsfähige End-to-End-Exploits.
  • Das NIST Center for AI Standards and Innovation (CAISI) stufte GLM-5.3 als das bisher leistungsfähigste Modell mit offenen Gewichten im Bereich Cyber-Fähigkeiten ein.
  • Sicherheitsmaßnahmen können durch irreführende Prompts oder das Vorausfüllen von Thinking-Tokens umgangen werden, was zu einer bis zu 92-prozentigen Compliance bei schädlichen Anfragen führt.

03 Warum das wichtig ist

Die Veröffentlichung eines leistungsstarken Modells mit offenen Gewichten, das zu autonomen Angriffen fähig ist, verändert die Bedrohungslage und zwingt Entwickler sowie Sicherheitsexperten, automatisierte Hochgeschwindigkeits-Schwachstellenforschung in ihre Abwehrstrategien einzubeziehen.

04 Für wen es relevant ist

Cybersecurity-Experten, KI-Entwickler und Bedrohungsanalysten.

OriginalquelleAnthropic