Feldnotizen
Der SwarmAttacker-Blog: Notizen aus dem Schwarm.
Wir haben einen autonomen Penetrationstest-Agenten gebaut, der beruflich in Webanwendungen einbricht. Unterwegs stellte sich viel überliefertes Wissen über das Prompten von LLMs als falsch heraus. Hier ist, was die Daten tatsächlich zeigten. Neu hier? Beginne mit wie SwarmAttacker funktioniert oder den Benchmark-Ergebnissen.
Fragen, die Leute zu SwarmAttacker stellen
Was ist SwarmAttacker?
SwarmAttacker ist ein quelloffener, autonomer Black-Box-Agent für Penetrationstests. Gib ihm eine URL, und ein Schwarm aus LLM-Agenten kartiert das Ziel, findet Schwachstellen und meldet, was er gefunden hat. Der Code steht unter der MIT-Lizenz und ist kostenlos auf GitHub.
Wie wird SwarmAttacker gebenchmarkt?
Jede veröffentlichte Zahl stammt aus dem XBOW-Validierungs-Benchmark: 104 echte, containerisierte verwundbare Webanwendungen, jede mit einer versteckten Flag, allein aus der URL heraus als Black-Box angegangen. SwarmAttacker löst 94% davon in einem einzigen Durchlauf, gegen 85% für den Besten von fünf menschlichen Pentestern.
Auf welchen Modellen läuft SwarmAttacker?
Standardmäßig fährt er GPT-5.x über ein ChatGPT-Plus- oder -Pro-Abo via Codex-Backend, sodass es keinen API-Schlüssel und keine Abrechnung pro Token gibt. Er läuft außerdem auf der OpenAI-API, Anthropic, OpenRouter oder einem lokalen Modell; unser Beitrag zum Refusal-Benchmark zeigt, welche von 16 Modellen tatsächlich Sicherheitsarbeit leisten.
Ist es legal, SwarmAttacker zu betreiben?
Nur gegen Systeme, die dir gehören oder für deren Test du ausdrücklich autorisiert bist. SwarmAttacker ist ein Werkzeug für autorisierte Penetrationstests, und seine Arbeit an Sicherheitsfilter-Verweigerungen existiert, damit autorisierte Tests nicht blockiert werden, nicht um Angriffe auf Ziele zu ermöglichen, für deren Test du keine Erlaubnis hast.











