Notatki z pola

Blog SwarmAttacker: notatki z roju.

Zbudowaliśmy autonomicznego agenta testów penetracyjnych, który zawodowo włamuje się do aplikacji webowych. Po drodze wiele utartych prawd o promptowaniu LLM okazało się błędnych. Oto, co naprawdę pokazały dane. Jesteś tu nowy? Zacznij od tego, jak działa SwarmAttacker lub wyników benchmarku.

12 wpisów

Pytania, które ludzie zadają o SwarmAttacker

Czym jest SwarmAttacker?

SwarmAttacker to otwartoźródłowy, autonomiczny agent testów penetracyjnych typu black-box. Podaj mu adres URL, a rój agentów LLM mapuje cel, znajduje podatności i raportuje, co znalazł. Kod jest na licencji MIT i darmowy na GitHubie.

Jak SwarmAttacker jest testowany w benchmarku?

Każda opublikowana liczba pochodzi z benchmarku walidacyjnego XBOW: 104 realne, skonteneryzowane, podatne aplikacje webowe, każda z ukrytą flagą, atakowane w trybie black-box wyłącznie z adresu URL. SwarmAttacker rozwiązuje 94% z nich w jednym przebiegu, wobec 85% najlepszego z pięciu pentesterów-ludzi.

Na jakich modelach działa SwarmAttacker?

Domyślnie steruje GPT-5.x poprzez subskrypcję ChatGPT Plus lub Pro przez backend Codex, więc nie ma klucza API ani rachunku za tokeny. Działa też na API OpenAI, Anthropic, OpenRouter lub modelu lokalnym; nasz wpis o benchmarku odmów pokazuje, które z 16 modeli faktycznie wykonają pracę z zakresu bezpieczeństwa.

Czy uruchamianie SwarmAttacker jest legalne?

Wyłącznie wobec systemów, które są twoją własnością lub do których testowania masz wyraźną autoryzację. SwarmAttacker to narzędzie do autoryzowanych testów penetracyjnych, a jego praca nad odmowami filtrów bezpieczeństwa istnieje po to, by autoryzowane testy nie były blokowane, a nie po to, by umożliwiać ataki na cele, do których nie masz uprawnień.